Mod vocal
Modul vocal transformă chat-ul într-o conversație hands-free pe rând: Libre ascultă, transcrie, generează răspunsul, îl rostește și ascultă din nou. Întrerupeți răspunsul vorbind peste el. Totul folosește aceleași contracte speech-to-text și text-to-speech ca dictarea și citirea; modul adaugă doar orchestrare, nu o cale audio nouă.
Pornirea conversației
Deschideți un chat și apăsați butonul de lângă microfon. Apare când este disponibil un model speech-to-text sau recunoașterea browserului. Răspunsurile folosesc modelul și vocea TTS configurate, inclusiv una salvată cu consimțământ, iar gestul inițial pregătește autoplay.
Bucla conversației
| Fază | Ce se întâmplă |
|---|---|
| Ascultare | Microfonul înregistrează; o pauză de circa 1,5 s încheie tura |
| Transcriere | Furnizorul sau browserul transcrie |
| Gândire | Textul devine mesaj normal și se generează răspunsul |
| Rostire | Răspunsul este redat prin setările TTS |
- Done speaking încheie imediat tura, util în zgomot.
- Mute oprește captarea; reluarea începe o tură nouă.
- Skip reply oprește redarea și revine la ascultare.
- Barge-in: vorbiți peste răspuns pentru a-l opri.
- Close oprește sesiunea, microfonul, transcrierea și redarea.
Erorile nu încheie conversația. Eroarea microfonului, înregistrarea respinsă, transcrierea eșuată sau timeout-ul apar inline, apoi se reia ascultarea.
Guvernanță și confidențialitate
Modul are acces propriu (voice-mode) în Voice access din User Management, separat de
STT, TTS și clonare. VOICE_MODE_ACCESS_MODE îl fixează. Transcrierea și sinteza au
porți proprii. Înregistrările sunt validate, limitate și efemere; doar transcrierea
intră în chat.
Limite
- Este pe rând, nu full-duplex: nu transmite simultan microfonul și vocea modelului.
- Detectarea automată și barge-in cer analiză audio; altfel folosiți Done speaking.
- Răspunsurile rulează câte unul; cuvintele din barge-in nu intră în următoarea transcriere.