Sari la conținutul principal

Mod vocal

Modul vocal transformă chat-ul într-o conversație hands-free pe rând: Libre ascultă, transcrie, generează răspunsul, îl rostește și ascultă din nou. Întrerupeți răspunsul vorbind peste el. Totul folosește aceleași contracte speech-to-text și text-to-speech ca dictarea și citirea; modul adaugă doar orchestrare, nu o cale audio nouă.

Pornirea conversației

Deschideți un chat și apăsați butonul de lângă microfon. Apare când este disponibil un model speech-to-text sau recunoașterea browserului. Răspunsurile folosesc modelul și vocea TTS configurate, inclusiv una salvată cu consimțământ, iar gestul inițial pregătește autoplay.

Bucla conversației

FazăCe se întâmplă
AscultareMicrofonul înregistrează; o pauză de circa 1,5 s încheie tura
TranscriereFurnizorul sau browserul transcrie
GândireTextul devine mesaj normal și se generează răspunsul
RostireRăspunsul este redat prin setările TTS
  • Done speaking încheie imediat tura, util în zgomot.
  • Mute oprește captarea; reluarea începe o tură nouă.
  • Skip reply oprește redarea și revine la ascultare.
  • Barge-in: vorbiți peste răspuns pentru a-l opri.
  • Close oprește sesiunea, microfonul, transcrierea și redarea.

Erorile nu încheie conversația. Eroarea microfonului, înregistrarea respinsă, transcrierea eșuată sau timeout-ul apar inline, apoi se reia ascultarea.

Guvernanță și confidențialitate

Modul are acces propriu (voice-mode) în Voice access din User Management, separat de STT, TTS și clonare. VOICE_MODE_ACCESS_MODE îl fixează. Transcrierea și sinteza au porți proprii. Înregistrările sunt validate, limitate și efemere; doar transcrierea intră în chat.

Limite

  • Este pe rând, nu full-duplex: nu transmite simultan microfonul și vocea modelului.
  • Detectarea automată și barge-in cer analiză audio; altfel folosiți Done speaking.
  • Răspunsurile rulează câte unul; cuvintele din barge-in nu intră în următoarea transcriere.