Ga naar hoofdinhoud

Spraakmodus

Spraakmodus verandert een chat in een handsfree gesprek om de beurt: Libre luistert, schrijft wat je zei uit, genereert een antwoord en spreekt het uit — en luistert daarna opnieuw. Onderbreek een gesproken antwoord door er gewoon doorheen te praten. Alles verloopt via dezelfde spraak-naar-tekst- en tekst-naar-spraakcontracten als de dicteer- en voorleesfuncties van de opsteller; Spraakmodus voegt alleen coördinatie toe, nooit een nieuw audiopad.

Een gesprek beginnen

Open een chat en druk naast de microfoon in de opsteller op de knop voor Spraakmodus. De knop verschijnt wanneer spraakinvoer beschikbaar is: via een spraak-naar-tekstmodel van een provider (dezelfde catalogus als dicteren in de opsteller, beschreven op de pagina over spraak-naar-tekst) of via de eigen spraakherkenning van de browser. Gesproken antwoorden gebruiken je ingestelde tekst-naar-spraakmodel en stem, inclusief een opgeslagen stem met actieve toestemming. Het openingsgebaar bereidt dit meteen voor volgens het autoplaybeleid van de browser.

De gesprekscyclus

Er is één beurt tegelijk actief, die vier zichtbare fasen doorloopt:

FaseWat er gebeurt
LuisterenDe microfoon neemt op; een pauze van ongeveer 1.5 s beëindigt je beurt
UitschrijvenDe geselecteerde provider of browser schrijft de opname uit
DenkenHet transcript wordt als normaal chatbericht verzonden en het antwoord wordt gegenereerd
SprekenHet antwoord wordt afgespeeld via je tekst-naar-spraakinstellingen

Bediening terwijl de overlay open is:

  • Klaar met spreken beëindigt je beurt onmiddellijk — handig in rumoerige ruimten of wanneer geen audioanalyse beschikbaar is voor automatische eindpuntdetectie.
  • Dempen pauzeert de opname zonder het gesprek te verlaten; dempen opheffen start een nieuwe beurt.
  • Antwoord overslaan stopt het afspelen en keert terug naar luisteren.
  • Inbreken: begin te praten terwijl het antwoord wordt afgespeeld; het afspelen stopt en er wordt weer naar je volgende beurt geluisterd.
  • Sluiten breekt de sessie af: de microfoonstroom stopt, een lopende transcriptie wordt afgebroken en het afspelen wordt geannuleerd.

Fouten beëindigen het gesprek nooit. Een microfoonfout, geweigerde opname, transcriptiefout of antwoordtime-out wordt in de interface getoond, waarna Spraakmodus weer naar de volgende beurt luistert.

Beheer en privacy

Spraakmodus valt onder een eigen toegangsmodus (voice-mode) op de kaart Spraaktoegang in Gebruikersbeheer, los van spraak-naar-tekst, tekst-naar-spraak en stemklonen; de omgevingsvariabele VOICE_MODE_ACCESS_MODE zet deze vast. Transcriptie en spraaksynthese hebben ook hun eigen functiebeperkingen, dus beperking van een ervan schakelt dat deel van de cyclus uit. Opnamen volgen het spraak-naar-tekstcontract: gevalideerd, begrensd en tijdelijk. De audio van een beurt bestaat alleen lang genoeg om te worden uitgeschreven en alleen het transcript komt als normaal bericht in de chat terecht.

Grenzen

  • Spraakmodus werkt om de beurt, niet full-duplex: microfoonaudio en modelspraak worden niet gelijktijdig via één realtimeverbinding gestreamd.
  • Automatische eindpuntdetectie en inbreken vereisen audioanalyse; wanneer de browser die niet kan leveren, beëindigt Klaar met spreken de beurt handmatig.
  • Beurtelingse antwoorden worden één voor één uitgevoerd; woorden die tijdens het inbreken worden gesproken, komen niet in het transcript van de volgende beurt terecht.