LiveLingoLiveLingoTry free

GPT-Live Vertaling: Functies, Limieten en Gemeten Latentie (2026)

GPT-Live-1 en GPT-Live-1 mini zijn OpenAI's full-duplex spraakmodellen: ze luisteren en spreken tegelijkertijd, en live vertaling is een van de kernfuncties. Ze debuteerden op 8 juli 2026 in ChatGPT en bereikten op 10 september 2026 de OpenAI API, waardoor de vertaalclaim eindelijk gemeten kan worden in plaats van aangenomen. Deze gids behandelt wat er is uitgebracht, hoe vertaling er daadwerkelijk werkt, en wat onafhankelijke metingen nu over de limieten laten zien.

Belangenverstrengeling

Deze gids wordt gepubliceerd door LiveLingo (Lunana Global Inc.), een spraakvertaalproduct dat concurreert met de spraakvertaling van ChatGPT. Wij hebben een financieel belang bij de adoptie van LiveLingo. Feitelijke claims over GPT-Live zijn gebaseerd op OpenAI's aankondiging, system card en ontwikkelaarsdocumentatie, en op onafhankelijke lanceringsberichtgeving, allemaal inline en in de sectie Bronnen gelinkt. De metingen in Sectie 5 zijn LiveLingo's eigen metingen, uitgevoerd via de OpenAI API op dezelfde audio die elk ander systeem kreeg, met de data per clip gepubliceerd op livelingo.io/research/gpt-live-1-interpreter-test voor onafhankelijke verificatie.

Snel antwoord: kan GPT-Live realtime vertalen?

Ja, en het houdt de tolkenrol betrouwbaar vast, maar het raakt bij doorlopende spraak steeds verder achterop. Start in ChatGPT een Voice-sessie en zeg iets als "vertaal simultaan alles wat ik zeg naar het Spaans." Omdat de modellen full-duplex zijn, streamt de vertaling terwijl je nog aan het praten bent. Gratis accounts krijgen GPT-Live-1 mini; de betaalde Go-, Plus- en Pro-plannen krijgen GPT-Live-1. Sinds 10 september 2026 kunnen ontwikkelaars het model ook rechtstreeks aanroepen als gpt-live-1 op v1/live/sessions, voor $0.05 per minuut plus het gebruik van het backend-model. Gemeten over een sessie van 452 seconden liep de voltooiingsvertraging op van 5,7 seconden naar een plateau van 10 tot 14 seconden bij Engels naar Spaans, en bij Engels naar Japans vertaalde het slechts 17% van de zinnen binnen 30 seconden.

1. Wat OpenAI Uitbracht, en Wat in September Veranderde

OpenAI kondigde GPT-Live aan op woensdag 8 juli 2026 in een blogpost en livestream (Introducing GPT-Live). Er verschenen twee modellen: GPT-Live-1, het nieuwe standaard spraakmodel voor de betaalde Go-, Plus- en Pro-plannen, en GPT-Live-1 mini, de nieuwe standaard voor gratis accounts (volgens MacRumors en The Decoder). Beide vervangen Advanced Voice Mode als de standaard voor ChatGPT Voice, waarbij de oude modus selecteerbaar blijft in de spraakinstellingen.

Op 10 september 2026 bereikten de modellen de OpenAI API, veruit de belangrijkste verandering sinds de lancering. GPT-Live-1 is nu aan te roepen als gpt-live-1 op het endpoint v1/live/sessions, geprijsd op $0.05 per gespreksminuut voor de spraaklaag, waarbij het backend-model dat het redeneren afhandelt apart wordt afgerekend (modelreferentie). Tot dan rustte de vertaalclaim op OpenAI's demo en persberichten. Nu kan die rechtstreeks gemeten worden, en dat is precies wat Sectie 5 doet.

Het bepalende kenmerk is full-duplex audio: het model verwerkt wat het hoort terwijl het spreekt en neemt vele malen per seconde interactiebeslissingen. Het kan daardoor natuurlijk onderbroken worden, reageren met tussenwerpsels ("mhmm," "got it") terwijl jij praat, of stil blijven terwijl je nadenkt (MarkTechPost). Voor alles wat webzoeken, dieper redeneren of agentisch werk vereist, delegeert GPT-Live op de achtergrond aan GPT-5.5 en houdt het gesprek gaande terwijl het resultaat terugkomt. Gebruikers kunnen kiezen uit drie redeneerniveaus (Instant, Medium, High); de hogere niveaus gaan naar GPT-5.5 Thinking.

OpenAI's gepubliceerde evaluaties richten zich op capaciteit in plaats van snelheid: op het niveau High scoort GPT-Live-1 84,2% op GPQA tegenover 45,3% voor Advanced Voice Mode, en 75,2% op BrowseComp tegenover 0,7%. In menselijke voorkeurstests werd GPT-Live-1 in 75,7% van de gesprekken verkozen boven Advanced Voice Mode, en mini in 69,2% (The Decoder, met verwijzing naar OpenAI's aankondiging). Onafhankelijk daarvan plaatst Artificial Analysis GPT-Live-1 op de tweede plek in het totaalklassement van zijn Speech-to-Speech index, met een score van 81,5 en 1,34 seconde tot de eerste audio. Latentiecijfers specifiek voor vertaling publiceert OpenAI nog steeds niet.

2. Hoe Live Vertaling op GPT-Live Werkt

Live vertaling is een van de functies die OpenAI expliciet in het lanceringsmateriaal benoemt: de full-duplex architectuur laat het model "natuurlijker heen-en-weer praten, een beter tijdsgevoel houden en zelfs live vertaling uitvoeren" (OpenAI-aankondiging). In persbriefings demonstreerde OpenAI het model dat een doorlopende vertaling uitsprak terwijl de presentator praatte.

Het is een prompt, geen modus

Er is geen vertaalschakelaar, taalpaarkiezer of aparte vertaal-UI. Je start een Voice-sessie en instrueert de assistent: "Ik wil dat je alles wat ik zeg simultaan naar het Hindi vertaalt." Het model spreekt vervolgens een vertaling uit terwijl jij praat, en gaat door tot je zegt te stoppen of te wisselen. Dit is hetzelfde prompt-gestuurde patroon dat ChatGPT Voice al had sinds de Realtime-release van mei 2026; wat veranderde is de full-duplex weergave, waardoor de vertaling je spraak kan overlappen in plaats van te wachten tot je beurt voorbij is.

De rol houdt stand, en dat is niet vanzelfsprekend

De voor de hand liggende faalwijze van een conversatiemodel dat moet tolken, is dat het de spreker antwoordt in plaats van hem te vertalen. Dat gebeurde niet. Over 27 minuten getolkte audio in gemeten tests, verdeeld over Engels naar Spaans, Engels naar Japans en Chinees naar Engels, reageerde het geen enkele keer op de spreker in plaats van te vertalen: geen verduidelijkende vragen, geen commentaar, geen terugval in assistentgedrag. Het opvolgen van instructies is niet waar dit misgaat.

De assistent-eerst afweging

GPT-Live is een algemene conversatie-assistent die op verzoek vertaalt, geen dedicated tolk, en die vorm heeft gevolgen voor het tempo in plaats van voor de gehoorzaamheid. Een conversatiemodel spreekt op een natuurlijk tempo en comprimeert of schrapt niets wanneer het achterop raakt. Tolken vraagt precies het omgekeerde: de spreker gaat sowieso door, dus een systeem dat het niet bijhoudt moet samenvatten, overslaan of een onbegrensde vertraging accepteren. In de consumenten-app injecteert het meepraatgedrag dat een gesprek natuurlijk laat voelen ("mhmm," "yeah") bovendien niet-vertaalaudio in een vertaalsessie, en gebruikers op dag één meldden dat breed als storend (BigGo).

3. GPT-Live vs OpenAI's Speciaal Gebouwde Vertaler

OpenAI levert twee verschillende oppervlakken voor live vertaling, en het zijn verschillende stacks. Op 7 mei 2026 bracht OpenAI gpt-realtime-translate uit in de Realtime API: een speciaal gebouwd streaming spraak-naar-spraak vertaalmodel, getraind op duizenden uren audio van professionele tolken en geconfigureerd om vertaal-alleen te blijven en op voldoende context te wachten voordat het spraak produceert (OpenAI-aankondiging). GPT-Live is de algemene full-duplex assistent die vertaalt wanneer je erom vraagt. Beide zijn nu beschikbaar voor ontwikkelaars, waardoor een directe vergelijking voor het eerst mogelijk is.

OpenAI's twee oppervlakken voor live vertaling per 16 september 2026. Feiten volgens OpenAI's aankondigingen en ontwikkelaarsdocumentatie; metingen volgens LiveLingo Research.
GPT-Live (gpt-live-1)gpt-realtime-translate
Wat het isFull-duplex spraakassistent; vertaling via promptDedicated streaming spraak-naar-spraak vertaalmodel
UitgebrachtChatGPT 8 juli 2026; API 10 september 20267 mei 2026
ToegangChatGPT-app plus API-endpoint /v1/live/sessionsRealtime API, endpoint /v1/realtime/translations
PrijsInbegrepen in ChatGPT-plannen; $0.05/min via API plus backend-model$0.034 per minuut audio
TalenNiet gepubliceerd; "de meeste gesproken talen," accenthiaten gemeld70+ invoertalen; 13 uitvoertalen (gedocumenteerd)
Blijft in vertalersrolJa, mits geïnstrueerd; nul rolbreuken in 27 minuten testenJa; vertaal-alleen by design, geen systeemprompts
Voltooiingsvertraging, en→es11,72 s mediaan, oplopend naar een plateau van 10–14 s2,65 s mediaan, vlak
Japanse dekking binnen 30 s17%98%
TranscriptiesTranscriptdelta's van bron en outputTekstdelta's van bron- en vertaalde spraak

De 13 gedocumenteerde uitvoertalen van gpt-realtime-translate: Engels, Spaans, Portugees, Frans, Duits, Italiaans, Russisch, Chinees, Japans, Koreaans, Hindi, Indonesisch en Vietnamees (OpenAI Cookbook). Voor GPT-Live publiceert OpenAI nog steeds geen talenlijst, dus gemeten gedrag is de enige leidraad, en dat verschilt enorm per taal.

Twee correcties uit de lanceringsweek die expliciet gemaakt moeten worden, omdat vroege berichtgeving beide door elkaar haalde. Ten eerste: de cijfers "$32 per miljoen audio-invoertokens, $64 output" die in sommige posts circuleerden, horen bij gpt-realtime-2, een ander model; GPT-Live-1 kost $0.05 per minuut voor de spraaklaag plus het backend-model. Ten tweede: de claim dat GPT-Live "geen API" heeft, klopte alleen in juli en is inmiddels achterhaald. Sinds 10 september 2026 is het model gewoon aan te roepen als gpt-live-1 op v1/live/sessions (modelreferentie).

4. Limieten Die OpenAI en Onafhankelijke Tests Blootleggen

  • De achterstand stapelt op bij doorlopende spraak. De gemeten voltooiingsvertraging liep bij Engels naar Spaans binnen drie minuten op van 5,7 seconden naar een plateau van 10 tot 14 seconden, en bleef daar de rest van de sessie.
  • Japans zakt ernstig weg. 17% van de zinnen werd binnen 30 seconden vertaald, tegenover 98% voor hetzelfde model naar het Spaans, en 20 van de 90 zinnen werden helemaal nooit vertaald.
  • Gebruikslimieten zijn reëel maar niet gepubliceerd. OpenAI's helpcentrum stelt dat de gebruikslimieten voor spraak per plan en Voice-optie verschillen en kunnen wijzigen. Meldingen van specifieke cijfers door derden spreken elkaar tegen; behandel elk specifiek cijfer als ongeverifieerd.
  • Geen officiële latentiecijfers. OpenAI bracht capaciteitsbenchmarks uit (GPQA, BrowseComp, voorkeurspercentages) maar geen metingen van eerste-audio latentie of achterstand bij vertaling.
  • Taaldekking is ongedocumenteerd. "De meeste gesproken talen," met niet-moedertaalaccenten en vloeiendheidshiaten gemeld voor andere talen.
  • Tussenwerpsels kunnen niet volledig uitgeschakeld worden in de consumenten-app, hoewel een expliciete vertaal-alleen instructie in API-tests zonder uitzondering standhield.
  • Veiligheidsmonitoring kan ingrijpen. Volgens de GPT-Live system card kan realtime monitoring een antwoord bijsturen of onderbreken, een gesproken veiligheidsbericht afspelen, of gesprekken met hoog risico beëindigen.

5. Wat Onafhankelijke Metingen Tonen

Wat we hebben gemeten (en wat niet)

Deze cijfers komen van gpt-live-1 via de OpenAI API, geprompt om als simultaantolk op te treden, gemeten op 15 september 2026. Het zijn geen metingen van de ChatGPT-consumentenervaring: gratis accounts draaien GPT-Live-1 mini, en de app voegt client-side spraakdetectie en eigen prompting toe die geen testopstelling kan isoleren. Elk systeem in de vergelijking kreeg identieke audio op identiek realtime tempo, en de data per clip is gepubliceerd op livelingo.io/research/gpt-live-1-interpreter-test.

Voltooiingsvertraging is het moment waarop de vertaling van een zin volledig is uitgesproken, minus het moment waarop de spreker die zin afmaakte. Eén doorlopende stream van 452 seconden, 90 zinnen, identieke audio voor elk systeem. Volledige methodologie: /research/gpt-live-1-interpreter-test.
SysteemVertraging en→esVertraging en→jaJapanse dekking binnen 30 sOver de sessie
LiveLingo0,94 s0,88 s100%Vlak
Gemini 3.5 Live Translate1,51 s1,92 s99%Vlak
OpenAI gpt-realtime-translate2,65 s3,33 s98%Vlak
GPT-Live-1 (geprompt)11,72 sn.v.t.17%Loopt op tot 10–14 s

Het valt nooit uit zijn rol. Over 27 minuten getolkte audio antwoordde het de spreker geen enkele keer in plaats van hem te vertalen, in beide richtingen. Dat is werkelijk lastig, en de dedicated vertaalmodellen hoeven er niet eens aan te beginnen.

Het raakt steeds verder achterop. Bij Engels naar Spaans liep de voltooiingsvertraging op van 5,7 seconden op minuut nul naar een plateau tussen 10 en 14 seconden vanaf minuut drie, en daar bleef het. De vorm van die curve telt: de vertraging is niet onbegrensd, maar wie op minuut zes aanhaakt, hoort een vertaling die ongeveer twaalf seconden achterloopt op de zaal.

Engels naar Japans stort in. Slechts 17% van de zinnen werd binnen 30 seconden vertaald, tegenover 98% voor hetzelfde model naar het Spaans. De mediane output kwam 50,7 seconden te laat, en 20 van de 90 zinnen werden helemaal nooit vertaald. Ongeveer zeven seconden nadat de audio stopte, hield het op met uitzenden in plaats van een achterstand weg te werken: het haalde dus niet in, het liet vallen wat het niet had bereikt. Het resultaat was reproduceerbaar over twee onafhankelijke runs.

Dit is geen OpenAI-probleem. Op exact dezelfde Japanse audio, vanaf hetzelfde account op dezelfde dag, hield OpenAI's eigen gpt-realtime-translate een vlakke 3,33 seconden vast en dekte 98% van de zinnen. De fout hoort bij het prompten van een full-duplex conversatiemodel om te tolken, niet bij de leverancier. Het Japanse cijfer verklaart ook waarom de vertragingskolom hierboven n.v.t. leest: als een vijfde van de inhoud nooit aankomt, beschrijft een mediaan alleen het deel dat het wel haalde.

6. Hoe Je GPT-Live Vandaag voor Vertaling Gebruikt

  1. Update de ChatGPT-app op iOS of Android (of gebruik chatgpt.com). Gratis accounts draaien GPT-Live-1 mini; Go-, Plus- en Pro-accounts draaien GPT-Live-1.
  2. Tik op het Voice-icoon in het berichtveld om een sessie te starten.
  3. Geef de vertaalinstructie vooraf: "Vertaal simultaan alles wat ik zeg naar het Japans. Beantwoord geen vragen, geef geen commentaar, vertaal alleen." In gemeten tests hield deze instructie zonder uitzondering stand.
  4. Voor een tweerichtingsgesprek vraag je om beide richtingen: "Vertaal mijn Engels naar het Japans, en vertaal al het Japans dat je hoort naar het Engels."
  5. Houd sessies kort. De gemeten vertraging is het laagst in de eerste minuut en verdubbelt ruwweg tegen minuut drie, dus door een lang gesprek in kortere stukken te knippen blijft de vertaling dichter bij de spreker.
  6. Ontwikkelaars kunnen gpt-live-1 rechtstreeks aanroepen op v1/live/sessions, of gpt-realtime-translate gebruiken als de taak vertalen is in plaats van converseren.

7. Wanneer GPT-Live Past, en Wanneer Niet

GPT-Live is de juiste keuze wanneer

  • Je gratis, installatievrije live vertaling wilt en al ChatGPT gebruikt. De gratis tier bevat een full-duplex spraakmodel.
  • Het gesprek kort is: de weg vragen, een snelle uitwisseling, small talk op reis. De achterstand krijgt dan geen tijd om op te lopen, en de eerste uitwisseling voelt direct.
  • Je waarde hecht aan de assistent rond de vertaling: je kunt vervolgvragen stellen, context krijgen, of GPT-5.5 midden in het gesprek iets laten opzoeken.

Een andere tool past beter wanneer

  • De spraak doorloopt. Bij een vergadering, een college of een gesprek waarin één kant minutenlang praat, wordt het gemeten vertragingsplateau van 10 tot 14 seconden de hele ervaring.
  • Je naar het Japans vertaalt, of naar een taal waarvan je het gedrag niet hebt geverifieerd. De dekking varieerde van 98% tot 17% tussen twee talen op hetzelfde model.
  • Je tijdens het luisteren een leesbaar tweetalig transcript nodig hebt. GPT-Live geeft je een chatlog, geen weergave van bron en vertaling naast elkaar die zichzelf nooit herschrijft.
  • Je vertaalde telefoongesprekken nodig hebt. Geen van de OpenAI-oppervlakken belt een telefoonnummer. LiveLingo plaatst uitgaande gesprekken naar gewone telefoonnummers met vertaling op de lijn, waarbij de ontvanger geen app nodig heeft.

Een eerlijke concessie. LiveLingo (de uitgever van deze gids) zit in de categorie dedicated vertalers, dus lees de vergelijking met dat in het achterhoofd. GPT-Live's conversationele natuurlijkheid is een echte vooruitgang, zijn full-duplex beurtwisseling loopt voor op elke dedicated vertaal-app inclusief de onze, zijn gratis tier maakt het de makkelijkste manier om vandaag live spraakvertaling te proberen, en het hield de tolkenrol 27 minuten vast zonder één misstap. Wat het niet doet, is het tempo bijhouden van een spreker die niet wacht. Specificaties naast elkaar: /compare/chatgpt-translation. Volledige metingen: /research/gpt-live-1-interpreter-test.

8. Veelgestelde Vragen

Wat is GPT-Live?

GPT-Live is OpenAI's familie van full-duplex spraakmodellen, gedebuteerd in ChatGPT op 8 juli 2026. Er verschenen twee modellen: GPT-Live-1 (standaard voor de betaalde Go-, Plus- en Pro-plannen) en GPT-Live-1 mini (standaard voor gratis gebruikers). Anders dan de Advanced Voice Mode die het vervangt, luistert en spreekt GPT-Live tegelijkertijd. Het kan daardoor natuurlijk onderbroken worden, meepraten terwijl jij spreekt, en live vertalen terwijl je nog aan het praten bent. Complexe vragen delegeert het op de achtergrond aan GPT-5.5. Het draait op iOS, Android en chatgpt.com, en sinds 10 september 2026 is het ook voor ontwikkelaars beschikbaar als gpt-live-1 in de OpenAI API.

Kan GPT-Live realtime vertalen?

Ja, en in gemeten tests brak het de tolkenrol geen enkele keer over 27 minuten audio. Vertaling activeer je met een prompt in plaats van een schakelaar: zeg tegen de assistent "vertaal simultaan alles wat ik zeg naar het Japans" en het spreekt een doorlopende vertaling uit terwijl jij praat. De beperking zit in het tempo, niet in de gehoorzaamheid: de voltooiingsvertraging liep op van 5,7 seconden naar een plateau van 10 tot 14 seconden bij Engels naar Spaans, over een sessie van 452 seconden.

Heeft GPT-Live een API?

Ja, sinds 10 september 2026. GPT-Live-1 is beschikbaar als het model gpt-live-1 op het endpoint v1/live/sessions, geprijsd op $0.05 per gespreksminuut voor de spraaklaag, waarbij het backend-model dat het redeneren afhandelt apart wordt afgerekend. Dat is veranderd sinds het ChatGPT-debuut op 8 juli, toen GPT-Live alleen in ChatGPT bestond. OpenAI levert daarnaast een apart, speciaal gebouwd vertaalmodel, gpt-realtime-translate, voor $0.034 per minuut met 70+ invoertalen en 13 uitvoertalen.

Hoeveel vertraging voegt GPT-Live toe bij vertalen?

Gemeten via de API op 15 september 2026: een mediaan van 11,72 seconden om een zin volledig uit te spreken bij Engels naar Spaans, binnen de sessie oplopend van 5,7 seconden op minuut nul naar een plateau van 10 tot 14 seconden vanaf minuut drie. Op identieke audio mat OpenAI's eigen gpt-realtime-translate 2,65 seconden, Gemini 3.5 Live Translate 1,51 seconden en LiveLingo 0,94 seconden, alle drie vlak over dezelfde 452 seconden in plaats van oplopend.

Waarom heeft GPT-Live moeite met vertalen naar het Japans?

Het raakt zo ver achterop dat het niet meer inhaalt. Slechts 17% van de Japanse zinnen werd binnen 30 seconden na het uitspreken vertaald, tegenover 98% voor hetzelfde model naar het Spaans, de mediane output kwam 50,7 seconden te laat, en 20 van de 90 zinnen werden helemaal nooit vertaald. Het resultaat was reproduceerbaar over twee runs. OpenAI's dedicated gpt-realtime-translate dekte op dezelfde audio 98% bij een vlakke 3,33 seconden, dus dit hoort bij het prompten van een conversatiemodel en is geen beperking van OpenAI's Japans.

Is GPT-Live gratis?

In ChatGPT wel, met een tier-splitsing. GPT-Live-1 mini is het standaard spraakmodel voor gratis accounts; de betaalde Go-, Plus- en Pro-plannen krijgen de grotere GPT-Live-1. Er is geen nieuw abonnement geïntroduceerd, en de gebruikslimieten voor spraak verschillen per plan zonder gepubliceerde minutenlimieten. De API staat daar los van en wordt afgerekend op $0.05 per minuut voor de spraaklaag plus het gebruik van het backend-model.

Welke talen ondersteunt GPT-Live voor vertaling?

OpenAI heeft geen talenlijst gepubliceerd. Het lanceringsmateriaal zegt dat spraak is geoptimaliseerd voor "de meeste gesproken talen" en meldt accent- en vloeiendheidshiaten voor andere talen. Het gemeten gedrag verschilt sterk per taal: hetzelfde model dekte 98% van de Spaanse zinnen binnen 30 seconden, maar slechts 17% van de Japanse. OpenAI's vertaalmodel voor ontwikkelaars, gpt-realtime-translate, documenteert 70+ invoertalen en 13 uitvoertalen: Engels, Spaans, Portugees, Frans, Duits, Italiaans, Russisch, Chinees, Japans, Koreaans, Hindi, Indonesisch en Vietnamees.

Hoe verhoudt GPT-Live zich tot Gemini Live voor vertaling?

Verschillende architecturale keuzes, en beide zijn nu meetbaar. GPT-Live is een full-duplex conversatie-assistent die op verzoek vertaalt. Google's Gemini 3.5 Live Translate is een dedicated streaming spraak-naar-spraak model. Op identieke audio van 452 seconden hield Gemini een vlakke voltooiingsvertraging van 1,51 seconde bij Engels naar Spaans en 1,92 seconde naar het Japans, terwijl gpt-live-1 opliep naar een plateau van 10 tot 14 seconden in het Spaans en slechts 17% van de Japanse zinnen binnen 30 seconden dekte. Een dedicated vertaalpad houdt een constante offset in plaats van vertraging op te stapelen.

Hoe schakel je vanuit GPT-Live terug naar Advanced Voice Mode?

Open de spraakinstellingen van ChatGPT en selecteer Advanced Voice Mode. GPT-Live verving het op 8 juli 2026 als standaard, maar OpenAI hield de oude modus selecteerbaar voor gebruikers die functies nodig hebben die GPT-Live niet ondersteunt, zoals video en schermdelen.

Hoe voorkom je dat GPT-Live onderbreekt of "mhmm" zegt?

Het meepraatgedrag kan in de consumenten-app niet volledig uitgeschakeld worden. De workaround is een expliciete instructie aan het begin van de sessie, zoals "vertaal alleen wat ik zeg, voeg verder niets toe." In gemeten API-tests hield die instructie volledig stand, met nul rolbreuken over 27 minuten, dus de tolkenrol zelf is betrouwbaar, ook al blijven conversationele tussenwerpsels in ChatGPT mogelijk. Blokkeert het gedrag je gebruiksscenario, dan blijft Advanced Voice Mode selecteerbaar in de spraakinstellingen.

Welke tool moet je nu gebruiken voor live gespreksvertaling?

Voor korte uitwisselingen is GPT-Live goed en gratis binnen ChatGPT. Voor doorlopende spraak zoals een vergadering, een college of een lang gesprek gebruik je een speciaal gebouwd pad. Gemeten op identieke audio van 452 seconden bedroeg de voltooiingsvertraging 0,94 seconde voor LiveLingo, 1,51 voor Gemini 3.5 Live Translate en 2,65 voor OpenAI's eigen gpt-realtime-translate, alle drie vlak, tegenover een oplopende 10 tot 14 seconden voor het geprompte gpt-live-1. Voor vertaalde gesprekken naar gewone telefoonnummers belt geen van de OpenAI-oppervlakken; dat is een andere productcategorie.

9. Bronnen

Bijgewerkt op 16 september 2026 omdat GPT-Live-1 op 10 september 2026 de OpenAI API bereikte, en om de eerste onafhankelijke metingen van zijn vertaalgedrag toe te voegen. Modelnamen, tier-indeling, endpoint en prijzen zijn op 16 september 2026 geverifieerd tegen OpenAI's ontwikkelaarsdocumentatie. De metingen gelden voor het API-model en niet voor de ChatGPT-consumentenervaring; OpenAI kan tiers, limieten, taaldekking en modelgedrag snel wijzigen.