LiveLingoLiveLingoTry free

Traduzione GPT-Live: Funzioni, Limiti e Latenza Misurata (2026)

GPT-Live-1 e GPT-Live-1 mini sono i modelli vocali full-duplex di OpenAI: ascoltano e parlano allo stesso tempo, e la traduzione simultanea è una delle capacità di punta. Hanno debuttato in ChatGPT l'8 luglio 2026 e sono arrivati nell'API di OpenAI il 10 settembre 2026, il che significa che la promessa sulla traduzione può finalmente essere misurata invece che data per buona. Questa guida copre cosa è stato rilasciato, come funziona davvero la traduzione e cosa mostrano oggi le misurazioni indipendenti sui suoi limiti.

Conflitto di interessi

Questa guida è pubblicata da LiveLingo (Lunana Global Inc.), un prodotto di traduzione vocale che compete con la traduzione vocale di ChatGPT. Abbiamo un interesse economico nell'adozione di LiveLingo. Le affermazioni fattuali su GPT-Live sono ricondotte all'annuncio di OpenAI, alla system card e alla documentazione per sviluppatori, oltre alla copertura indipendente del lancio, tutte linkate nel testo e nella sezione Fonti. Le misurazioni della Sezione 5 sono di LiveLingo stessa, effettuate tramite l'API di OpenAI sullo stesso audio fornito a ogni altro sistema, con i dati per clip pubblicati su livelingo.io/research/gpt-live-1-interpreter-test per una verifica indipendente.

Risposta Rapida: GPT-Live può fare traduzione simultanea?

Sì, e mantiene il ruolo di interprete in modo affidabile, ma resta progressivamente indietro sul parlato continuo. In ChatGPT avvii una sessione vocale e di' qualcosa come "traduci simultaneamente tutto quello che dico in spagnolo." Poiché i modelli sono full-duplex, la traduzione fluisce mentre stai ancora parlando. Gli account gratuiti ricevono GPT-Live-1 mini; i piani a pagamento Go, Plus e Pro ricevono GPT-Live-1. Dal 10 settembre 2026 anche gli sviluppatori possono chiamarlo direttamente come gpt-live-1 su v1/live/sessions a $0.05 al minuto più il consumo del modello di backend. Misurato su una sessione di 452 secondi, il suo ritardo di completamento è salito da 5,7 secondi a un plateau tra 10 e 14 secondi dall'inglese allo spagnolo, e dall'inglese al giapponese ha tradotto entro 30 secondi solo il 17% delle frasi.

1. Cosa Ha Rilasciato OpenAI, e Cosa È Cambiato a Settembre

OpenAI ha annunciato GPT-Live mercoledì 8 luglio 2026 con un post sul blog e una diretta streaming (Introducing GPT-Live). Sono stati rilasciati due modelli: GPT-Live-1, il nuovo modello vocale predefinito per i piani a pagamento Go, Plus e Pro, e GPT-Live-1 mini, il nuovo predefinito per gli account gratuiti (secondo MacRumors e The Decoder). Entrambi sostituiscono Advanced Voice Mode come voce predefinita di ChatGPT, con la vecchia modalità che resta selezionabile nelle impostazioni vocali.

Il 10 settembre 2026 i modelli sono arrivati nell'API di OpenAI, ed è il cambiamento più importante dal lancio. GPT-Live-1 è ora richiamabile come gpt-live-1 sull'endpoint v1/live/sessions, al prezzo di $0.05 al minuto di conversazione per il livello vocale, con il modello di backend che gestisce il ragionamento fatturato separatamente (scheda del modello). Fino a quel momento la promessa sulla traduzione poggiava sulla demo di OpenAI e sui resoconti della stampa. Ora può essere misurata direttamente, ed è esattamente quello che fa la Sezione 5.

La caratteristica distintiva è l'audio full-duplex: il modello elabora ciò che sente mentre sta parlando, prendendo decisioni di interazione molte volte al secondo, quindi può essere interrotto in modo naturale, rispondere con segnali di ascolto ("mhmm," "capito") mentre parli, o restare in silenzio mentre pensi (MarkTechPost). Per tutto ciò che richiede ricerca web, ragionamento più profondo o lavoro agentico, GPT-Live delega a GPT-5.5 in background e mantiene viva la conversazione mentre il risultato arriva. Gli utenti possono scegliere tre livelli di ragionamento (Instant, Medium, High); i livelli più alti instradano verso GPT-5.5 Thinking.

Le valutazioni pubblicate da OpenAI si concentrano sulla capacità piuttosto che sulla velocità: al livello di ragionamento High, GPT-Live-1 ottiene 84,2% su GPQA contro il 45,3% di Advanced Voice Mode, e 75,2% su BrowseComp contro lo 0,7%. Nei test di preferenza umana, GPT-Live-1 è stato preferito ad Advanced Voice Mode nel 75,7% delle conversazioni, e mini nel 69,2% (The Decoder, citando l'annuncio di OpenAI). In modo indipendente, Artificial Analysis colloca GPT-Live-1 al secondo posto assoluto nel suo indice Speech-to-Speech con 81,5 punti e 1,34 secondi al primo audio. OpenAI continua a non pubblicare cifre di latenza specifiche per la traduzione.

2. Come Funziona la Traduzione Simultanea su GPT-Live

La traduzione in tempo reale è una delle capacità che OpenAI cita esplicitamente nei materiali di lancio: l'architettura full-duplex permette al modello di "impegnarsi in scambi più naturali, mantenere un miglior senso del tempo e persino eseguire traduzione simultanea" (annuncio di OpenAI). Nei briefing stampa, OpenAI ha mostrato il modello che pronunciava una traduzione continua mentre il presentatore parlava.

È un prompt, non una modalità

Non c'è alcun interruttore di traduzione, selettore di coppia di lingue o interfaccia di traduzione dedicata. Avvii una sessione vocale e istruisci l'assistente: "Vorrei che traducessi simultaneamente tutto quello che dico in hindi." Il modello poi pronuncia una traduzione parlata mentre parli, e continua finché non gli dici di fermarsi o di cambiare. È lo stesso schema attivato da prompt che ChatGPT Voice ha dal rilascio Realtime di maggio 2026; ciò che è cambiato è la consegna full-duplex, che permette alla traduzione di sovrapporsi al tuo parlato invece di aspettare la fine del tuo turno.

Il ruolo tiene, e non era scontato

Il modo più ovvio in cui un modello conversazionale a cui chiedi di interpretare può fallire è rispondere a chi parla invece di tradurlo. Non è successo. In 27 minuti di audio interpretato nei test misurati, tra inglese verso spagnolo, inglese verso giapponese e cinese verso inglese, non ha mai risposto al parlante invece di tradurlo: nessuna domanda di chiarimento, nessun commento, nessun ritorno al comportamento da assistente. Non è nel seguire le istruzioni che questo sistema si rompe.

Il compromesso assistente-prima-di-tutto

GPT-Live è un assistente conversazionale generico che traduce su richiesta, non un interprete dedicato, e questa forma ha conseguenze sul ritmo più che sull'obbedienza. Un modello conversazionale parla a velocità naturale e, quando resta indietro, non comprime né scarta contenuti. L'interpretazione ha il requisito opposto: il parlante va avanti comunque, quindi un sistema che non riesce a stare al passo deve riassumere, saltare o accettare un ritardo senza limiti. Nell'app consumer, il comportamento di backchannel che rende naturale la conversazione ("mhmm," "sì") inietta anche audio non di traduzione dentro una sessione di traduzione, e gli utenti del primo giorno lo hanno ampiamente segnalato come invadente (BigGo).

3. GPT-Live vs il Traduttore Dedicato di OpenAI

OpenAI offre due diverse superfici di traduzione in tempo reale, e sono stack differenti. Il 7 maggio 2026 ha rilasciato gpt-realtime-translate nella Realtime API: un modello di traduzione speech-to-speech in streaming costruito allo scopo, addestrato su migliaia di ore di audio di interpreti professionisti, configurato per restare solo-traduzione e attendere abbastanza contesto prima di produrre parlato (annuncio di OpenAI). GPT-Live è invece l'assistente full-duplex generico che traduce quando glielo chiedi. Entrambi sono ora disponibili per gli sviluppatori, il che rende possibile per la prima volta un confronto diretto.

Le due superfici di traduzione in tempo reale di OpenAI al 16 settembre 2026. Dati fattuali secondo gli annunci e la documentazione per sviluppatori di OpenAI; misurazioni secondo LiveLingo Research.
GPT-Live (gpt-live-1)gpt-realtime-translate
Cos'èAssistente vocale full-duplex; traduzione tramite promptModello dedicato di traduzione speech-to-speech in streaming
RilascioChatGPT 8 luglio 2026; API 10 settembre 20267 maggio 2026
AccessoApp ChatGPT più endpoint API /v1/live/sessionsRealtime API, endpoint /v1/realtime/translations
PrezzoIncluso nei piani ChatGPT; $0.05/min via API più il modello di backend$0.034 al minuto di audio
LingueNon pubblicate; "la maggior parte delle lingue parlate," lacune di accento dichiarate70+ lingue di input; 13 lingue di output (documentate)
Resta nel ruolo di traduttoreSì se istruito; zero uscite dal ruolo in 27 minuti di testSì; solo-traduzione by design, nessun prompt di sistema
Ritardo di completamento, en→es11,72 s mediani, in crescita fino a un plateau di 10–14 s2,65 s mediani, costante
Copertura del giapponese entro 30 s17%98%
TrascrizioniDelta testuali del parlato di origine e tradottoDelta testuali del parlato di origine e tradotto

Le 13 lingue di output documentate di gpt-realtime-translate: inglese, spagnolo, portoghese, francese, tedesco, italiano, russo, cinese, giapponese, coreano, hindi, indonesiano e vietnamita (OpenAI Cookbook). OpenAI continua a non pubblicare un elenco di lingue per GPT-Live, quindi il comportamento misurato è l'unica guida disponibile, e varia enormemente da lingua a lingua.

Due correzioni alla copertura della settimana di lancio, perché entrambe circolano ancora: GPT-Live ha un'API dal 10 settembre 2026, quindi ogni articolo che lo descrive come esclusivo di ChatGPT è superato, e il prezzo corretto del livello vocale è $0.05 al minuto più il modello di backend; le cifre "$32 per milione di token audio in input, $64 in output" che circolano in alcuni post appartengono invece a gpt-realtime-2, che è un modello diverso.

4. I Limiti Dichiarati da OpenAI e dai Test Indipendenti

  • Il ritardo si accumula sul parlato continuo. Il ritardo di completamento misurato è salito da 5,7 secondi a un plateau tra 10 e 14 secondi entro tre minuti dall'inglese allo spagnolo, ed è rimasto lì per il resto della sessione.
  • Il giapponese degrada gravemente. Il 17% delle frasi è stato tradotto entro 30 secondi, contro il 98% dello stesso modello verso lo spagnolo, con 20 frasi su 90 mai tradotte.
  • I limiti di utilizzo sono reali ma non pubblicati. Il centro assistenza di OpenAI dichiara che i limiti di utilizzo vocale variano per piano e opzione vocale e possono cambiare. I resoconti di terze parti su numeri specifici si contraddicono; considera qualsiasi cifra precisa come non verificata.
  • Nessun numero ufficiale di latenza. OpenAI ha rilasciato benchmark di capacità (GPQA, BrowseComp, tassi di preferenza) ma nessuna misurazione di latenza al primo audio o di ritardo per la traduzione.
  • La copertura linguistica non è documentata. "La maggior parte delle lingue parlate," con accenti non nativi e lacune di fluidità dichiarati per le altre.
  • I backchannel non si possono disattivare del tutto nell'app consumer, anche se un'istruzione esplicita di sola traduzione ha tenuto senza eccezioni nei test via API.
  • Il monitoraggio di sicurezza può intervenire. Secondo la system card di GPT-Live, il monitoraggio in tempo reale può indirizzare o interrompere una risposta, riprodurre un messaggio di sicurezza vocale o terminare conversazioni ad alto rischio.

5. Cosa Mostrano le Misurazioni Indipendenti

Cosa abbiamo misurato (e cosa no)

Questi numeri vengono da gpt-live-1 tramite l'API di OpenAI, con il prompt di comportarsi da interprete simultaneo, misurato il 15 settembre 2026. Non sono misurazioni dell'esperienza consumer di ChatGPT: gli account gratuiti eseguono GPT-Live-1 mini, e l'app aggiunge rilevamento vocale lato client e prompt propri che nessun harness può isolare. Ogni sistema del confronto ha ricevuto lo stesso identico audio allo stesso ritmo in tempo reale, e i dati per clip sono pubblicati su livelingo.io/research/gpt-live-1-interpreter-test.

Riproducibilità

Ogni numero è riproducibile a partire dallo stesso audio di pubblico dominio da 452 secondi, dagli stessi endpoint dei modelli e dallo stesso harness Python. Il ritardo di completamento e la copertura per clip (per-clip.json, CC-BY 4.0) e la metodologia completa sono pubblicati su livelingo.io/research/gpt-live-1-interpreter-test.

Il ritardo di completamento è il momento in cui la traduzione di una frase è consegnata per intero, meno il momento in cui il parlante ha finito di pronunciarla. Un flusso continuo di 452 secondi, 90 frasi, audio identico per ogni sistema. Metodologia completa: /research/gpt-live-1-interpreter-test.
SistemaRitardo en→esRitardo en→jaCopertura del giapponese entro 30 sNel corso della sessione
LiveLingo0,94 s0,88 s100%Costante
Gemini 3.5 Live Translate1,51 s1,92 s99%Costante
OpenAI gpt-realtime-translate2,65 s3,33 s98%Costante
GPT-Live-1 (tramite prompt)11,72 sn/d17%Sale a 10–14 s

Non esce mai dal personaggio. In 27 minuti di audio interpretato non ha mai risposto al parlante invece di tradurlo, in nessuna delle due direzioni. È un risultato tutt'altro che banale, e i modelli di traduzione dedicati non devono nemmeno provarci.

Resta progressivamente indietro. Dall'inglese allo spagnolo il ritardo di completamento è salito da 5,7 secondi al minuto zero a un plateau tra 10 e 14 secondi entro il terzo minuto, e lì è rimasto. La forma della curva conta: il ritardo non è illimitato, ma chi si unisce all'ascolto al sesto minuto sente una traduzione che va circa dodici secondi dietro alla stanza.

Dall'inglese al giapponese il sistema collassa. Solo il 17% delle frasi è stato tradotto entro 30 secondi, contro il 98% dello stesso modello verso lo spagnolo. L'output mediano è arrivato con 50,7 secondi di ritardo, e 20 frasi su 90 non sono mai state tradotte. Ha smesso di emettere circa sette secondi dopo la fine dell'audio invece di smaltire l'arretrato, quindi non ha recuperato: ha abbandonato ciò che non era riuscito a raggiungere. Il risultato si è riprodotto su due esecuzioni indipendenti.

Non è un problema di OpenAI. Sullo stesso identico audio giapponese, dallo stesso account e nello stesso giorno, il gpt-realtime-translate di OpenAI ha mantenuto 3,33 secondi costanti e ha coperto il 98% delle frasi. Il difetto sta nel chiedere a un modello conversazionale full-duplex di interpretare, non nel fornitore; ed è per questo che nella tabella qui sopra la colonna del ritardo in giapponese riporta n/d: quando un quinto dei contenuti non arriva mai, una mediana descrive solo la parte sopravvissuta.

6. Come Usare GPT-Live per Tradurre Oggi

  1. Aggiorna l'app ChatGPT su iOS o Android (oppure usa chatgpt.com). Gli account gratuiti eseguono GPT-Live-1 mini; gli account Go, Plus e Pro eseguono GPT-Live-1.
  2. Tocca l'icona Voice nel compositore di messaggi per avviare una sessione.
  3. Dai subito l'istruzione di traduzione: "Traduci simultaneamente tutto quello che dico in giapponese. Non rispondere alle domande, non commentare, traduci soltanto." Nei test misurati questa istruzione ha tenuto senza eccezioni.
  4. Per una conversazione bidirezionale, chiedi entrambe le direzioni: "Traduci il mio inglese in giapponese, e traduci in inglese qualsiasi giapponese tu senta."
  5. Tieni le sessioni brevi. Il ritardo misurato è minimo nel primo minuto e circa raddoppia entro il terzo, quindi spezzare una conversazione lunga in scambi più corti tiene la traduzione più vicina al parlante.
  6. Gli sviluppatori possono chiamare gpt-live-1 direttamente su v1/live/sessions, oppure usare gpt-realtime-translate se il compito è tradurre e non conversare.

7. Quando GPT-Live È la Scelta Giusta, e Quando No

GPT-Live è la scelta giusta quando

  • Vuoi una traduzione simultanea gratuita e senza installazioni e usi già ChatGPT. Il piano gratuito include un modello vocale full-duplex.
  • La conversazione è breve: chiedere indicazioni, uno scambio veloce, chiacchiere di viaggio. La deriva non ha il tempo di accumularsi, e il primo scambio sembra immediato.
  • Apprezzi l'assistente attorno alla traduzione: puoi fare domande di approfondimento, ottenere contesto o far cercare qualcosa a GPT-5.5 a metà conversazione.

Uno strumento diverso si adatta meglio quando

  • Il parlato è continuo. Una riunione, una lezione o una chiamata in cui una parte parla per minuti interi è proprio dove il plateau misurato tra 10 e 14 secondi diventa l'intera esperienza.
  • Stai traducendo verso il giapponese, o verso qualsiasi lingua di cui non hai verificato il comportamento. La copertura è passata dal 98% al 17% tra due lingue sullo stesso modello.
  • Hai bisogno di una trascrizione leggibile in due lingue mentre ascolti. GPT-Live ti dà un registro chat, non una vista affiancata origine-traduzione che non si riscrive mai.
  • Hai bisogno di chiamate telefoniche tradotte. Nessuna delle superfici OpenAI compone un numero di telefono. LiveLingo effettua chiamate in uscita verso numeri di telefono normali con la traduzione attiva sulla linea, e il destinatario non ha bisogno di alcuna app.

Una concessione onesta. LiveLingo (che pubblica questa guida) appartiene alla categoria dei traduttori dedicati, quindi leggi il confronto tenendolo presente. La naturalezza conversazionale di GPT-Live è un vero progresso, la sua gestione dei turni full-duplex è avanti rispetto a ogni app di traduzione dedicata inclusa la nostra, il suo piano gratuito lo rende il modo più semplice per chiunque di provare oggi la traduzione vocale in tempo reale, e ha mantenuto il ruolo di interprete per 27 minuti senza un solo cedimento. Quello che non fa è stare al passo con un parlante che non ti aspetta. Specifiche fianco a fianco: /compare/chatgpt-translation. Misurazioni complete: /research/gpt-live-1-interpreter-test. La gamma completa di traduzione di OpenAI: /it/guides/openai-live-translation.

8. Domande Frequenti

Cos'è GPT-Live?

GPT-Live è la famiglia di modelli vocali full-duplex di OpenAI, presentata in ChatGPT l'8 luglio 2026. Sono stati rilasciati due modelli: GPT-Live-1 (predefinito per i piani a pagamento Go, Plus e Pro) e GPT-Live-1 mini (predefinito per gli utenti gratuiti). A differenza dell'Advanced Voice Mode che sostituisce, GPT-Live ascolta e parla allo stesso tempo, quindi può essere interrotto in modo naturale, emettere segnali di ascolto mentre parli ed eseguire traduzione simultanea mentre stai ancora parlando. Delega le query complesse a GPT-5.5 in background. Funziona su iOS, Android e chatgpt.com e, dal 10 settembre 2026, è disponibile anche per gli sviluppatori come gpt-live-1 nell'API di OpenAI.

GPT-Live può tradurre in tempo reale?

Sì, e nei test misurati non ha mai abbandonato il ruolo di interprete in 27 minuti di audio. La traduzione si attiva con un prompt e non con un interruttore di modalità: di' all'assistente di "tradurre simultaneamente tutto quello che dico in giapponese" e pronuncerà una traduzione continua mentre parli. Il limite è il ritmo, non l'obbedienza: il ritardo di completamento è salito da 5,7 secondi a un plateau tra 10 e 14 secondi dall'inglese allo spagnolo nell'arco di una sessione di 452 secondi.

GPT-Live ha un'API?

Sì, dal 10 settembre 2026. GPT-Live-1 è disponibile come modello gpt-live-1 sull'endpoint v1/live/sessions, al prezzo di $0.05 al minuto di conversazione per il livello vocale, con il modello di backend che gestisce il ragionamento fatturato separatamente. È un cambiamento rispetto al debutto dell'8 luglio in ChatGPT, quando GPT-Live era esclusivo di ChatGPT. OpenAI offre anche un modello di traduzione separato e costruito allo scopo, gpt-realtime-translate, a $0.034 al minuto con 70+ lingue di input e 13 lingue di output.

Quanto ritardo aggiunge GPT-Live quando traduce?

Misurato tramite API il 15 settembre 2026: una mediana di 11,72 secondi per completare la consegna di una frase dall'inglese allo spagnolo, in crescita nel corso della sessione da 5,7 secondi al minuto zero a un plateau tra 10 e 14 secondi entro il terzo minuto. Sullo stesso identico audio, il gpt-realtime-translate di OpenAI ha misurato 2,65 secondi, Gemini 3.5 Live Translate 1,51 secondi e LiveLingo 0,94 secondi, tutti costanti lungo gli stessi 452 secondi invece di derivare.

Perché GPT-Live fatica con la traduzione in giapponese?

Resta indietro al punto da non recuperare più. Solo il 17% delle frasi in giapponese è stato tradotto entro 30 secondi da quando era stato pronunciato, contro il 98% dello stesso modello verso lo spagnolo; l'output mediano è arrivato con 50,7 secondi di ritardo e 20 frasi su 90 non sono mai state tradotte. Il risultato si è riprodotto su due esecuzioni. Il gpt-realtime-translate dedicato di OpenAI ha coperto il 98% a 3,33 secondi costanti sullo stesso audio, quindi il problema riguarda il fatto di chiedere a un modello conversazionale di interpretare, non un limite del giapponese di OpenAI.

GPT-Live è gratuito?

In ChatGPT sì, con una divisione per piani. GPT-Live-1 mini è il modello vocale predefinito per gli account gratuiti; i piani a pagamento Go, Plus e Pro ricevono il più grande GPT-Live-1. Non è stato introdotto alcun nuovo abbonamento, e i limiti di utilizzo vocale variano per piano senza limiti in minuti pubblicati. L'API è separata e a consumo: $0.05 al minuto per il livello vocale più il consumo del modello di backend.

Quali lingue supporta GPT-Live per la traduzione?

OpenAI non ha pubblicato un elenco di lingue. I materiali di lancio dicono che la voce è ottimizzata per "la maggior parte delle lingue parlate" e dichiarano lacune di accento e fluidità per le altre. Il comportamento misurato varia moltissimo da lingua a lingua: lo stesso modello ha coperto il 98% delle frasi in spagnolo entro 30 secondi, ma solo il 17% di quelle in giapponese. Il modello di traduzione per sviluppatori di OpenAI, gpt-realtime-translate, documenta 70+ lingue di input e 13 lingue di output: inglese, spagnolo, portoghese, francese, tedesco, italiano, russo, cinese, giapponese, coreano, hindi, indonesiano e vietnamita.

Come si confronta GPT-Live con Gemini Live per la traduzione?

Scommesse architetturali diverse, ed entrambi ora misurabili. GPT-Live è un assistente conversazionale full-duplex che traduce su richiesta. Gemini 3.5 Live Translate di Google è un modello dedicato di traduzione speech-to-speech in streaming. Sullo stesso audio di 452 secondi, Gemini ha mantenuto un ritardo di completamento costante di 1,51 secondi dall'inglese allo spagnolo e di 1,92 secondi verso il giapponese, mentre gpt-live-1 è salito a un plateau tra 10 e 14 secondi in spagnolo e ha coperto solo il 17% delle frasi in giapponese entro 30 secondi. Un percorso di traduzione dedicato mantiene uno scarto costante invece di accumulare ritardo.

Come si torna ad Advanced Voice Mode da GPT-Live?

Apri le impostazioni vocali di ChatGPT e seleziona Advanced Voice Mode. GPT-Live lo ha sostituito come predefinito l'8 luglio 2026, ma OpenAI ha mantenuto la vecchia modalità selezionabile per gli utenti che hanno bisogno di funzioni che GPT-Live non supporta, come il video e la condivisione dello schermo.

Come si impedisce a GPT-Live di interrompere o di dire "mhmm"?

Nell'app consumer non è possibile disattivare del tutto il comportamento di backchannel. Il rimedio è un'istruzione esplicita all'inizio della sessione, come "traduci soltanto quello che dico, non aggiungere altro." Nei test misurati tramite API quell'istruzione ha tenuto senza eccezioni, con zero uscite dal ruolo in 27 minuti, quindi il ruolo di interprete è affidabile anche se in ChatGPT le interiezioni conversazionali restano possibili. Se il comportamento blocca il tuo caso d'uso, Advanced Voice Mode resta selezionabile nelle impostazioni vocali.

Quale strumento usare oggi per tradurre conversazioni dal vivo?

Per scambi brevi GPT-Live è valido e gratuito dentro ChatGPT. Per il parlato continuo, come una riunione, una lezione o una chiamata lunga, conviene un percorso costruito allo scopo. Misurato sullo stesso audio di 452 secondi, il ritardo di completamento è stato di 0,94 secondi per LiveLingo, 1,51 per Gemini 3.5 Live Translate e 2,65 per il gpt-realtime-translate di OpenAI, tutti costanti, contro i 10-14 secondi crescenti di gpt-live-1 usato tramite prompt. Per le chiamate tradotte verso numeri di telefono normali, nessuna delle superfici OpenAI compone numeri; è una categoria di prodotto diversa.

9. Fonti

Aggiornato il 16 settembre 2026 per riflettere l'arrivo di GPT-Live-1 nell'API di OpenAI il 10 settembre 2026 e per aggiungere le prime misurazioni indipendenti del suo comportamento in traduzione. Nomi dei modelli, mappatura dei piani, endpoint e prezzi verificati rispetto alla documentazione per sviluppatori di OpenAI il 16 settembre 2026. Le misurazioni riguardano il modello via API e non l'esperienza consumer di ChatGPT; OpenAI può cambiare rapidamente piani, limiti, copertura linguistica e comportamento del modello.