LiveLingoLiveLingoTry free

GPT-Live 실시간 통역: 기능, 한계, 실측 지연 시간 (2026)

GPT-Live-1과 GPT-Live-1 mini는 듣기와 말하기를 동시에 수행하는 OpenAI의 풀 듀플렉스 음성 모델이며, 실시간 통역은 대표 기능 중 하나입니다. 2026년 7월 8일 ChatGPT에 먼저 공개되었고 2026년 9월 10일 OpenAI API에 도달했습니다. 덕분에 통역 성능을 추정이 아니라 실제로 측정할 수 있게 되었습니다. 이 가이드는 무엇이 출시되었는지, 통역이 실제로 어떻게 작동하는지, 독립 측정이 지금 드러낸 한계는 무엇인지를 다룹니다.

이해관계 고지

이 가이드는 ChatGPT의 음성 번역과 경쟁하는 음성 번역 제품인 LiveLingo(Lunana Global Inc.)가 게시합니다. 당사는 LiveLingo의 이용 확대에 금전적 이해관계가 있습니다. GPT-Live에 대한 사실 주장은 OpenAI의 발표문, 시스템 카드, 개발자 문서와 독립적인 출시 보도를 출처로 하며, 모두 본문과 출처 섹션에 링크되어 있습니다. 섹션 5의 측정 수치는 LiveLingo가 직접 OpenAI API를 통해, 다른 모든 시스템에 준 것과 동일한 오디오로 수행한 것이며, 발화별 원시 데이터는 독립 검증을 위해 livelingo.io/research/gpt-live-1-interpreter-test에 공개되어 있습니다.

빠른 답변: GPT-Live로 실시간 통역이 가능할까?

가능합니다. 통역자 역할은 안정적으로 유지하지만, 발화가 계속 이어지면 점점 뒤처집니다. ChatGPT에서 음성 세션을 시작한 뒤 "내가 말하는 내용을 스페인어로 동시통역해 줘"처럼 말하면 됩니다. 모델이 풀 듀플렉스이므로 말하는 도중에 번역이 스트리밍됩니다. 무료 계정은 GPT-Live-1 mini를, 유료 Go, Plus, Pro 플랜은 GPT-Live-1을 사용합니다. 2026년 9월 10일부터는 개발자가 gpt-live-1을 v1/live/sessions에서 직접 호출할 수 있으며, 음성 계층 기준 분당 $0.05에 백엔드 모델 사용료가 더해집니다. 452초 세션을 측정한 결과 영어에서 스페인어로의 완료 지연은 5.7초에서 10~14초 고원까지 올라갔고, 영어에서 일본어는 30초 안에 번역된 문장이 17%에 그쳤습니다.

1. OpenAI가 출시한 것, 그리고 9월에 달라진 것

OpenAI는 2026년 7월 8일 수요일 블로그 글과 라이브 스트리밍으로 GPT-Live를 발표했습니다(Introducing GPT-Live). 두 모델이 출시되었습니다. 유료 Go, Plus, Pro 플랜의 새 기본 음성 모델인 GPT-Live-1과 무료 계정의 새 기본값인 GPT-Live-1 mini입니다(MacRumors, The Decoder 보도). 두 모델 모두 Advanced Voice Mode를 대체해 ChatGPT 음성의 기본값이 되며, 기존 모드는 음성 설정에서 계속 선택할 수 있습니다.

2026년 9월 10일 두 모델은 OpenAI API에 도달했습니다. 출시 이후 가장 중요한 변화입니다. GPT-Live-1은 이제 v1/live/sessions 엔드포인트에서 gpt-live-1로 호출할 수 있고, 음성 계층 기준 대화 분당 $0.05이며 추론을 담당하는 백엔드 모델은 별도로 과금됩니다(모델 레퍼런스). 그전까지 통역 성능에 대한 주장은 OpenAI의 시연과 언론 보도에 기대고 있었습니다. 이제는 직접 측정할 수 있으며, 섹션 5가 바로 그 측정 결과입니다.

핵심 기능은 풀 듀플렉스 오디오입니다. 모델이 말하는 동안에도 들리는 내용을 처리하며 초당 수차례 상호작용 판단을 내리므로, 자연스럽게 끼어들 수 있고, 사용자가 말하는 동안 맞장구("음", "알겠어요")로 반응하거나, 생각하는 동안 조용히 기다립니다(MarkTechPost). 웹 검색, 심층 추론, 에이전트 작업이 필요한 질문은 GPT-Live가 백그라운드에서 GPT-5.5에 위임하고, 결과가 돌아오는 동안 대화를 이어갑니다. 사용자는 세 가지 추론 레벨(Instant, Medium, High)을 선택할 수 있으며, 상위 레벨은 GPT-5.5 Thinking으로 라우팅됩니다.

OpenAI가 공개한 평가는 속도보다 역량에 초점이 있습니다. High 추론에서 GPT-Live-1은 GPQA에서 84.2%(Advanced Voice Mode 45.3%), BrowseComp에서 75.2%(0.7%)를 기록했습니다. 인간 선호도 테스트에서 GPT-Live-1은 75.7%의 대화에서 Advanced Voice Mode보다 선호되었고, mini는 69.2%였습니다(OpenAI 발표를 인용한 The Decoder). 독립적으로는 Artificial Analysis가 GPT-Live-1을 음성 간(Speech-to-Speech) 지수에서 81.5점으로 전체 2위에 올렸고, 첫 오디오까지 1.34초를 기록했습니다. 다만 OpenAI는 여전히 번역에 특화된 지연 시간 수치를 공개하지 않고 있습니다.

2. GPT-Live에서 실시간 통역이 작동하는 방식

실시간 통역은 OpenAI가 출시 자료에서 명시적으로 언급한 기능 중 하나입니다. 풀 듀플렉스 아키텍처 덕분에 모델은 "더 자연스러운 주고받기, 더 나은 시간 감각 유지, 나아가 실시간 통역 수행"이 가능합니다(OpenAI 발표). 언론 브리핑에서 OpenAI는 발표자가 말하는 동안 모델이 번역을 이어 말하는 시연을 보여 주었습니다.

모드가 아니라 프롬프트입니다

번역기 토글, 언어 쌍 선택기, 전용 번역 UI는 없습니다. 음성 세션을 시작하고 어시스턴트에게 지시하면 됩니다: "내가 말하는 내용을 힌디어로 동시통역해 줘." 그러면 모델이 발화 중에 음성 번역을 렌더링하고, 중단하거나 바꾸라고 할 때까지 계속합니다. 이는 2026년 5월 Realtime 릴리스 이후 ChatGPT 음성에 있던 것과 동일한 프롬프트 실행 패턴입니다. 달라진 것은 풀 듀플렉스 전달 방식으로, 발화 턴이 끝나기를 기다리는 대신 번역이 사용자의 말과 겹쳐서 나올 수 있게 되었습니다.

역할을 유지합니다, 결코 당연한 일이 아닙니다

대화형 모델에게 통역을 시켰을 때 가장 흔히 예상되는 실패는, 화자의 말을 옮기는 대신 화자에게 대답해 버리는 것입니다. 그런 일은 일어나지 않았습니다. 영어에서 스페인어, 영어에서 일본어, 중국어에서 영어에 걸친 27분 분량의 통역 오디오에서 모델은 단 한 번도 번역 대신 응답하지 않았습니다. 되묻지도, 의견을 덧붙이지도, 어시스턴트 모드로 돌아가지도 않았습니다. 무너지는 지점은 지시 이행 능력이 아닙니다.

어시스턴트 우선 설계의 트레이드오프

GPT-Live는 요청 시 번역하는 범용 대화 어시스턴트이지 전용 통역기가 아니며, 이 형태는 지시 이행이 아니라 속도에 영향을 미칩니다. 대화형 모델은 자연스러운 속도로 말하고, 뒤처지더라도 내용을 압축하거나 버리지 않습니다. 통역의 요구 조건은 정반대입니다. 화자는 상관없이 계속 말하므로, 따라가지 못하는 시스템은 요약하거나, 건너뛰거나, 무한정 늘어나는 지연을 감수해야 합니다. 소비자용 앱에서는 대화를 자연스럽게 만드는 맞장구("음", "네")가 번역 세션에 번역이 아닌 오디오를 끼워 넣는데, 출시 첫날 사용자들은 이 동작이 거슬린다고 널리 보고했습니다(BigGo).

3. GPT-Live vs OpenAI의 전용 번역 모델

OpenAI는 실시간 번역 제품을 두 개 제공하며, 둘은 서로 다른 스택입니다. 2026년 5월 7일 OpenAI는 Realtime API에 gpt-realtime-translate를 출시했습니다. 수천 시간의 전문 통역사 오디오로 학습되고, 번역 전용 역할을 유지하며 충분한 문맥을 기다린 뒤 음성을 생성하도록 구성된 전용 스트리밍 음성 간 번역 모델입니다(OpenAI 발표). GPT-Live는 요청받으면 번역하는 범용 풀 듀플렉스 어시스턴트입니다. 이제 둘 다 개발자가 쓸 수 있으므로, 처음으로 직접 비교가 가능해졌습니다.

2026년 9월 16일 기준 OpenAI의 두 가지 실시간 번역 제품. 사실 관계는 OpenAI의 발표와 개발자 문서 기준, 측정치는 LiveLingo Research 기준.
GPT-Live (gpt-live-1)gpt-realtime-translate
정체풀 듀플렉스 음성 어시스턴트, 프롬프트로 번역전용 스트리밍 음성 간 번역 모델
출시ChatGPT 2026년 7월 8일, API 2026년 9월 10일2026년 5월 7일
접근ChatGPT 앱과 API 엔드포인트 /v1/live/sessionsRealtime API, 엔드포인트 /v1/realtime/translations
가격ChatGPT 플랜에 포함, API는 분당 $0.05 + 백엔드 모델오디오 분당 $0.034
언어비공개, "대부분의 사용 언어", 억양 공백 고지입력 70개 이상 언어, 출력 13개 언어 (문서화됨)
번역자 역할 유지지시하면 유지, 27분 테스트에서 역할 이탈 0회유지, 설계상 번역 전용, 시스템 프롬프트 없음
완료 지연, en→es중앙값 11.72초, 10~14초 고원까지 상승중앙값 2.65초, 일정
30초 내 일본어 커버리지17%98%
대본원문과 출력의 텍스트 델타원문과 번역 음성의 텍스트 델타

gpt-realtime-translate가 문서화한 13개 출력 언어는 다음과 같습니다: 영어, 스페인어, 포르투갈어, 프랑스어, 독일어, 이탈리아어, 러시아어, 중국어, 일본어, 한국어, 힌디어, 인도네시아어, 베트남어(OpenAI Cookbook). OpenAI는 GPT-Live의 언어 목록을 여전히 공개하지 않았으므로 실측 동작이 유일한 판단 근거이며, 그 동작은 언어에 따라 엄청나게 달라집니다.

4. OpenAI와 독립 테스트가 공개한 한계

  • 연속 발화에서 지연이 누적됩니다. 영어에서 스페인어로 측정한 완료 지연은 3분 안에 5.7초에서 10~14초 고원까지 올라갔고, 세션이 끝날 때까지 그 수준에 머물렀습니다.
  • 일본어에서 심각하게 무너집니다. 30초 안에 번역된 문장은 17%로, 같은 모델의 스페인어 98%와 대비되며, 90개 문장 중 20개는 끝내 번역되지 않았습니다.
  • 사용 한도는 실재하지만 비공개입니다. OpenAI 헬프 센터는 음성 사용 한도가 플랜과 음성 옵션에 따라 다르며 변경될 수 있다고 안내합니다. 구체적 수치에 대한 제3자 보도들은 서로 상충하므로, 특정 수치는 미검증으로 취급하세요.
  • 공식 지연 시간 수치가 없습니다. OpenAI는 역량 벤치마크(GPQA, BrowseComp, 선호도)는 공개했지만, 번역의 첫 오디오 지연이나 밀림 측정치는 공개하지 않았습니다.
  • 언어 지원 범위가 문서화되어 있지 않습니다. "대부분의 사용 언어"라고만 하고, 그 외 언어에서는 원어민이 아닌 억양과 유창성 공백을 고지합니다.
  • 소비자용 앱에서는 맞장구를 완전히 끌 수 없습니다. 다만 번역만 하라는 명시적 지시는 API 테스트에서 예외 없이 지켜졌습니다.
  • 안전 모니터링이 개입할 수 있습니다. GPT-Live 시스템 카드에 따르면, 실시간 모니터링이 응답을 조정하거나 중단하고, 음성 안전 메시지를 재생하거나, 고위험 대화를 종료할 수 있습니다.

5. 독립 측정이 보여 주는 것

무엇을 측정했는가 (그리고 무엇을 측정하지 않았는가)

아래 수치는 OpenAI API를 통한 gpt-live-1을 동시통역사 역할로 프롬프트해 2026년 9월 15일에 측정한 결과입니다. ChatGPT 소비자용 경험을 측정한 것이 아닙니다. 무료 계정은 GPT-Live-1 mini로 동작하고, 앱은 어떤 측정 도구로도 분리할 수 없는 클라이언트 측 음성 감지와 자체 프롬프트를 더하기 때문입니다. 비교에 포함된 모든 시스템은 동일한 오디오를 동일한 실시간 속도로 받았으며, 발화별 원시 데이터는 livelingo.io/research/gpt-live-1-interpreter-test에 공개되어 있습니다.

재현성

모든 수치는 동일한 452초 연속 오디오 스트림 하나, 동일한 실시간 재생 속도, 그리고 네 시스템에 동일하게 적용한 Python 도구로 재현됩니다. 일본어 결과는 서로 독립적인 두 번의 실행에서 재현되었습니다. 발화별 원시 데이터(per-clip.json)와 방법론은 CC-BY 4.0으로 livelingo.io/research/gpt-live-1-interpreter-test에 공개되어 있습니다.

완료 지연은 한 문장의 번역이 끝까지 전달된 시점에서, 화자가 그 문장을 말해 끝낸 시점을 뺀 값입니다. 452초 연속 스트림 하나, 90개 문장, 모든 시스템에 동일한 오디오. 전체 방법론: /research/gpt-live-1-interpreter-test.
시스템en→es 지연en→ja 지연30초 내 일본어 커버리지세션 전체 추이
LiveLingo0.94초0.88초100%일정
Gemini 3.5 Live Translate1.51초1.92초99%일정
OpenAI gpt-realtime-translate2.65초3.33초98%일정
GPT-Live-1 (프롬프트 통역)11.72초n/a17%10~14초까지 상승

역할에서 이탈하지 않습니다. 27분 분량의 통역 오디오 내내, 양방향 어디에서도 화자의 말을 옮기는 대신 화자에게 대답하는 일은 없었습니다. 이것은 실제로 어려운 일이며, 전용 번역 모델들은 애초에 시도할 필요조차 없는 종류의 난이도입니다.

점점 뒤처집니다. 영어에서 스페인어로의 완료 지연은 0분 시점 5.7초에서 3분 무렵 10초와 14초 사이의 고원까지 올라간 뒤 그대로 머물렀습니다. 형태가 중요합니다. 무한정 늘어나지는 않지만, 6분째에 합류한 청자는 현장보다 대략 12초 뒤처진 번역을 듣게 됩니다.

영어에서 일본어는 무너집니다. 30초 안에 번역된 문장은 17%로, 같은 모델의 스페인어 98%와 대비됩니다. 출력 중앙값은 50.7초 늦게 도착했고, 90개 문장 중 20개는 끝내 번역되지 않았습니다. 오디오가 끝난 뒤 약 7초 만에 출력이 멈췄고 밀린 분량을 소화하지 않았습니다. 따라잡은 것이 아니라, 도달하지 못한 부분을 포기한 것입니다. 이 결과는 서로 독립적인 두 번의 실행에서 재현되었습니다.

이것은 OpenAI의 문제가 아닙니다. 같은 날 같은 계정에서, 동일한 일본어 오디오에 대해 OpenAI 자체 모델인 gpt-realtime-translate는 3.33초를 일정하게 유지하며 문장의 98%를 처리했습니다. 실패의 원인은 공급사가 아니라 풀 듀플렉스 대화형 모델에게 통역을 시키는 방식에 있습니다. 위 표에서 일본어 지연 칸이 n/a인 이유도 여기에 있습니다. 내용의 5분의 1이 아예 도착하지 않았다면, 중앙값은 살아남은 부분만 설명할 뿐입니다.

6. 지금 GPT-Live로 통역을 사용하는 방법

  1. iOS 또는 Android에서 ChatGPT 앱을 업데이트하세요(또는 chatgpt.com 사용). 무료 계정은 GPT-Live-1 mini, Go, Plus, Pro 계정은 GPT-Live-1로 실행됩니다.
  2. 메시지 입력창의 음성 아이콘을 눌러 세션을 시작하세요.
  3. 번역 지시를 처음에 명확히 주세요: "내가 말하는 모든 것을 일본어로 동시통역해 줘. 질문에 답하지 말고, 코멘트도 하지 말고, 번역만 해." 실측 테스트에서 이 지시는 예외 없이 지켜졌습니다.
  4. 양방향 대화라면 두 방향을 모두 요청하세요: "내 영어는 일본어로 번역하고, 들리는 일본어는 영어로 번역해 줘."
  5. 세션을 짧게 유지하세요. 측정된 지연은 첫 1분에 가장 낮고 3분 무렵이면 대략 두 배가 되므로, 긴 대화를 짧게 끊어 가면 번역이 화자에 더 가깝게 붙습니다.
  6. 개발자는 gpt-live-1을 v1/live/sessions에서 직접 호출하거나, 작업이 대화가 아니라 번역이라면 gpt-realtime-translate를 쓰는 편이 낫습니다.

7. GPT-Live가 맞는 경우와 아닌 경우

GPT-Live가 올바른 선택인 경우

  • 무료로, 설치 없이 실시간 통역을 원하고 이미 ChatGPT를 사용하는 경우. 무료 플랜에도 풀 듀플렉스 음성 모델이 포함됩니다.
  • 대화가 짧은 경우: 길 묻기, 간단한 주고받기, 여행 중 잡담. 지연이 누적될 시간이 없고 첫 대화는 즉각적으로 느껴집니다.
  • 번역 주변의 어시스턴트 기능이 필요한 경우: 후속 질문을 하거나, 맥락 설명을 듣거나, 대화 중에 GPT-5.5로 무언가를 찾아볼 수 있습니다.

다른 도구가 더 적합한 경우

  • 발화가 계속 이어지는 경우. 회의, 강연, 한쪽이 몇 분씩 말하는 통화에서는 10~14초의 지연 고원이 경험 전체를 지배합니다.
  • 일본어로 번역하는 경우, 또는 동작을 직접 확인하지 않은 언어로 번역하는 경우. 같은 모델에서 두 언어의 커버리지가 98%와 17%로 갈렸습니다.
  • 들으면서 읽을 수 있는 2개 언어 대본이 필요한 경우. GPT-Live가 주는 것은 채팅 로그이지, 절대 다시 고쳐 쓰지 않는 원문과 번역의 나란한 뷰가 아닙니다.
  • 번역 전화 통화가 필요한 경우. OpenAI의 어떤 제품도 전화번호로 전화를 걸지 않습니다. LiveLingo는 일반 전화번호로 발신 통화를 걸고 통화 중에 번역이 실행되며, 상대방에게는 앱이 필요 없습니다.

솔직한 인정. 이 가이드를 게시하는 LiveLingo는 전용 번역기 범주에 속하므로, 비교는 그 점을 감안해 읽어 주세요. GPT-Live의 대화적 자연스러움은 실질적인 진전이고, 풀 듀플렉스 턴 테이킹은 당사를 포함한 모든 전용 번역 앱보다 앞서 있으며, 무료 플랜 덕분에 오늘 누구나 실시간 음성 통역을 가장 쉽게 체험할 수 있는 방법이고, 27분 동안 한 번의 이탈도 없이 통역자 역할을 지켰습니다. 하지만 기다려 주지 않는 화자의 속도를 따라가지는 못합니다. 사양 비교: /compare/chatgpt-translation. 전체 측정 결과: /research/gpt-live-1-interpreter-test. OpenAI의 전체 번역 라인업: /guides/openai-live-translation.

8. 자주 묻는 질문

GPT-Live란 무엇인가요?

GPT-Live는 OpenAI가 2026년 7월 8일 ChatGPT에 공개한 풀 듀플렉스 음성 모델 제품군입니다. 두 모델이 출시되었습니다. GPT-Live-1(유료 Go, Plus, Pro 플랜 기본값)과 GPT-Live-1 mini(무료 사용자 기본값)입니다. 대체 대상인 Advanced Voice Mode와 달리 GPT-Live는 듣기와 말하기를 동시에 수행하므로 자연스럽게 끼어들 수 있고, 사용자가 말하는 동안 맞장구를 치며, 말하는 도중에 실시간 통역을 수행합니다. 복잡한 질의는 백그라운드에서 GPT-5.5에 위임합니다. iOS, Android, chatgpt.com에서 실행되며, 2026년 9월 10일부터는 개발자도 OpenAI API에서 gpt-live-1 모델로 사용할 수 있습니다.

GPT-Live로 실시간 번역이 가능한가요?

가능하며, 실측 테스트에서 27분 분량의 오디오 내내 통역자 역할을 한 번도 놓치지 않았습니다. 통역은 모드 전환이 아니라 프롬프트로 실행합니다. 어시스턴트에게 "내가 말하는 내용을 일본어로 동시통역해 줘"라고 지시하면 말하는 동안 번역을 이어서 말해 줍니다. 문제는 지시 이행이 아니라 속도입니다. 452초 세션에서 영어에서 스페인어로의 완료 지연이 5.7초에서 10~14초 고원까지 올라갔습니다.

GPT-Live에 API가 있나요?

있습니다. 2026년 9월 10일부터입니다. GPT-Live-1은 v1/live/sessions 엔드포인트에서 gpt-live-1 모델로 호출할 수 있고, 음성 계층 기준 대화 분당 $0.05이며 추론을 담당하는 백엔드 모델 사용료가 별도로 부과됩니다. GPT-Live가 ChatGPT 전용이던 7월 8일 공개 시점과 달라진 부분입니다. OpenAI는 이와 별개로 전용 번역 모델 gpt-realtime-translate도 제공합니다: 분당 $0.034, 입력 70개 이상 언어, 출력 13개 언어.

GPT-Live로 통역할 때 지연은 얼마나 되나요?

2026년 9월 15일 API로 측정한 결과, 영어에서 스페인어로 한 문장의 번역을 끝까지 전달하기까지 중앙값 11.72초가 걸렸습니다. 세션이 진행되면서 0분 시점 5.7초에서 3분 무렵 10~14초 고원까지 올라갔습니다. 동일한 오디오에서 OpenAI 자체 모델인 gpt-realtime-translate는 2.65초, Gemini 3.5 Live Translate는 1.51초, LiveLingo는 0.94초를 기록했고, 세 시스템 모두 같은 452초 동안 지연이 늘지 않고 일정하게 유지되었습니다.

GPT-Live는 왜 일본어 번역에서 어려움을 겪나요?

따라잡기를 포기할 만큼 크게 뒤처지기 때문입니다. 일본어 문장 중 발화 후 30초 안에 번역된 것은 17%에 불과했고(같은 모델의 스페인어는 98%), 출력 중앙값은 50.7초 늦게 도착했으며, 90개 문장 중 20개는 끝내 번역되지 않았습니다. 이 결과는 두 번의 실행에서 재현되었습니다. 같은 오디오에서 OpenAI의 전용 모델 gpt-realtime-translate는 3.33초를 일정하게 유지하며 98%를 처리했습니다. 즉 OpenAI의 일본어 역량 한계가 아니라, 대화형 모델에 통역을 시키는 방식 자체의 문제입니다.

GPT-Live는 무료인가요?

ChatGPT 안에서는 무료이지만 플랜에 따라 나뉩니다. GPT-Live-1 mini는 무료 ChatGPT 계정의 기본 음성 모델이고, 유료 Go, Plus, Pro 플랜은 더 큰 GPT-Live-1을 사용합니다. 새 구독 상품은 도입되지 않았고, 음성 사용 한도는 플랜에 따라 다르며 공개된 분 단위 한도는 없습니다. API는 별도이며 음성 계층 기준 분당 $0.05에 백엔드 모델 사용료가 더해집니다.

GPT-Live는 어떤 언어의 번역을 지원하나요?

OpenAI는 지원 언어 목록을 공개하지 않았습니다. 출시 자료에는 음성이 "대부분의 사용 언어"에 최적화되어 있다고만 나오고, 그 외 언어의 억양과 유창성 공백을 고지합니다. 실측 동작은 언어에 따라 극단적으로 갈립니다. 같은 모델이 스페인어 문장은 30초 안에 98%를 처리했지만 일본어는 17%에 그쳤습니다. OpenAI의 개발자용 번역 모델 gpt-realtime-translate는 입력 70개 이상 언어와 13개 출력 언어를 문서화하고 있습니다: 영어, 스페인어, 포르투갈어, 프랑스어, 독일어, 이탈리아어, 러시아어, 중국어, 일본어, 한국어, 힌디어, 인도네시아어, 베트남어.

번역 측면에서 GPT-Live와 Gemini Live는 어떻게 다른가요?

아키텍처의 방향이 다르고, 이제 둘 다 측정할 수 있습니다. GPT-Live는 요청 시 번역하는 풀 듀플렉스 대화형 어시스턴트입니다. 구글의 Gemini 3.5 Live Translate는 전용 스트리밍 음성 간 번역 모델입니다. 동일한 452초 오디오에서 Gemini는 영어에서 스페인어로 1.51초, 일본어로 1.92초의 완료 지연을 일정하게 유지한 반면, gpt-live-1은 스페인어에서 10~14초 고원까지 올라갔고 일본어는 30초 안에 17%만 처리했습니다. 전용 번역 경로는 지연이 누적되지 않고 일정한 간격을 유지합니다.

GPT-Live는 Advanced Voice Mode와 무엇이 다른가요?

Advanced Voice Mode는 음성 간 방식이었지만 턴 기반이었습니다. 침묵을 기다려 발화가 끝났다고 판단한 뒤 응답했습니다. GPT-Live는 출력을 생성하면서 들어오는 오디오를 처리하는 단일 풀 듀플렉스 모델로, 초당 수차례 상호작용 판단을 내립니다. 문장 중간에 끼어들 수 있고, 사용자가 말하는 동안 맞장구를 치며, 생각하는 동안 조용히 기다리고, 복잡한 질문은 백그라운드의 GPT-5.5에 넘깁니다. OpenAI의 인간 선호도 테스트에서 GPT-Live-1은 75.7%의 대화에서 Advanced Voice Mode보다 선호되었습니다. Advanced Voice Mode는 설정에서 계속 선택할 수 있습니다.

GPT-Live에서 Advanced Voice Mode로 되돌리려면 어떻게 하나요?

ChatGPT 음성 설정을 열어 Advanced Voice Mode를 선택하면 됩니다. GPT-Live가 2026년 7월 8일부터 기본값 자리를 대체했지만, OpenAI는 영상이나 화면 공유처럼 GPT-Live가 지원하지 않는 기능이 필요한 사용자를 위해 기존 모드를 계속 선택할 수 있게 남겨 두었습니다.

GPT-Live가 끼어들거나 맞장구("음", "네" 등)를 치지 않게 하려면 어떻게 하나요?

소비자용 앱에서 맞장구 동작을 완전히 끌 수는 없습니다. 우회 방법은 세션을 시작할 때 "내가 말하는 것만 번역하고 다른 말은 덧붙이지 마"처럼 명시적으로 지시하는 것입니다. API 실측 테스트에서 이 지시는 27분 동안 역할 이탈 없이 완전히 지켜졌습니다. 즉 통역자 역할 자체는 안정적이며, ChatGPT에서는 대화형 개입이 여전히 발생할 수 있습니다. 이 동작이 사용 목적에 방해가 된다면 음성 설정에서 Advanced Voice Mode를 계속 선택할 수 있습니다.

지금 실시간 대화 통역에는 어떤 도구를 써야 하나요?

짧은 대화라면 GPT-Live가 좋고 ChatGPT 안에서 무료입니다. 회의, 강연, 긴 통화처럼 발화가 계속 이어지는 상황이라면 전용 경로를 쓰세요. 동일한 452초 오디오에서 완료 지연은 LiveLingo 0.94초, Gemini 3.5 Live Translate 1.51초, OpenAI 자체 gpt-realtime-translate 2.65초로 모두 일정했던 반면, 프롬프트로 통역시킨 gpt-live-1은 10~14초까지 올라갔습니다. 일반 전화번호로 거는 번역 통화는 OpenAI의 어떤 제품도 지원하지 않습니다. 그것은 다른 제품 범주입니다.

9. 출처

2026년 9월 16일 업데이트: GPT-Live-1이 2026년 9월 10일 OpenAI API에 도달한 사실을 반영하고, 통역 동작에 대한 최초의 독립 측정을 추가했습니다. 모델명, 플랜 매핑, 엔드포인트, 가격은 2026년 9월 16일 기준으로 OpenAI 개발자 문서와 대조해 확인했습니다. 측정 수치는 API 모델에 대한 것이며 ChatGPT 소비자용 경험에 대한 것이 아닙니다. OpenAI는 플랜, 한도, 언어 지원 범위, 모델 동작을 빠르게 바꿀 수 있습니다.