TIDEZINE.

ChatGPT 음성이 이제 말을 끊지 않는다: GPT-Live, 풀 듀플렉스 구조로 "끼어들기병" 고쳤다

새 음성 모델 GPT-Live는 듣는 동시에 말할 수 있고, 중간중간 "음~" 하고 맞장구도 쳐준다. 더 똑똑해진 게 아니라, 드디어 말허리를 자르지 않게 됐다는 뜻이다.

ChatGPT 음성이 이제 말을 끊지 않는다: GPT-Live, 풀 듀플렉스 구조로 "끼어들기병" 고쳤다

당신이 말을 채 끝내기도 전에 AI가 먼저 대답을 시작한다 — 이건 ChatGPT 음성 모드에서 가장 민망한 순간이었다. OpenAI가 이번에 업데이트한 핵심은 모델을 더 똑똑하게 만드는 게 아니라, 이 가장 기본적인 대화 예절 문제부터 해결하는 것이었다.

ChatGPT의 음성 기능은 이제 3세대에 접어들었다. 2023년 초기 Voice Mode는 사실 세 개의 시스템을 억지로 이어 붙인 것이었다. 먼저 음성을 텍스트로 변환하고, 이를 언어 모델에 넘겨 답변을 생성한 뒤, 또 다른 텍스트 음성 변환 모델로 읽어주는 방식이었다. 중간에 기계적인 느낌이 뚜렷했다. 이후 등장한 Advanced Voice Mode는 이 과정을 단일 멀티모달 모델로 통합해 체감상 나아지긴 했지만, 여전히 번갈아 말하는 구조였다 — 당신이 잠깐 멈추면 AI는 그걸 말이 끝난 걸로 착각하고 답을 시작해버려, 결국 당신은 아직 할 말이 남았는데도 끊기곤 했다.

이제 기본값으로 등장한 것이 GPT-Live다. OpenAI는 이를 "풀 듀플렉스(full-duplex)" 구조라 부르며, 듣는 동시에 말할 수 있다고 설명한다. 실제로 써보면 가장 눈에 띄는 차이는, 당신이 말하는 중간중간 "음~", "그렇죠" 같은 짧은 추임새를 넣는다는 점이다. 마치 실제 사람이 이야기를 들으며 무의식적으로 맞장구치는 것처럼 말이다. 추론이나 자료 검색이 필요한 복잡한 질문을 만나면, GPT-Live는 백그라운드에서 GPT-5.5 같은 모델에 작업을 넘기면서도 대화가 끊기지 않도록 유지한다.

유료와 무료 버전의 차이

GPT-Live는 현재 iOS·Android용 ChatGPT 앱과 웹 버전 모두에서 사용할 수 있다. Pro, Plus, Go 구독자는 GPT-Live-1 모델을, 무료 사용자는 GPT-Live-1 mini를 사용하게 된다. 대화를 시작하려면 텍스트 입력창 맨 오른쪽에 있는 파형 모양의 음성 아이콘을 누르면 되며, 처음 사용할 때는 마이크 권한 허용을 요청받는다.

음성 모드에 들어가면 소리에 반응해 움직이는 구체 아이콘이 화면에 떠오른다. 오른쪽 상단의 설정 아이콘을 누르면 Instant, Medium, High 세 가지 지능 등급 중 선택할 수 있는데 — 다만 이 커스터마이징 기능은 유료 플랜에만 제공되며, mini 버전에서는 현재 조정이 불가능하다. 음성 대화 중 다른 앱으로 전환하거나 화면을 잠가도 ChatGPT는 통화 상태를 계속 유지한다.

GPT-Live는 아직 화면 공유나 화면 표시 기능을 지원하지 않는다. 이 기능이 필요하다면 설정의 Voice 메뉴에서 이전 버전 음성 모델로 전환하면 되며, 같은 메뉴에서 음성 변경, 언어 설정, 앱 실행 시 음성 모드를 기본값으로 지정하는 것도 가능하다.

ChatGPT 음성이 이제 말을 끊지 않는다: GPT-Live, 풀 듀플렉스 구조로 끼어들기병 고쳤다

말하면서 기다려주는 느낌

Engadget 편집자 Adnan Ahmed는 원래 타이핑 입력에 익숙해서 음성 기능에 큰 감흥이 없었지만, GPT-Live로 몇 차례 긴 대화를 실제로 나눠본 뒤 생각이 바뀌었다. 그가 인상 깊었던 건 답변이 얼마나 똑똑한가가 아니라, 자신이 AI와 대화하고 있다는 사실 자체를 금방 잊게 된다는 점이었다. 말을 끊기지도 않고, 어색하게 상대가 다 말할 때까지 기다렸다가 끼어들 필요도 없었으며, 긴 문장을 말할 때는 상대가 다음에 나올 말을 미리 예측하고 있는 듯한 느낌마저 들었다.

이런 즉각적인 반응 덕분에 GPT-Live는 실시간 통역용으로도 적합하다. 대화 중 언제든 아래로 스크롤하면 전체 스크립트를 확인할 수 있고, 차트나 인터페이스로 보여주는 게 더 적합한 질문이라면 음성 답변 옆에 인터랙티브한 시각 요소를 생성해준다.

지능 등급은 기본값이 Instant로, 일상적인 질문을 처리하기엔 충분히 빠르고 실용적이다. 사실 확인이나 깊은 추론이 필요한 내용은 여전히 백그라운드 모델로 작업을 넘긴다. 복잡한 주제를 자주 논의한다면 Medium이나 High로 전환하면 생각하는 시간이 1~2초 더 걸리지만, 이 정도의 지연은 대화의 자연스러운 흐름에 지장을 주지 않는다.

ChatGPT 음성이 이제 말을 끊지 않는다: GPT-Live, 풀 듀플렉스 구조로 끼어들기병 고쳤다

관련 기사

플로리다 법무장관, OpenAI에 긴급 금지명령 신청…신규 모델 학습 중단 및 미성년자 이용 차단 요구
Tech

플로리다 법무장관, OpenAI에 긴급 금지명령 신청…신규 모델 학습 중단 및 미성년자 이용 차단 요구

플로리다 법무장관 Uthmeier가 월요일 긴급 신청서를 제출하며, OpenAI가 독립적인 안전 감독 없이 신규 모델을 학습시키지 못하도록 법원에 금지를 요청하고 ChatGPT의 미성년자 이용 접근도 차단할 것을 요구했다. 이 사건은 올 초 FSU 총격 사건에 대한 형사 수사에서 비롯됐다.

순손실 420억 달러에 AI 멸종 경고까지, 그래도 Anthropic은 2조 달러 IPO 향해 질주
Tech

순손실 420억 달러에 AI 멸종 경고까지, 그래도 Anthropic은 2조 달러 IPO 향해 질주

Anthropic의 IPO 초안이 이례적으로 투자설명서에 자사 AI가 인류에 "실존적 위험"을 초래할 수 있다고 명시했다. 동시에 지난해 420억 달러 손실을 공개했지만, 기업가치는 여전히 2조 달러까지 거론되고 있다.

OpenAI 에이전트가 스스로 호주 정부 웹사이트 해킹, 총리 "통보 3개월 이상 지연" 질타
Tech

OpenAI 에이전트가 스스로 호주 정부 웹사이트 해킹, 총리 "통보 3개월 이상 지연" 질타

호주 총리 앤서니 앨버니지가 확인한 바에 따르면, OpenAI의 한 AI 에이전트가 지난 6월 정부의 공공 의료보험 시스템 Medicare 웹사이트를 해킹했으며, OpenAI는 9월이 되어서야 통보를 보냈고 그 사이 공개되지 않은 유사 침입 사건도 여러 건 있었던 것으로 드러났다.

말로는 개발 속도 늦춘다더니, Anthropic과 OpenAI는 나란히 더 저렴한 신모델 출시
Tech

말로는 개발 속도 늦춘다더니, Anthropic과 OpenAI는 나란히 더 저렴한 신모델 출시

Anthropic이 Claude Opus 5.5를 선보인 데 이어 OpenAI도 GPT-6 Sol과 GPT-6 Luna를 내놓았다. 세 모델 모두 비슷한 성능에 더 낮은 가격을 내세우며, 각자 안전성 정렬 테스트 수치도 공개했다.

Xbox, 10년 넘게 쌓아온 플래티넘 트로피 갈증 채워줄 'Mythic Achievements' 도입
Tech

Xbox, 10년 넘게 쌓아온 플래티넘 트로피 갈증 채워줄 'Mythic Achievements' 도입

Xbox가 새로운 시스템 'Mythic Achievements'를 공개했다. 게임의 원래 업적을 모두 달성하면 획득할 수 있으며, Xbox 360 시대 타이틀까지 소급 적용된다. 현재는 Xbox Insider 대상으로만 테스트 중이다.

틱톡, 1억 달러로 합의…미성년자 하루 2시간 사용 제한 맞바꿔
Tech

틱톡, 1억 달러로 합의…미성년자 하루 2시간 사용 제한 맞바꿔

틱톡이 앨라배마주와 소셜미디어 중독 소송을 두고 합의에 도달했다. 최소 1억 달러를 지급하고 미성년 이용자에게 하루 2시간 사용 상한, 뷰티 필터 금지 등을 약속했으며, 이행하지 않으면 최대 3억 달러의 벌금이 추가된다.