당신이 말을 채 끝내기도 전에 AI가 먼저 대답을 시작한다 — 이건 ChatGPT 음성 모드에서 가장 민망한 순간이었다. OpenAI가 이번에 업데이트한 핵심은 모델을 더 똑똑하게 만드는 게 아니라, 이 가장 기본적인 대화 예절 문제부터 해결하는 것이었다.
ChatGPT의 음성 기능은 이제 3세대에 접어들었다. 2023년 초기 Voice Mode는 사실 세 개의 시스템을 억지로 이어 붙인 것이었다. 먼저 음성을 텍스트로 변환하고, 이를 언어 모델에 넘겨 답변을 생성한 뒤, 또 다른 텍스트 음성 변환 모델로 읽어주는 방식이었다. 중간에 기계적인 느낌이 뚜렷했다. 이후 등장한 Advanced Voice Mode는 이 과정을 단일 멀티모달 모델로 통합해 체감상 나아지긴 했지만, 여전히 번갈아 말하는 구조였다 — 당신이 잠깐 멈추면 AI는 그걸 말이 끝난 걸로 착각하고 답을 시작해버려, 결국 당신은 아직 할 말이 남았는데도 끊기곤 했다.
이제 기본값으로 등장한 것이 GPT-Live다. OpenAI는 이를 "풀 듀플렉스(full-duplex)" 구조라 부르며, 듣는 동시에 말할 수 있다고 설명한다. 실제로 써보면 가장 눈에 띄는 차이는, 당신이 말하는 중간중간 "음~", "그렇죠" 같은 짧은 추임새를 넣는다는 점이다. 마치 실제 사람이 이야기를 들으며 무의식적으로 맞장구치는 것처럼 말이다. 추론이나 자료 검색이 필요한 복잡한 질문을 만나면, GPT-Live는 백그라운드에서 GPT-5.5 같은 모델에 작업을 넘기면서도 대화가 끊기지 않도록 유지한다.
유료와 무료 버전의 차이
GPT-Live는 현재 iOS·Android용 ChatGPT 앱과 웹 버전 모두에서 사용할 수 있다. Pro, Plus, Go 구독자는 GPT-Live-1 모델을, 무료 사용자는 GPT-Live-1 mini를 사용하게 된다. 대화를 시작하려면 텍스트 입력창 맨 오른쪽에 있는 파형 모양의 음성 아이콘을 누르면 되며, 처음 사용할 때는 마이크 권한 허용을 요청받는다.








