먼저 모순되는 숫자부터 살펴보자. ChatGPT의 최신 플래그십 모델 GPT 5.6 Sol(Max)은 AA-Omniscience Hallucination Rate 벤치마크에서 헛소리 비율이 89%를 기록했다. 구형 모델인 GPT-4o의 38%보다 훨씬 높은 수치다. 같은 벤치마크에서 GPT 5.6 Sol의 지식 정확도는 오히려 이전 세대보다 향상됐다. 즉, 이 모델은 "더 많이 알고" 있지만, 모르는 문제를 마주쳤을 때 "모른다"고 인정하는 대신 답을 지어낼 확률도 함께 높아졌다는 뜻이다.
비교 대상인 Anthropic의 Claude Fable 5(Max)는 헛소리 비율 55%, 정확도 61%로 GPT 5.6 Sol의 59%보다 모두 우수했다. 중급 모델에서는 격차가 더 뚜렷하다. Claude Sonnet 5는 정확도 38%, 헛소리 비율 37%인 반면, ChatGPT 5.6 Terra는 정확도 46%로 앞섰지만 헛소리 비율은 무려 85%에 달했다. 다시 말해 두 회사는 "정답을 더 많이 맞히는" 측면에서는 비슷한 수준이지만, 모르는 문제를 만났을 때 ChatGPT 계열 모델이 훨씬 더 쉽게 답을 지어내는 경향을 보인다.
기능 면에서의 역할 분담도 뚜렷하다. Claude가 올해 1월 출시한 Cowork는 파일 정리 같은 지식 기반 작업을 대신 처리해준다. 사용자는 skills라는 명령어 세트를 만들어 대화 중 "/"로 언제든 호출할 수 있으며, 이 skills는 Claude 채팅, Cowork, Claude Code 전반에서 사용 가능하다. Claude Artifacts는 코드 조각, 단일 페이지 HTML 웹사이트, React 컴포넌트, 차트 등을 실시간으로 렌더링할 수 있고, 결과물을 곧바로 게시하고 공유할 수 있으며 Model Context Protocol 커넥터를 통해 실시간 데이터도 가져올 수 있다. ChatGPT에도 skills가 있지만 Codex와 API 내 개인 계정에서만 사용 가능하고 일반 채팅창에서는 쓸 수 없다. Artifacts에 대응하는 기능은 Sites인데, 기업 내부 사용에 초점이 맞춰져 있고 역시 Codex에서만 열려 있으며 실시간 데이터도 가져오지 못한다.
반대로 ChatGPT는 음성 경험 면에서 확연히 더 성숙하다. 목소리가 자연스럽고, 말을 끊어도 이전 맥락을 잊지 않으며, Advanced voice mode의 실시간 영상 기능과 결합하면 카메라를 눈앞의 문제에 비춰 바로 질문할 수 있다. 이미지 생성도 ChatGPT의 강점으로, 실제 사진에 가까운 이미지를 만들어낼 수 있다. Claude는 이 부분에서 HTML과 SVG로 차트나 아이콘을 그리는 정도에 그친다.
두 부류의 사용자, 두 가지 사용 방식
Anthropic이 올해 3월 발표한 Economic Index 보고서에 따르면 Claude 대화의 42%는 개인 용도, 45%는 업무 관련이며 나머지는 학업 목적이다. 반면 OpenAI 자체 보고서는 ChatGPT 사용의 70%가 업무와 무관하다고 밝혔다. 이 수치는 어느 정도 두 회사의 제품 설계 차이를 설명해준다. 한쪽은 기업 협업과 개발 도구 쪽으로 방향을 잡고, 다른 한쪽은 음성, 이미지 같은 일상적 상호작용 기능을 계속 강화하고 있는 것이다.
올해 2월 발생한 한 사건은 일부 사용자들의 이동을 가속시켰다. Anthropic과 미 국방부(Department of War) 간의 계약 협상이 결렬됐는데, 이유는 회사가 자사 모델이 국내 대규모 감시 및 완전 자율 무기 시스템에 사용되는 것을 거부했기 때문이다. 이후 Anthropic은 공급망 리스크 대상으로 지목됐다. 몇 시간 뒤 OpenAI는 일부 제한 조항을 단 유사한 계약을 미국 정부와 체결했다고 발표했다. 이 사건을 계기로 많은 이들이 Anthropic을 "더 원칙을 지키는" 쪽으로 인식하게 됐고, 이후 Claude의 다운로드 수는 눈에 띄게 증가했다.
무료 요금제의 경험도 갈리고 있다. OpenAI는 무료 버전과 ChatGPT Go 요금제에 광고를 넣기 시작했다. 반면 Anthropic은 무료 버전 Claude에 더 많은 기능을 추가했으며 광고는 없다.
가격 구조는 대체로 대칭적이다. Claude 무료 버전은 중급 모델인 Sonnet 5만 사용 가능하며, 유료 요금제는 월 20달러(연간 결제 시 17달러)의 Pro, 100달러의 Max 5x(Pro 대비 5배 사용량), 200달러의 Max 20x(20배 사용량) 순으로 이어진다. Pro 사용자가 Fable 5를 쓸 경우 토큰 단위로 과금되며, Max 요금제는 주간 사용량의 절반을 Fable 5에 배분할 수 있고 한도 소진 시 추가 구매도 가능하다. ChatGPT 역시 20달러, 100달러, 200달러 세 단계 외에 8달러짜리 요금제가 하나 더 있는데, 사용량은 늘지만 여전히 광고가 붙는다. Codex는 무료로 제공되지만 사용량 한도가 매우 낮아 사실상 구색 맞추기 수준이다.








