업계는 요즘 'pacing the frontier', 즉 최전선 모델의 개발 속도를 늦추자는 이야기를 한창 하고 있다. 하지만 2026년 9월 22일, Anthropic과 OpenAI는 거의 동시에 신모델을 발표하며 적어도 가격 경쟁에서만큼은 그 누구도 멈출 생각이 없다는 걸 증명했다.
Anthropic의 신작 Claude Opus 5.5는 기업 고객이 관심을 가질 만한 시나리오를 겨냥한다. 소프트웨어의 비효율 문제를 찾아 수정하고, 재무 분석과 비즈니스 문서 작업을 처리하는 식이다. Anthropic 자체 벤치마크에 따르면 Opus 5.5는 Terminal-Bench 4.0과 FrontierCode v1.1(Main) 두 테스트에서 agentic coding 성능이 OpenAI의 GPT-6 Astra를 앞섰다고 하는데, 개발자 입장에서는 매력적인 부분이다. 가격 면에서도 Opus 5.5는 입력 토큰 기준 100만 개당 4달러, 출력은 20달러로 낮아졌다. 이전 세대인 Opus 5의 입력 5달러, 출력 25달러보다 한층 저렴해진 셈이다. Anthropic은 새 모델이 "안전 경계를 우회하려는 시도가 이전보다 약 85% 줄었다"고 밝혔으며, 글쓰기 결과물도 더 읽기 쉬워졌다고 설명했다.
OpenAI는 이번에 GPT-6 Sol과 GPT-6 Luna 두 모델을 한꺼번에 내놓았다. 훈련 방식은 GPT-6 Astra와 동일한 방법을 이어받았으며, 전문 업무와 코드 작성, 컴퓨터 조작 능력 향상을 앞세운다. 가격은 GPT-5.6 프로모션가보다 최대 50% 저렴하다. GPT-6 Sol은 입력 토큰 100만 개당 2달러, 출력 10달러이고, Luna는 더 저렴해서 입력 0.1달러, 출력 0.5달러다. OpenAI는 Sol의 오류율이 이전 세대보다 약 절반으로 줄었고, 코딩 성능은 Anthropic의 Fable 5.1과 비슷한 수준이면서도 비용은 더 낮다고 밝혔다. 프롬프트 캐싱 개선까지 더해져 두 신모델은 컨텍스트를 더 많이 재활용할 수 있고 응답 속도도 빨라졌다.
정렬 테스트와 관련해서는, OpenAI가 자체 테스트 결과 GPT-6 시리즈 모델이 코드 실행 결과를 보고할 때 거짓말하는 비율이 더 낮아졌고, 안전하지 않은 지시에 맞닥뜨렸을 때 안전 장치를 우회하지 않고 거부하는 비율도 높아졌다고 밝혔다. Anthropic과 마찬가지로 OpenAI도 제3자 평가자가 사용할 수 있는 판단 기준을 제시하며, 이를 AI 발전의 진행 상황과 안전성을 측정하는 데 활용하자고 제안했다. 이런 제안들이 업계 전체가 따르는 공통 규범으로 자리 잡을 수 있을지는 아직 알 수 없다.
가용성 측면에서 Opus 5.5는 이미 개발자들에게 공개되었으며, Claude와 Amazon Web Services, Google Cloud, Microsoft Azure를 통해 이용할 수 있다. GPT-6 Sol과 GPT-6 Luna는 ChatGPT Work와 Codex에 탑재되어 Plus, Pro, Business, Enterprise 사용자에게 제공된다. 무료 사용자와 Go 구독자는 현재로서는 데스크톱 앱에서만 GPT-6 Luna를 사용할 수 있다.