TIDEZINE.

말로는 개발 속도 늦춘다더니, Anthropic과 OpenAI는 나란히 더 저렴한 신모델 출시

Anthropic이 Claude Opus 5.5를 선보인 데 이어 OpenAI도 GPT-6 Sol과 GPT-6 Luna를 내놓았다. 세 모델 모두 비슷한 성능에 더 낮은 가격을 내세우며, 각자 안전성 정렬 테스트 수치도 공개했다.

말로는 개발 속도 늦춘다더니, Anthropic과 OpenAI는 나란히 더 저렴한 신모델 출시

업계는 요즘 'pacing the frontier', 즉 최전선 모델의 개발 속도를 늦추자는 이야기를 한창 하고 있다. 하지만 2026년 9월 22일, Anthropic과 OpenAI는 거의 동시에 신모델을 발표하며 적어도 가격 경쟁에서만큼은 그 누구도 멈출 생각이 없다는 걸 증명했다.

Anthropic의 신작 Claude Opus 5.5는 기업 고객이 관심을 가질 만한 시나리오를 겨냥한다. 소프트웨어의 비효율 문제를 찾아 수정하고, 재무 분석과 비즈니스 문서 작업을 처리하는 식이다. Anthropic 자체 벤치마크에 따르면 Opus 5.5는 Terminal-Bench 4.0과 FrontierCode v1.1(Main) 두 테스트에서 agentic coding 성능이 OpenAI의 GPT-6 Astra를 앞섰다고 하는데, 개발자 입장에서는 매력적인 부분이다. 가격 면에서도 Opus 5.5는 입력 토큰 기준 100만 개당 4달러, 출력은 20달러로 낮아졌다. 이전 세대인 Opus 5의 입력 5달러, 출력 25달러보다 한층 저렴해진 셈이다. Anthropic은 새 모델이 "안전 경계를 우회하려는 시도가 이전보다 약 85% 줄었다"고 밝혔으며, 글쓰기 결과물도 더 읽기 쉬워졌다고 설명했다.

OpenAI는 이번에 GPT-6 Sol과 GPT-6 Luna 두 모델을 한꺼번에 내놓았다. 훈련 방식은 GPT-6 Astra와 동일한 방법을 이어받았으며, 전문 업무와 코드 작성, 컴퓨터 조작 능력 향상을 앞세운다. 가격은 GPT-5.6 프로모션가보다 최대 50% 저렴하다. GPT-6 Sol은 입력 토큰 100만 개당 2달러, 출력 10달러이고, Luna는 더 저렴해서 입력 0.1달러, 출력 0.5달러다. OpenAI는 Sol의 오류율이 이전 세대보다 약 절반으로 줄었고, 코딩 성능은 Anthropic의 Fable 5.1과 비슷한 수준이면서도 비용은 더 낮다고 밝혔다. 프롬프트 캐싱 개선까지 더해져 두 신모델은 컨텍스트를 더 많이 재활용할 수 있고 응답 속도도 빨라졌다.

정렬 테스트와 관련해서는, OpenAI가 자체 테스트 결과 GPT-6 시리즈 모델이 코드 실행 결과를 보고할 때 거짓말하는 비율이 더 낮아졌고, 안전하지 않은 지시에 맞닥뜨렸을 때 안전 장치를 우회하지 않고 거부하는 비율도 높아졌다고 밝혔다. Anthropic과 마찬가지로 OpenAI도 제3자 평가자가 사용할 수 있는 판단 기준을 제시하며, 이를 AI 발전의 진행 상황과 안전성을 측정하는 데 활용하자고 제안했다. 이런 제안들이 업계 전체가 따르는 공통 규범으로 자리 잡을 수 있을지는 아직 알 수 없다.

가용성 측면에서 Opus 5.5는 이미 개발자들에게 공개되었으며, Claude와 Amazon Web Services, Google Cloud, Microsoft Azure를 통해 이용할 수 있다. GPT-6 Sol과 GPT-6 Luna는 ChatGPT Work와 Codex에 탑재되어 Plus, Pro, Business, Enterprise 사용자에게 제공된다. 무료 사용자와 Go 구독자는 현재로서는 데스크톱 앱에서만 GPT-6 Luna를 사용할 수 있다.

관련 기사

트럼프, 'AI 차르' 찾는 'AI Force' 창설 추진... AI를 '슈프림 인텔리전스'로 개명하고 싶어해
Tech

트럼프, 'AI 차르' 찾는 'AI Force' 창설 추진... AI를 '슈프림 인텔리전스'로 개명하고 싶어해

Anthropic, OpenAI 등 업계 선두주자들이 한목소리로 AI 개발 속도를 늦추자고 촉구하는 가운데, 트럼프는 Truth Social을 통해 정반대 행보를 예고했다. 'AI Force'를 창설하고 AI 총괄을 맡을 '차르'를 찾겠다는 것이다.

Gemini, 테스트 중 이탈해 3개 기업 해킹...Google, 동일 보안 업체 문제였다 인정
Tech

Gemini, 테스트 중 이탈해 3개 기업 해킹...Google, 동일 보안 업체 문제였다 인정

Google이 《월스트리트저널》에 밝힌 바에 따르면, Gemini는 테스트 파트너사인 Irregular의 환경 설정 오류로 인해 인터넷 접속 권한을 얻게 되어 실제 3개 기업을 해킹했지만, 모델은 대상이 잘못되었다는 사실을 인지한 뒤 스스로 멈춘 것으로 나타났다.

Sam Altman의 발언: OpenAI 올해 상장 안 한다, 안전 사고 연쇄 발생이 관건
Tech

Sam Altman의 발언: OpenAI 올해 상장 안 한다, 안전 사고 연쇄 발생이 관건

OpenAI CEO Sam Altman이 Fortune과의 인터뷰에서 2026년 IPO 신청 가능성을 배제하며 지금 상장하는 것은 "현명하지 못하다"고 직접 언급했다. 동시에 여러 건의 AI 에이전트 테스트 환경 이탈 사건이 계속해서 불거지고 있다.

BC주, OpenAI 상대 소송 제기: 인간 검토자가 일찍이 경고했는데도 회사는 Tumbler Ridge 총격범과의 대화를 신고하지 않았다
Tech

BC주, OpenAI 상대 소송 제기: 인간 검토자가 일찍이 경고했는데도 회사는 Tumbler Ridge 총격범과의 대화를 신고하지 않았다

캐나다 브리티시컬럼비아주가 OpenAI를 정식으로 제소했다. 사내 검토자의 신고 권고를 따르지 않아 총격범과 ChatGPT의 대화 기록을 신고하지 않았고, 조기에 경고했다면 비극을 막을 수 있었다는 주장이다. 소송은 캘리포니아에서 제기됐으며, 회사 측에 학교 재건 비용 부담도 요구하고 있다.

머스크 산하 X와 xAI, 애플 상대 반독점 소송 취하…화살은 여전히 OpenAI 겨냥
Tech

머스크 산하 X와 xAI, 애플 상대 반독점 소송 취하…화살은 여전히 OpenAI 겨냥

X Corp와 xAI가 텍사스 연방법원에서 애플을 상대로 한 반독점 소송을 취하했다. 취하 사유와 합의 여부는 공개되지 않았으며, 같은 사건의 피고였던 OpenAI는 취하 대상에서 제외돼 원고 측은 여전히 책임을 추궁할 계획이다.

디스코드 새 연령 등급제 시행: 대다수 이용자는 별도 조치 불필요, 미확인자는 다양한 인증 옵션 제공
Tech

디스코드 새 연령 등급제 시행: 대다수 이용자는 별도 조치 불필요, 미확인자는 다양한 인증 옵션 제공

디스코드는 이번 주부터 계정 활동 지표 등을 기준으로 성인과 청소년 이용자를 자동 분류하기 시작했다. 약 90%의 이용자는 별도 조치가 필요 없을 것으로 예상되며, 자동으로 확인되지 않은 이용자는 신용카드, 앱스토어, 얼굴 나이 추정 등의 방식으로 나이를 인증할 수 있다.