業界ではこのところ「pacing the frontier(フロンティアモデルの進展を緩やかにする)」という言葉がよく聞かれる。しかし2026年9月22日、AnthropicとOpenAIはほぼ同時に新モデルを発表し、少なくとも価格競争の面では誰も立ち止まるつもりがないことを証明した。
Anthropicの新モデル「Claude Opus 5.5」は、企業顧客が関心を寄せる場面に狙いを定めている。ソフトウェアの非効率な部分を見つけて修正すること、財務分析、ビジネス文書作成などだ。Anthropic自社のベンチマークによれば、Opus 5.5は「Terminal-Bench 4.0」と「FrontierCode v1.1(Main)」の2つのテストにおいて、agentic codingの性能でOpenAIの「GPT-6 Astra」を上回っており、開発者にとっては魅力的なポイントとなる。価格面では、Opus 5.5の入力トークンは100万トークンあたり4ドル、出力は20ドルまで下がり、前世代の「Opus 5」(入力5ドル、出力25ドル)よりかなり安くなった。Anthropicはまた、新モデルは「安全境界を回避しようとする試みが従来より約85%減少した」とし、文章の出力もより読みやすくなったと述べている。
一方OpenAIは、「GPT-6 Sol」と「GPT-6 Luna」の2モデルを同時に発表した。訓練手法は「GPT-6 Astra」と同じ路線を踏襲しており、専門的な業務、プログラミング、コンピュータ操作能力の向上を売りにしている。価格は「GPT-5.6」のセール価格よりも最大50%安い。GPT-6 Solの入力トークンは100万トークンあたり2ドル、出力は10ドル。Lunaはさらに安く、入力0.1ドル、出力0.5ドルとなっている。OpenAIによれば、Solのエラー率は前世代の約半分に減少し、プログラミングの性能はAnthropicの「Fable 5.1」に匹敵しながら、コストはより低いという。プロンプトキャッシングの改善と合わせて、両新モデルはコンテキストの再利用性が高まり、応答速度も向上している。
アライメントテストについて、OpenAIは自社テストの結果、GPT-6シリーズのモデルはプログラム実行結果を報告する際に嘘をつく割合が低下し、安全でない指示に直面した際に安全機構の回避を拒否する割合も向上したとしている。Anthropicと同様、OpenAIも第三者評価者が使用できる一連の判断基準を提示し、AIの発展の進捗と安全性を測る指標とした。これらの提案が業界全体で共有される規範となるかどうかは、現時点ではまだ答えが出ていない。
利用可能性については、Opus 5.5はすでに開発者向けに公開されており、Claude、Amazon Web Services、Google Cloud、Microsoft Azureを通じて利用できる。GPT-6 SolとGPT-6 Lunaは「ChatGPT Work」と「Codex」に搭載され、Plus、Pro、Business、Enterpriseの各ユーザーに提供される。無料ユーザーとGoサブスクリプション利用者は、現時点ではデスクトップ版アプリでGPT-6 Lunaのみ利用可能となっている。