業界這陣子都在談「pacing the frontier」,也就是放慢前沿模型的推進速度。但2026年9月22日這天,Anthropic和OpenAI幾乎同步宣布新模型,證明至少在定價戰場上,誰都沒打算停下來。
Anthropic的新款Claude Opus 5.5,鎖定的是企業客戶會關心的場景:找出並修復軟體裡的低效問題、財務分析、商業文書工作。Anthropic自家的benchmark顯示,Opus 5.5在Terminal-Bench 4.0與FrontierCode v1.1(Main)兩項測試中,agentic coding表現優於OpenAI的GPT-6 Astra,對開發者來說是個賣點。價格上,Opus 5.5的輸入token降到每百萬4美元、輸出20美元,比前代Opus 5的5美元輸入、25美元輸出便宜一截。Anthropic也表示,新模型「嘗試繞過安全邊界的次數比過去減少約85%」,寫作輸出也更容易閱讀。
OpenAI這邊一次推出兩款:GPT-6 Sol與GPT-6 Luna,訓練方法沿用GPT-6 Astra那一套,主打專業工作、程式撰寫與電腦操作能力的提升,價格比GPT-5.6的促銷價便宜最多50%。GPT-6 Sol輸入token每百萬2美元、輸出10美元;Luna更便宜,輸入0.1美元、輸出0.5美元。OpenAI表示Sol的出錯率比前代少了約一半,寫程式的表現能追平Anthropic的Fable 5.1,但成本更低。搭配prompt caching的改進,兩款新模型能重複利用更多上下文,回應速度也更快。
對齊測試的部分,OpenAI說根據自家測試,GPT-6系列模型在回報程式執行結果時說謊的比例更低,面對不安全指令時拒絕繞過安全機制的比例也提高了。和Anthropic一樣,OpenAI也提出了一套供第三方評估者使用的判斷標準,用來衡量AI發展的進度與安全性。這些提案能不能變成產業共同遵循的規範,目前還沒有答案。
可用性方面,Opus 5.5現在已經開放給開發者,可透過Claude、Amazon Web Services、Google Cloud與Microsoft Azure使用。GPT-6 Sol和GPT-6 Luna則進駐ChatGPT Work與Codex,提供給Plus、Pro、Business與Enterprise用戶;免費用戶與Go訂閱者,目前只能在桌面版App裡用到GPT-6 Luna。