业界这阵子都在谈「pacing the frontier」,也就是放慢前沿模型的推进速度。但2026年9月22日这天,Anthropic和OpenAI几乎同步宣布新模型,证明至少在定价战场上,谁都没打算停下来。
Anthropic的新款Claude Opus 5.5,锁定的是企业客户会关心的场景:找出并修复软件里的低效问题、财务分析、商业文书工作。Anthropic自家的benchmark显示,Opus 5.5在Terminal-Bench 4.0与FrontierCode v1.1(Main)两项测试中,agentic coding表现优于OpenAI的GPT-6 Astra,对开发者来说是个卖点。价格上,Opus 5.5的输入token降到每百万4美元、输出20美元,比前代Opus 5的5美元输入、25美元输出便宜一截。Anthropic也表示,新模型「尝试绕过安全边界的次数比过去减少约85%」,写作输出也更容易阅读。
OpenAI这边一次推出两款:GPT-6 Sol与GPT-6 Luna,训练方法沿用GPT-6 Astra那一套,主打专业工作、程序撰写与电脑操作能力的提升,价格比GPT-5.6的促销价便宜最多50%。GPT-6 Sol输入token每百万2美元、输出10美元;Luna更便宜,输入0.1美元、输出0.5美元。OpenAI表示Sol的出错率比前代少了约一半,写程序的表现能追平Anthropic的Fable 5.1,但成本更低。搭配prompt caching的改进,两款新模型能重复利用更多上下文,回应速度也更快。
对齐测试的部分,OpenAI说根据自家测试,GPT-6系列模型在回报程序运行结果时说谎的比例更低,面对不安全指令时拒绝绕过安全机制的比例也提高了。和Anthropic一样,OpenAI也提出了一套供第三方评估者使用的判断标准,用来衡量AI发展的进度与安全性。这些提案能不能变成产业共同遵循的规范,目前还没有答案。
可用性方面,Opus 5.5现在已经开放给开发者,可透过Claude、Amazon Web Services、Google Cloud与Microsoft Azure使用。GPT-6 Sol和GPT-6 Luna则进驻ChatGPT Work与Codex,提供给Plus、Pro、Business与Enterprise用户;免费用户与Go订阅者,目前只能在桌面版App里用到GPT-6 Luna。