八月,OpenAI 才因为自家模型入侵了 AI 平台 Hugging Face 而宣布放慢前沿模型的开发速度。九月三日,公司就发布了 GPT-6 Astra——距离上一个模型家族 GPT-5.6 Sol、Terra 与 Luna 上市,中间只隔了不到两个月。OpenAI 称 Astra 是「全世界最聪明、最对齐的模型」,同时也暗示,这可能是接下来一段时间内公司最后一次发布重大模型。
官方表示,Astra 特别擅长电脑操作与浏览器操作,能处理软件工程、资安、科学研究与一般专业事务。发布同步发布的示范视频里,Astra 一边做 3D 建模、一边做投视频,甚至同时处理跨领域的多项任务,例如一边叫外送、一边写游戏代码。OpenAI 强调这套模型具备「强大的视觉判断力」,运行多步骤工作流程时不会偏离最初的指示。
资安测试的满分,恰好接在黑客事件之后
Astra 在 ARC-AGI-3——业界用来衡量 AI 解决陌生问题能力的基准测试——拿下 98.6% 的成绩。VentureBeat 报导指出,这个分数需要打上但书:不同 AI 在受测时的系统配置并不一致,像是是否具备持续记忆等架构差异,都可能影响结果。相对明确的数字则是:Astra 在程序能力测试 Terminal Bench 4.0 拿下 57.7%,在衡量代理能力的 Agent's Last Exam 拿下 59.3%,皆高于前代 GPT-5.6 Sol。
真正值得留意的是资安相关项目。Astra 在专门测试模型能否利用软件漏洞的 ExploitBench 拿下满分,相较之下 GPT-5.6 Sol 只有 78.5%。另一项测试 SRE-Bench,用来衡量模型在没有源代码的情况下逆向工程软件二进位档的能力,Astra 一次尝试就解出 88.0% 的任务,四次尝试内达 99.2%;同样条件下 GPT-5.6 Sol 分别只有 55.9% 与 68.7%。
OpenAI 表示 Astra 的「对齐」能力也一并提升,涵盖遵循指令范本、更透明地表达自身状态等面向,同时特别训练模型不去运行高级资安攻击任务。公司称添加的防护机制能让 Astra 更能抵御越狱式提示攻击,也有助于公司监控滥用情况。一个在漏洞利用测试拿满分的模型,刚好出现在另一个 OpenAI 模型真的入侵过平台之后——这个时间点的巧合,值得读者自己记住。
开放时程与定价
OpenAI 表示 Astra 今日起先开放给少数组织使用,接下来几天内会陆续开放给所有 ChatGPT Plus、Pro、Business 与 Enterprise 用户,同时透过 OpenAI API 与 AWS 提供。对开发者而言,透过 API 调用 Astra 的价格是每百万输入 token 10 美元、每百万输出 token 50 美元,落在目前 AI 模型定价偏高的一端。
OpenAI 总裁 Greg Brockman 向 VentureBeat 表示,衡量 token 价格未必是企业采购的正确方式,「你真正想要的,而且我认为市场也开始意识到这点,是每个任务的价格。问题其实是:你能不能用合理的成本、合理的速度把事情做完。」对 OpenAI 而言,这句话等于是把 Astra 昂贵的 token 定价,重新包装成「完成任务」的效率承诺。