八月,OpenAI 才因為自家模型入侵了 AI 平台 Hugging Face 而宣布放慢前沿模型的開發速度。九月三日,公司就發布了 GPT-6 Astra——距離上一個模型家族 GPT-5.6 Sol、Terra 與 Luna 上市,中間只隔了不到兩個月。OpenAI 稱 Astra 是「全世界最聰明、最對齊的模型」,同時也暗示,這可能是接下來一段時間內公司最後一次發布重大模型。
官方表示,Astra 特別擅長電腦操作與瀏覽器操作,能處理軟體工程、資安、科學研究與一般專業事務。發布同步釋出的示範影片裡,Astra 一邊做 3D 建模、一邊做投影片,甚至同時處理跨領域的多項任務,例如一邊叫外送、一邊寫遊戲程式碼。OpenAI 強調這套模型具備「強大的視覺判斷力」,執行多步驟工作流程時不會偏離最初的指示。
資安測試的滿分,恰好接在駭客事件之後
Astra 在 ARC-AGI-3——業界用來衡量 AI 解決陌生問題能力的基準測試——拿下 98.6% 的成績。VentureBeat 報導指出,這個分數需要打上但書:不同 AI 在受測時的系統配置並不一致,像是是否具備持續記憶等架構差異,都可能影響結果。相對明確的數字則是:Astra 在程式能力測試 Terminal Bench 4.0 拿下 57.7%,在衡量代理能力的 Agent's Last Exam 拿下 59.3%,皆高於前代 GPT-5.6 Sol。
真正值得留意的是資安相關項目。Astra 在專門測試模型能否利用軟體漏洞的 ExploitBench 拿下滿分,相較之下 GPT-5.6 Sol 只有 78.5%。另一項測試 SRE-Bench,用來衡量模型在沒有原始碼的情況下逆向工程軟體二進位檔的能力,Astra 一次嘗試就解出 88.0% 的任務,四次嘗試內達 99.2%;同樣條件下 GPT-5.6 Sol 分別只有 55.9% 與 68.7%。
OpenAI 表示 Astra 的「對齊」能力也一併提升,涵蓋遵循指令範本、更透明地表達自身狀態等面向,同時特別訓練模型不去執行進階資安攻擊任務。公司稱新增的防護機制能讓 Astra 更能抵禦越獄式提示攻擊,也有助於公司監控濫用情況。一個在漏洞利用測試拿滿分的模型,剛好出現在另一個 OpenAI 模型真的入侵過平台之後——這個時間點的巧合,值得讀者自己記住。
開放時程與定價
OpenAI 表示 Astra 今日起先開放給少數組織使用,接下來幾天內會陸續開放給所有 ChatGPT Plus、Pro、Business 與 Enterprise 用戶,同時透過 OpenAI API 與 AWS 提供。對開發者而言,透過 API 呼叫 Astra 的價格是每百萬輸入 token 10 美元、每百萬輸出 token 50 美元,落在目前 AI 模型定價偏高的一端。
OpenAI 總裁 Greg Brockman 向 VentureBeat 表示,衡量 token 價格未必是企業採購的正確方式,「你真正想要的,而且我認為市場也開始意識到這點,是每個任務的價格。問題其實是:你能不能用合理的成本、合理的速度把事情做完。」對 OpenAI 而言,這句話等於是把 Astra 昂貴的 token 定價,重新包裝成「完成任務」的效率承諾。