12.8 分到 62.7 分,這是 DeepSeek 自己公布的 DeepSWE 測試成績,橫跨的是同一個模型的兩個版本:今年 4 月的預覽版,與 8 月 13 日正式轉正的 DeepSeek-V4-Pro。中間差了將近五倍。

DeepSeek-V4-Pro 轉正上線,一個分數說明了它想在 Agent 戰場拿下什麼

台北時間 8 月 13 日,DeepSeek 官方透過 X 帳號(@deepseek_ai)與 API 更新日誌宣布 V4-Pro 正式版(GA 版本)全面上線,這是繼 4 月預覽版、7 月 V4-Flash 之後,V4 系列旗艦模型的正式轉正。目前已同步在官方 App、網頁端與 API 平台開放,開發者只要把呼叫模型名稱設定為 deepseek-v4-pro 即可切換使用。除了 DeepSWE 分數暴增,V4-Pro 在 Terminal Bench 2.1 也拿下 87.9 分,官方將這組成績直接對應到「生產環境與 Agent 任務」的實戰能力。

分數之外,這次更新真正照顧到開發者情緒的,是原生支援 OpenAI Responses API 格式,並針對 Codex 做了適配。官方提供一鍵配置腳本,用意很直接:降低專案從其他平台遷移過來的技術門檻。對於已經在用 OpenAI 生態的團隊來說,這是一個「換引擎不用拆車」的訊號。

思考模式這次也被拆得更細,V4-Pro 與 V4-Flash 都新增 low、high、max 三檔強度,官方建議簡單任務用 low、日常 Agent 任務用 high、複雜運算才切到 max。底層規格維持原本的重量級規模:混合專家(MoE)架構,總參數 1.6 兆,激活約 490 億參數,支援 100 萬 Token 上下文與最高約 38.4 萬 Token 輸出。

定價策略也一併預告。目前計費暫時沿用預覽版標準,輸入約每百萬 Token 3 元人民幣、輸出約 6 元人民幣,快取命中則更低。新制將於北京時間 2026 年 8 月 17 日凌晨 0 時生效,屆時導入「峰谷定價」,離峰時段呼叫 API 只要高峰時段的一半價格。想搶先體驗的使用者,目前可透過官網 Expert Mode 或官方 App 直接呼叫。