12.8 分到 62.7 分,这是 DeepSeek 自己公布的 DeepSWE 测试成绩,横跨的是同一个模型的两个版本:今年 4 月的预览版,与 8 月 13 日正式转正的 DeepSeek-V4-Pro。中间差了将近五倍。

DeepSeek-V4-Pro 转正上线,一个分数说明了它想在 Agent 战场拿下什么

台北时间 8 月 13 日,DeepSeek 官方透过 X 帐号(@deepseek_ai)与 API 更新日志宣布 V4-Pro 正式版(GA 版本)全面上线,这是继 4 月预览版、7 月 V4-Flash 之后,V4 系列旗舰模型的正式转正。目前已同步在官方 App、网页端与 API 平台开放,开发者只要把调用模型名称设置为 deepseek-v4-pro 即可切换使用。除了 DeepSWE 分数暴增,V4-Pro 在 Terminal Bench 2.1 也拿下 87.9 分,官方将这组成绩直接对应到「生产环境与 Agent 任务」的实战能力。

分数之外,这次更新真正照顾到开发者情绪的,是原生支持 OpenAI Responses API 格式,并针对 Codex 做了适配。官方提供一键配置脚本,用意很直接:降低项目从其他平台迁移过来的技术门槛。对于已经在用 OpenAI 生态的团队来说,这是一个「换引擎不用拆车」的信号。

思考模式这次也被拆得更细,V4-Pro 与 V4-Flash 都添加 low、high、max 三档强度,官方建议简单任务用 low、日常 Agent 任务用 high、复杂运算才切到 max。底层规格维持原本的重量级规模:混合专家(MoE)架构,总参数 1.6 兆,激活约 490 亿参数,支持 100 万 Token 上下文与最高约 38.4 万 Token 输出。

定价策略也一并预告。目前计费暂时沿用预览版标准,输入约每百万 Token 3 元人民币、输出约 6 元人民币,缓存命中则更低。新制将于北京时间 2026 年 8 月 17 日凌晨 0 时生效,届时导入「峰谷定价」,离峰时段调用 API 只要高峰时段的一半价格。想抢先体验的用户,目前可透过官网 Expert Mode 或官方 App 直接调用。