DeepSeek 的“白菜价”时代即将终结。
DeepSeek-V4-Pro正式版正式发布。该模型在 DeepSWE 评测中得分 62.7%,超越 Claude Opus 4.8(58%),智能体能力显著增强,并全面支持 Responses API 与 Codex 接入。然而,伴随性能升级的是定价策略的重大调整:自 8 月 17 日起,将启用峰谷分时计价,高峰时段输出价格涨幅达 4.5 倍。
性能实测:代号 0813 的全面进化
代号"0813"的DeepSeek-V4-Pro正式版在 10 项智能体评测中斩获两项单项冠军。在 Cybergym 测试中得分为 83.3%,以微弱优势超越 Claude Fable 5;在 AutomationBench 测试中得分为 31.8%,优于 Kimi K3 的 30.8%。
此次升级进步最为显著的是 DeepSWE 指标,得分从预览版的 12.8% 飙升至 62.7%,不仅超越了 Claude Opus 4.8(58%)和 GLM-5.2(46.2%),也缩小了与 Kimi K3(67.5%)及 Claude Fable 5(70%)的差距。此外,在 Terminal Bench 2.1 测试中,该模型得分 87.9%,与 Kimi K3、Claude Fable 5 处于同一梯队,均优于 Claude Opus 4.8 的 85%。
数据显示,正式版与预览版存在量级差异:DeepSWE 提升近 50 个百分点,Terminal Bench 从 72.1% 升至 87.9%,Cybergym 从 52.7% 跃升至 83.3%。DeepSeek-V4-Pro的纸面战斗力表现强劲。
不过,参考 Artificial Analysis 模型榜单,DeepSeek-V4-Pro正式版综合得分为 53 分,仅比DeepSeek-V4-Flash(52 分)高出 1 分。在全球排名中,其得分仍落后于同日发布的 Grok 4.6(61 分)和 Kimi K3(60 分)。
定价新政:峰谷制下成本大幅上调
相比性能提升,新的定价方案更值得关注。DeepSeek 将于 8 月 17 日零点正式实施峰谷分时定价,高峰时段(北京时间 9:00-12:00 及 14:00-18:00)价格为空闲时段的两倍。
DeepSeek-V4-Pro新价格标准如下:
- 高峰时段:输入 9 元/百万 tokens,输出 27 元/百万 tokens。
- 空闲时段:输入 4.5 元/百万 tokens,输出 13.5 元/百万 tokens。
作为对比,涨价前该模型输入仅需 3 元(缓存命中低至 0.025 元),输出为 6 元。以占比最大的输出部分计算,空闲时段价格涨幅达 125%(2.25 倍),高峰时段涨幅高达 350%(4.5 倍)。
换算为美元,DeepSeek-V4-Pro高峰时段输出价格为 4.01 美元/百万 tokens。相比之下,Grok 4.6 为 6 美元,Claude Opus 5 高达 25 美元。考虑到综合智能水平,涨价后的 DeepSeek 虽仍具价格优势,但已不再像此前那样悬殊。
性价比新选:DeepSeek-V4-Flash
值得注意的是,DeepSeek-V4-Flash在新定价体系下反而凸显出极高的性价比。其空闲时段输出价格仅为 4.5 元(约 0.67 美元),高峰时段为 9 元(约 1.34 美元)。此前该版本在 DeepSWE 评测中已取得 54.4% 的优异成绩,适合对成本敏感的应用场景。
新定价将于 8 月 17 日正式生效,用户若需体验低价 API,需在窗口期内抓紧部署。
接入指南与技术参数
DeepSeek-V4-Pro正式版现已上线 DeepSeek APP 及网页端,用户选择“专家模式”即可调用。
在开发接入方面,新模型已支持 Responses API,可直接沿用 OpenAI 格式调用;同时兼容 Codex 接入,开发者可在 OpenAI Codex 环境中切换至 DeepSeek 模型。此外,Anthropic API 格式亦在兼容列表之中。
核心技术参数保持不变:
- 上下文窗口:100 万 tokens
- 最大输出:384K tokens
- 思考模式:默认开启
- 参数量:总参数 1.6 万亿,每次 Token 激活 490 亿参数
调用方式无需变更,API 模型名称仍为deepseek-v4-pro,切换至正式版无需修改既有代码。
峰谷定价的风潮,终于席卷至 AI 大模型领域。

