OFweek AI 产业应用消息,DeepSeek-V4-Flash 正式版 API 现已上线公测,DeepSeek-V4-Pro 正式版预计于 8 月初发布。此次更新距 DeepSeek V4 预览版上线已历时三个月。
性能表现:小参数模型超越旗舰预览版
测试数据显示,DeepSeek-V4-Flash 在多项基准测试中表现优异:Terminal Bench 2.1 得分为 82.7 分,Cybergym 为 76.7 分,Toolathlon Verified 为 70.3 分,内部全栈测试 DSBench-FullStack 为 68.7 分,高难度编码任务 DSBench-Hard 为 59.6 分。官方指出,V4-Flash 在多项代码智能体指标上已优于 V4-Pro-Preview 版本。
技术解析:后训练优化成效显著
本次更新的核心亮点在于技术路径的突破。DeepSeek-V4-Flash-0731 的模型结构与尺寸与预览版保持一致,仅通过重新进行后训练(Post-training)实现了性能跃升。这意味着在过去三个月中,团队未在预训练层增加任何参数。
参数对比显示,V4-Flash 总参数量为 284B(激活参数 13B),而 V4-Pro 总参数量高达 1.6T(激活参数 49B)。两者在总参数和激活参数上分别相差 5.6 倍和 3.8 倍。然而,这款仅拥有 13B 激活参数的模型,凭借相同的架构骨架,在代码智能体任务中成功超越了自家 49B 激活参数的旗舰预览版。
生态适配与定价策略
原生支持 Responses API 与 Codex
值得关注的是,V4-Flash 正式版原生支持 Responses API 格式,并专门针对 Codex 进行了适配。用户只需配置一次,即可在 Codex CLI、ChatGPT 桌面端及 VS Code 的 Codex 插件中直接调用。在 Anthropic 收紧对中国背景团队 API 访问的背景下,DeepSeek 的这一举措提供了极具竞争力的替代方案。
极具竞争力的价格体系
价格方面,DeepSeek 推出了极具吸引力的计费标准:
- DeepSeek-V4-Pro:输入命中缓存时为 1 元/百万 tokens,未命中时为 12 元/百万 tokens,输出价格为 24 元/百万 tokens。
- DeepSeek-V4-Flash:输入命中缓存时仅需 0.2 元/百万 tokens,未命中时为 1 元/百万 tokens,输出价格仅为 2 元/百万 tokens。

