大数跨境

倒反天罡?DeepSeek-V4-Flash正式版上线,干翻自家先发的Pro

倒反天罡?DeepSeek-V4-Flash正式版上线,干翻自家先发的Pro 智东西
2026-07-31
3
导读:Pro正式版8月见。

DeepSeek-V4-Flash 正式版上线,Pro 版将于 8 月初发布。
作者 | 王涵
编辑 | 冰倩
智东西 7 月 31 日报道,DeepSeek-V4-Flash 正式版 API 今日开启公测,DeepSeek-V4-Pro 正式版预计于 8 月初上线。此次更新距 V4 预览版发布已历时三个月。

模型架构与核心能力升级

DeepSeek-V4-Flash 正式版延续 MoE 架构,总参数量达 284B(激活 13B),支持最长 100 万 token 上下文,并具备思考与非思考模式切换功能。其模型结构与尺寸与预览版保持一致,主要优化在于后训练阶段。

Agent 适配与兼容性优化

在生态适配方面,DeepSeek V4 已完成对 Claude Code、OpenClaw、OpenCode、CodeBuddy 等主流 Agent 产品的优化。Flash 正式版原生支持 OpenAI Responses API 格式,并针对性适配 Codex,开发者无需修改 Base URL 即可无缝切换模型。

基准测试性能表现

据官方文档显示,DeepSeek-V4-Flash 正式版的 Agent 能力显著增强,多项基准测试成绩远超 4 月发布的 Pro 预览版:

Terminal Bench 2.1: 82.7

NL2Repo: 54.2

Cybergym: 76.7

DeepSWE: 54.4

Toolathlon verified: 70.3

Agent Last Exam: 25.2

Automation Bench (Public): 25.1

DSBench-FullStack: 68.7

DSBench-Hard: 59.6

V4 系列预览版回顾与技术突破

今年 4 月 24 日,DeepSeek 开源 V4 系列预览版,采取双策略布局:Pro 版对标闭源旗舰模型,追求性能上限;Flash 版则通过缩小参数规模,实现更低延迟与成本。

Pro 预览版性能对标

评测数据显示,DeepSeek-V4-Pro-Preview 在 Agentic Coding 等领域跻身开源第一梯队。其交付质量在非思考模式下接近 Claude Opus 4.6,但在高难度数学、STEM 及竞赛型代码任务中,整体表现已比肩 GPT-5.4 及 Claude Opus 4.6-Max 等顶级闭源模型。

长上下文效率优化

在长上下文处理上,V4 系列实现了激进优化:在 100 万 token 场景下,单 token 推理计算量仅为 V3.2 的 27%,KV Cache 占用降至约 10%,大幅降低了长链路任务的算力与显存成本。

定价策略与成本控制

价格方面,DeepSeek-V4-Pro 输入命中缓存时为 1 元/百万 tokens,未命中为 12 元,输出为 24 元;DeepSeek-V4-Flash 更具性价比,输入命中缓存仅 0.2 元,未命中为 1 元,输出为 2 元。

行业观察:从价格战到能力战

近期 OpenAI 宣布 GPT-5.6 系列降价,被业内视为受国产大模型低价策略影响。然而,随着 API 调用成本普遍降低,价格已不再是开发者选择模型的唯一决定因素,具备实际交付能力的 Agent 才是竞争核心。
过去半年,国产大模型在保持价格优势的同时,加速补齐 Agent 与 Coding 能力短板。DeepSeek-V4-Flash 正式版以更低成本提供超越此前 Pro 预览版的 Agent 能力,证明了“低价不等于低能”。
对开发者而言,价格战仅是入局门槛,模型的 Agent 能力才是决定智能应用天花板的關鍵。
【声明】内容源于网络
0
0
智东西
各类跨境出海行业相关资讯
内容 11763
粉丝 0
智东西 各类跨境出海行业相关资讯
总阅读200.0k
粉丝0
内容11.8k