新智元报道
今日,DeepSeek 正式官宣:DeepSeek-V4-Flash 正式版 API 开启公测。此次更新凭借三大核心突破引发开发者社区广泛关注。
首先,Agent 能力显著升级,性能超越 V4 Pro 预览版;其次,模型架构保持不变,完全依托后训练技术实现性能飞跃;最后,OpenAI 开源的 Codex 现已支持接入 DeepSeek-V4-Flash,而 DeepSeek-V4-Pro 预计将于 2026 年 8 月初完成适配。此外,DeepSeek Harness 也即将发布。
在 GPT-5.6 降价的背景下,DeepSeek-V4-Flash 的推出被视为对现有市场格局的一次强力冲击,标志着平民化 Agent 时代的到来。
极速版性能越级,比肩专业模型
传统认知中,"Flash"代表轻量低价,"Pro"象征全能昂贵。然而,DeepSeek-V4-Flash 正式版打破了这一规则。这款参数量不到 300B 的轻量级模型,在多项测试中不仅大幅超越前代,甚至在部分指标上追平了 Opus 4.8。
在专为真实开发环境和复杂代码设计的 DSBench-FullStack 与 DSBench-Hard 测试中,V4-Flash 正式版得分远超预览版,表现令业界瞩目。
开发者评价指出,该模型在当前使用场景下已呈现“性能溢出”状态,兼具低成本与高智能,真正推动了 Agent 技术的普及。
后训练技术突破,重塑模型潜能
令人惊叹的是,DeepSeek-V4-Flash-0731 的模型结构与尺寸与此前的 Preview 版本完全一致,性能的巨大提升 solely 归功于重新进行的后训练(Post-training)。
DeepSeek-V4-Flash-0731 的模型结构、尺寸和 DeepSeek-V4-Flash-Preview 保持一致,仅重新进行了后训练。
这一成果有力证明了后训练技术在大模型领域的巨大潜力。DeepSeek 通过独特的方法论,成功将 200B 量级的模型调教出远超其体量的智能水平,为行业挖掘模型潜能提供了新思路。
原生适配 Responses API 与 Codex
针对开发者痛点,本次更新宣布 V4-Flash 原生支持 Responses API 格式,并全面适配 Codex。
Responses API 彻底解决了大模型输出 JSON 格式不稳定的难题,确保数据结构输出的精准度达到 100%。结合强大的 Agent 规划能力,开发者可放心利用该模型调用外部工具、操作数据库及控制 RPA 机器人。
全面适配 Codex 意味着 V4-Flash 在代码生成、审查及自动补全方面已达到专业助手水准,可无缝接入 VS Code、Codex CLI 或 ChatGPT 桌面端。
macOS / Linux 用户可在终端执行:
bash <(curl -fsSL https://cdn.deepseek.com/api-docs/codex-deepseek-setup.sh)
Windows 用户可在 PowerShell 中执行:
irm https://cdn.deepseek.com/api-docs/codex-deepseek-setup-en.ps1 | iex
国产大模型重塑全球 AI 格局
凭借极高的性价比,200B 参数的 V4-Flash 已在 Agent 和代码能力上展现出“性能溢出”的优势,足以应对长文本、高并发及多 Agent 协同等日常任务。
官方表示,此次升级仅针对 V4-Flash API,V4-Pro API 及应用端模型暂未变动,正式版即将发布。若 200B 参数的 Flash 版本仅靠后训练即可达到如此高度,那么传闻中 1.6T 参数的 V4-Pro 正式版无疑更值得期待。
业界正密切关注 V4-Pro 能否与顶级模型正面竞争。若这一天到来,将是国产大模型重塑全球 AI 格局的重要时刻。
参考资料:
编辑:Aeneas 大卫

