搜索
首页
大数快讯
大数活动
服务超市
报告
跨企查
广告开户
产业带
导航
知识体系
工具箱
产业园
更多
百科
找货源
跨境招聘
DeepSeek
首页
>
V4 Flash不是降价,是清场
>
V4 Flash不是降价,是清场
AI驱动数字化转型
2026-08-01
1
导读:7月31日晚上发生的事,其实就一句话:一个卖 0.28 美元的模型,被抬进了旗舰的考场,大家争的是它和旗舰差 3 分还是 4 分,没人再问它配不配。
7月31日下午,
DeepSeek
悄悄上线了 V4-Flash 的正式版,没开新闻发布会,也没发预告。
结果当晚,知乎热搜第一。国外 Hacker News 上,两条相关帖子加起来一千多赞,三百多条评论在逐项核对它的分数。
大家围观的是一组价格:输出 0.28 美元每百万 token,输入 0.14 美元,缓存命中的输入 0.0028 美元。
一年半以前,DeepSeek 自己的推理模型 R1,输出价格是 2.19 美元。再往前数,V3 是 1.10 美元。同一个公司,同类负载,输出价格跌了 87%。
这不是一次普通的降价。降价是被动的让步,这次更像是主动清场。为什么这么说,得从这次更新到底改了什么讲起。
这次更新,强在哪
版本号 0731,意思是 7 月 31 日这一版。
官方更新日志说得很简短:正式版 API 上线公测,Agent 能力大幅增强,基准测试全面超越预览版。Agent 这个词可以理解成"会自己干活的 AI",让它改代码、查资料、操作软件,它自己一步步完成,不用人盯着。
衡量这种能力,行业里靠跑任务打分。这次公布了一串分数:终端操作测试 82.7,
工具
调用测试 70.3,软件工程任务 54.4,网络安全任务 76.7,还有几个别的,全线上涨。
最值得看的不是分数,是日志末尾那行小字:0731 和预览版用的是同一套架构、同一个参数规模,只是重新做了一轮后训练。
后训练可以理解成调教。发动机没换,排量没变,靠新的调校方式把性能硬拉上去。预览版终端操作测试是 56.9,正式版 82.7,一轮调教涨了 25.8 分。
这说明玩法变了。以前拼的是模型底子,谁算力多、架构新;现在拼的是调教功夫,谁的数据好、训练方法巧。DeepSeek 甚至把测试用的框架单独打包,准备公开发布,等于把"怎么调教、怎么测试"的方法论也摊开给人看。
有人评论说,以后发布模型会变成模型加框架成对出现,不再是一堆文件扔出来就完事。这个判断,看着正在成真。
0.28 美元,是什么概念
先看这笔钱买到了什么。
一次能装下 100 万 token 的上下文,相当于几本书的内容同时读进去;一次最多能输出 38 万 token,够生成一份长
报告
;同时能处理 2500 个请求,是 Pro 版的 5 倍。而价格只有 Pro 的三分之一,Pro 输出要 0.87 美元。
再放到国际市场里看。2025 年发布的旗舰闭源模型,输出定价在 10 美元上下,最贵的到过 75 美元。0.28 是 10 的三十六分之一,是 75 的两百六十八分之一。
Hacker News 上有句话传得很广:这个开源模型,用 GPT-3 时代的价格,对标
OpenAI
的 Sonnet 级模型。
GPT-3 时代什么价?当时最大的 GPT-3,每百万 token 收 60 美元,后来 gpt-3.5-turbo 降到 2 美元,都算是历史低价了。现在 0.28 美元。
独立评测机构 Artificial Analysis 给 Flash 的智能指数打了约 50 分。有开发者顺着他们的图表算了一笔账:OpenAI 那边能赢过 Flash 的最便宜型号,每任务成本大约是 Flash 的三倍,换来的是 2 到 5 倍的推理
速度
。
三倍的价格买速度,还是三分之一的价格接受慢一点。这道选择题,正被全球开发者用真金
白银
投票。
跟 OpenAI 的旗舰比,差距多大
社区最兴奋的不是价格,是分数。
有开发者整理了一份对比表,对手是 GPT-5.6 Terra,OpenAI 专门用来干 Agent 活的旗舰型号。终端操作测试,Flash 82.7 对 Terra 78.4;工具调用测试,70.3 对 53.1;软件工程任务,54.4 对 69.6;Agent 综合考试,25.2 对 50.4。
四组数据各有胜负,没有一边倒。原话是"和 Terra 打得有来有回"。
质疑声也有,而且很实在。官方分数是用自家测试框架测的,有人提出这不算公平对比;终端操作测试的第三方官方榜单上写的是 78.4,和 DeepSeek 自报的 82.7 有出入。已经有人提交了复核申请,等着第三方重新跑一遍。
注意这个现场:大家在逐项核对一个 0.28 美元模型的分数,争论它和旗舰差 3 分还是 4 分。放在一年前,这个价位的模型根本没资格进考场。质疑不是否定,恰恰说明它被抬进了旗舰的考场。
OpenAI 自己的编程助手,也用上它了
更新日志里还有一句:Flash 原生支持 Responses API,专门为 Codex 做了适配。
Codex 是 OpenAI 官方的编程 Agent,相当于 OpenAI 自己家的"会写代码的 AI 助手"。它的模型目录里,现在躺着 DeepSeek-V4-Flash,官方描述写的是"最新前沿的 Agentic 编码模型",1M 上下文,多 Agent 编排,shell 命令、补丁工具、联网搜索全都可用。
翻译成人话:OpenAI 自己家的编程助手,可以选 DeepSeek 当大脑,OpenAI 还给这个选择写了句"前沿模型"的推荐语。
这件事双向都成立才会发生。DeepSeek 这边,把接口、工具、协议逐条对齐 Codex 的要求。Codex 那边,愿意在目录里收录第三方模型,说明它判断这个后端在真实干活场景里够用。
中文媒体也注意到了。腾讯新闻的标题很实在:《DeepSeek V4正式版来了,但只来了一半》。Flash 是正式版了,Pro 的正式版还没出,官方只说"即将发布"。旧的 deepseek-chat、deepseek-reasoner 两个模型名,已经在 7 月 24 日退役,全部并进 V4 体系。
先放 Flash,Pro 跟在后面。清场的阵型已经摆开。
这场清场,清的是谁
现在的 AI 应用,交付价值的不是单个模型,是模型加工具加编排拼成的整套系统。一个任务干得成干不成,看几十次工具调用靠不靠谱,看长上下文丢不丢信息,看并发高峰顶不顶得住。模型单点的分数,只是其中一个变量。
系统把模型差距稀释了,最强模型的溢价就没了支撑。
Flash 踩的正是这个位置。单点不是最强,组合起来好用:工具调用稳,缓存自动管,上下文管够,并发管饱,主流 Agent 前端全兼容,思考过程还不另收费。够用的能力,配一个数量级的价格差,算术题就摆在那里。
冲击先落在三类玩家身上:
高价闭源的中端型号,能力不如旗舰,价格是 Flash 的三十倍以上,两头不靠。
套壳转售的中间商,模型厂商自己把工具调用、专用接口、联网搜索全做进标准协议,差价被直接抹平。
没有推理基础设施的模型创业公司,技术再先进,成本压不到这个水位,定价权就永远在别人手里。
还有一类,不是公司,是老习惯。"任务必须用最强模型"的执念,会在成本报表面前逐步瓦解。
定价页里还藏着一行通知:API 即将采用峰谷定价,工作日高峰时段价格翻倍。像电费,忙时贵,闲时便宜。这个信号说明需求已经大到让成本结构承压,也说明推理成本已经透明到可以精细运营。价格战打到这里,拼的不再是谁敢降价,是谁的算力成本更低、调度更精。
顺着这条线看,输出价格还会往下走,0.28 不是底,是新的锚。中等性能的通用模型会逐步消失,市场向两极收敛:旗舰卖稀缺能力,地板价卖规模。模型厂商的收入重心会从卖 token 转向卖场景,单价低到撑不起收入时,收入必然流向工具链、私有化部署和 Agent
服务
。
7月31日晚上发生的事,其实就一句话:一个卖 0.28 美元的模型,被抬进了旗舰的考场,大家争的是它和旗舰差 3 分还是 4 分,没人再问它配不配。
稻草压垮的不是某家公司,是某个价格时代。
而 V4-Pro 的正式版,还悬在"即将发布"四个字后面。这场清场的下半场,还在等着开场。
【声明】内容源于网络
0
0
AI驱动数字化转型
专注AI,促进智造行业数据衍生,服务智能制造企业的数字化、智能化,聚焦大模型私域部署、大模型微调、数据清洗、AI模型训练、私域知识库及agent技术延展等。行业智能,落地为先。
内容
1081
粉丝
1
关注
在线咨询
AI驱动数字化转型
专注AI,促进智造行业数据衍生,服务智能制造企业的数字化、智能化,聚焦大模型私域部署、大模型微调、数据清洗、AI模型训练、私域知识库及agent技术延展等。行业智能,落地为先。
总阅读
10.4k
粉丝
1
内容
1.1k