AI 定价观察 · 15 天
一边在公告中承认基准测试成绩基于自家框架,一边将价格上调最高达 12 倍。这种看似矛盾的组合背后,只有一种解释:DeepSeek 坚信其模型实力足以赢得市场。
8 月 8 日,笔者曾撰文指出:DeepSeek 的涨价并非背离“价格屠夫”的定位,而是低价策略成功后的必然收口。当时这仅是官方邮件中的一句预告。
15 天后,预测全面落地:
8 月 13 日,DeepSeek 正式宣布调价:输出价格从 6 元涨至 27 元(涨幅 350%),缓存命中价格从 0.025 元飙升至 0.30 元(涨幅 1100%,即标题所述的"12 倍”)。新价于 8 月 17 日生效,随后在 8 月 23 日补充规则,明确周末全天执行“谷电”低价。
短短 15 天内,定价规则三次调整:从宣布峰谷定价,到正式生效,再到细化高峰时段定义(工作日 9-12 点及 14-18 点)。与此同时,8 月 13 日发布的 DeepSeek Pro 版本反响平平,榜单数据与实际测试存在差距。
更为反常的是,DeepSeek 在承认公开基准上的 Agent 成绩是在自家"Harness 极简模式”下测得、并提示“其他框架结果可能不同”的情况下,依然坚持发布正式版并大幅涨价,且在一周内迅速推出了 Flash 多模态版本。
为何敢如此行事?核心判断在于底气:DeepSeek 相信其模型迭代速度极快,实测表现终将匹配榜单高度,因此敢于按未来的价值提前定价。
01
15 天规则三变:缓存命中价格上涨 12 倍
公告、生效、补条款,十天之内完成三次规则迭代
8 月 13 日至 23 日,DeepSeek 完成了一套 AI 行业罕见的组合动作:
8 月 13 日,官方宣布 V4-Pro 正式版上线,同步推出峰谷定价机制。其中,峰值时段输出价格从 6 元涨至 27 元(涨幅 350%);缓存命中价格从 0.025 元涨至 0.30 元(涨幅 1100%)。该政策于 8 月 17 日零时正式生效。
图 1:DeepSeek 官方定价页(2026-08-23),展示三模型峰谷价格表
图 2:8 月 8 日官方定价页快照,显示老价「输出 2 元/6 元」与「计划近期整体上调」预告
涨价前的旧价格表仍保留在 8 月 8 日的快照中,当时官方脚注已注明“计划近期整体上调 API 定价,预计涨幅较大”。同一周内,Flash 免费窗口开放,第三方数据显示 48 小时内消耗 220B tokens;8 月 21 日 Vision-Exp 上线并按 Flash 费率计费;评测框架 Harness 开源后迅速获得 18.62 万星标。
8 月 23 日,官方在定价页脚注中进一步明确:高峰时段为“北京时间周一至周五 9:00-12:00、14:00-18:00",其余时间及周末全天均视为空闲时段,执行低价策略。
这一系列操作违背了常规剧本。通常逻辑是:发现瑕疵→低调修复→新版发布时再涨价。而 DeepSeek 的路径是:承认瑕疵→正式发布→立即涨价→加速迭代。
这种反常行为的唯一合理解释是:团队对产品未来极具信心,并正在为这种确定性溢价收费。
02
62.7 分现象:榜单越高,实测越需谨慎
官方脚注坦诚:成绩基于自家 Harness 极简模式测试
首先需厘清事实:V4-Pro 发布确实存在局限性。
8 月 13 日官方公告脚注明确指出:"DeepSeek-V4-Pro-0813 在公开基准测试集的 Code Agent 任务中,使用 DeepSeek Harness 极简模式(max 档位,topp=0.95,temperature=1.0)进行测试,其他框架下结果可能略有不同。”
图 3:8 月 13 日官方公告页,含 Harness 脚注与资源调配说明
这意味着更换测试框架,成绩可能出现波动。
第三方实测印证了这一点。ctol.digital 测试显示:DeepSWE 分数从 12.8 跃升至 62.7,Terminal Bench 2.1 从 72.1 涨至 87.9,但在真实多样化的提示词下性能会退化,显示出 CoT(思维链)过度适配的特征。社区反馈更直接:“提示词越少越好”,脱离 Harness 环境难以复现高分。
关键对照在于:阿里云开发者社区测试显示,V4-Flash 在不同 Harness 下得分稳定在 90-95 分,未出现此类问题。因此判断:过拟合问题是 Pro 版本专属。
这并非造假,而是评测框架与真实调用分布不一致所致。Harness 极简模式如同特定题型,Pro 版本“刷题”过于精准,导致泛化能力暂时不足。这是可迭代的工程问题,而非模型能力虚假。
正因是工程问题,DeepSeek 才敢于照常发布正式版,因为他们确信该瑕疵可通过快速迭代修复。
03
90-95 分稳定性:Flash 换框架表现纹丝不动
Pro 存在过拟合专属问题,Flash 跨框架表现稳健
修复机制已经启动:
第一,模型本体无恙。Flash 版本在不同 Harness 下稳定保持 90-95 分,证明智能基座没有问题,症结在于评分方式与特定版本的适配。
第二,快速发布即是修复节奏。从 8 月 13 日 Pro 正式版,到 8 月 21 日 Vision-Exp,再到 8 月 22 日媒体报道的灰度新模型,DeepSeek 未选择停滞解释,而是用发布速度证明迭代能力。
第三,Harness 全面开源。该项目已在 GitHub 获得 18.62 万星标,秉持"Everything is a Plugin"理念。
图 4:GitHub deepseek-harness 仓库,获 18.62 万星标
将评测框架交给社区,由大众共同复现、修补和对齐。这不是掩盖问题,而是动员社区力量解决问题。
瑕疵止损靠的是时间而非辩解。DeepSeek 选择发得快、修得快,让下一版产品用实力说话。
04
2 亿 DAU 背后的账本:用户增 66.7%,算力仅增 8.3%
心虚者降价维稳,自信者涨价赚时间
涨价是一种强烈的信号。“我值这个价”必须建立在对未来时间表的确信之上。
对比来看:缺乏信心的公司会选择降价维稳,如《大模型价格战》中所述的 0.1 折、3 折续命;而自信的公司如英伟达、OpenAI 以及现在的 DeepSeek,则敢于通过涨价换取发展时间。
需求侧压力显而易见:据媒体报道,OpenRouter 周吞吐量达 7.11 万亿 tokens 居全球第一;DeepSeek DAU 达 2 亿(增长 66.7%),但算力仅增长 8.3%;5 月曾连续四次发生服务崩溃。需求明显超过产能,官方虽仅表述为“为了更加合理地调配资源”,但供需矛盾已成事实。
定价基础已从“边际成本”切换至“机会成本”。在软件逻辑下,多服务一个用户成本趋近于零;但在基建逻辑下,当产能稀缺时,上涨的不是智能本身的费用,而是“即时可用”的费用。
当然,有人会说涨价仅是为了收回成本或缓解产能不足。但这无法解释为何敢在公开承认瑕疵的当下,按未来高价售卖。DeepSeek 敢涨价,等于对“下一版性能到位”下了重注。
05
75% 降幅终结:从补贴期到收口期的逻辑切换
补贴、瓶颈、定价,三个阶段对应三种战略期许
DeepSeek 的价格演变轨迹,折射出公司对自身定位的三次战略升级。
三个阶段解析
补贴期:开源 + 白菜价 = 构建生态。旨在吸引开发者入驻,5 月甚至永久降价 75%。此时定价逻辑是战略投资,以亏损换市场。
瓶颈期:需求大于产能。DAU 激增 66.7% 而算力仅增 8.3%,导致服务崩溃、排队限流。此时定价逻辑切换为机会成本。
定价期:电网式价格表上线。实施峰谷电价、周末全谷、缓存命中高价策略。这不再单纯售卖软件,而是在售卖基础设施。
作为前云计算架构师,看到这张价格表的第一反应是:这完全符合电网定价逻辑。峰谷电价、错峰用电、固定成本加边际成本,DeepSeek 沿用了同一套账本。
敢将价格表做成“电网”形态,本身就是“我是基础设施”的自我认知。只有自信能长久存在的玩家,才配拥有基础设施的定价权。
核心判断
敢把价格表做成“电网”,标志着 DeepSeek 已完成从应用层到基础设施层的自我认知跨越——基础设施定价权只属于那些自信将长期主导市场的玩家。
登顶需要巨额投入:显卡、电力、下一代模型研发。资金从何而来?要么依赖补贴,要么由用户承担。DeepSeek 选择了后者,意味着必须开始严格考量成本限制。
06
3 次预言应验:从免费狂欢到价值回归
三条旧文预言,今日全部兑现
回顾过往,三条预言已全部应验:
5 月 4 日曾预言:“未来 AI 将走向优质模型昂贵化,只有付费才能享受顶级服务。”如今应验:Pro 版涨价 4.5 倍,但 Flash 版仍维持全场最低价,Vision 版按 Flash 计价。贵的是头部能力,便宜的是基本盘。
8 月 8 日曾指出:“最便宜的模型开始涨价,AI 成本账开始重算。”如今应验:涨价标志着变现开关正式落地;新增的变量是,变现的底气源于技术自信。
8 月 13 日曾断言:“这种水平的智能,将像水电一样持续使用。”如今应验更为精确:峰谷 + 周末规则构成了真实的“电网”模型,8 月 23 日连“周末谷电”细节都已补齐。
作者原话回顾
8 月 8 日的判断正在兑现:DeepSeek 对模型极具自信,虽然 Pro 发布初期有瑕疵,但后续版本的快速迭代将使能力与实测对标,从而占据头部第一位置,因此必须考虑成本限制。
量的第一已有公开数据佐证(OpenRouter 周第一、DAU 2 亿)。现在赌的是质的第一:当能力与实测完全对标之日,就是其头部地位彻底坐实之时。
07
90 倍价差:同样的 Token,不同的结构不同的价
决定成本的不再是模型选择,而是购买的结构
在当前的定价体系下,决定成本的关键不再是选择哪家模型,而是你采用的调用结构。
三个省钱结构策略
错峰:将重负载任务移至周末或夜间。官方明确鼓励,周末全天执行空闲低价。
缓存:优先利用缓存命中最低档,适用于长上下文和高复用场景。0.15 元与 13.5 元之间,存在高达 90 倍的价差。
混合:采用“官方 Flash+ 第三方 Pro/本地兜底路由”策略。建议第三方计费工具支持 weekday 轴以优化成本。
这一变化对 API 密集的 Agent 开发者影响最大,而对普通网页和 App 用户几乎无感。
如果说 AI 免费时代真有谢幕,那它谢幕的原因不是竞争,而是自信。
底气来自模型越来越强,DeepSeek 用一张电网式价格表宣布:我信我能赢,而且我为赢定了价。

