8月17日零点,DeepSeek正式落地国内大模型圈首套峰谷计价规则。此次调价未作预热,与一周前V4 Pro上线风格一致,通过后台静默更新完成API服务成本逻辑重构。开发者次日查询账单时方知定价体系已全面切换。
V4 Pro实行峰谷分时定价
8月12日上线的V4 Pro正式版曾因高性价比获市场关注,但仅一周后定价即迎来大幅调整。新规则依据国内开发者工作节奏划分时段:
- 高峰时段(9:00-12:00、14:00-18:00):缓存未命中输入价调整为9元/百万tokens,输出价为27元;缓存命中复用价格由0.025元涨至0.3元,涨幅超11倍。
- 闲时时段(其余17小时):所有服务单价为高峰价的50%。其中缓存未命中输入4.5元、输出13.5元,缓存命中复用成本降至0.15元,为错峰调度提供空间。
V4 Flash同步调整计价策略
轻量级模型V4 Flash同步切换峰谷计价。调价后高峰时段缓存命中、未命中输入及输出价格分别升至0.1元、3元和9元/百万tokens;闲时维持高峰价50%。该机制支持低延迟实时问答场景通过时段调度有效控制成本。
Harness v0.1开源Agent全栈框架
伴随调价消息,DeepSeek首款Agent原生产品Harness v0.1面向全球开放测试,并采用MIT协议开源全量代码。该产品采用“全插件化”架构,核心模块解耦,模型选型、工具调用、技能定制、会话管理、沙箱环境及前端交互等均为可插拔独立插件。开发者可自由替换底层模型或接入专属业务插件,摆脱厂商技术栈绑定,获得高度灵活的智能体开发底座。
从低价吸引迁移到峰谷定价调节算力供需,再到开源Agent全栈框架,DeepSeek正推动国内大模型竞争逻辑从单纯的“Token价格战”转向“算力使用效率”的新阶段。

