DeepSeek V4 推出的峰谷分时定价机制,是国内头部通用大模型首次落地的算力弹性定价体系。该机制对标传统工业能源调度模式,摒弃了单一的固定单价计费方式,实现了算力价格与市场供需、资源负载的动态匹配。
一、机制概述与落地背景
2026 年 6 月 29 日,DeepSeek 官方宣布将于 7 月中旬全面上线 DeepSeek V4 正式版,并同步启动国内首个 API 算力峰谷分时定价机制。本次调整仅针对企业 API 接口调用场景,普通用户的网页端及客户端免费对话服务不受影响。该机制旨在通过市场化价格杠杆优化全网算力调度,平抑日间峰值压力,有效缓解接口拥堵、超时及限流问题,显著提升企业用户服务的稳定性与可用性。
二、峰谷时段划分规则
1. 高峰时段
每日设定 7 小时高峰计费窗口:9:00–12:00、14:00–18:00。该时段覆盖企业核心办公与业务调用高峰期,周一至周日统一执行倍率上浮规则,无工作日与周末的差异化豁免。
2. 平/谷时段
除高峰时段外的所有时间均为平价时段,包括凌晨、夜间、午间(12:00–14:00)及全天周末。此期间持续沿用 DeepSeek V4 预览版基准低价,保障企业离线批量业务的低成本算力调度需求。
三、分时计费价格标准(单位:元/百万 Tokens)
1. deepseek-v4-pro 专业版
计费项 |
平峰原价 |
高峰双倍价 |
输入(缓存命中) |
0.025 |
0.05 |
输入(缓存未命中) |
3 |
6 |
输出 |
6 |
12 |
2. deepseek-v4-flash 极速轻量版
计费项 |
平峰原价 |
高峰双倍价 |
输入(缓存命中) |
0.02 |
0.04 |
输入(缓存未命中) |
1 |
2 |
输出 |
2 |
4 |
四、核心计费与服务规则
差异化调价规则:仅对高峰时段调用执行价格上浮,谷时段与平时段计费标准保持不变。结合 2026 年 4 月的永久降价政策,V4 Pro 模型综合成本已降至原定价的 2.5 折,夜间及周末批量业务可长期维持极低调用成本。
缓存复用低价机制:系统支持 Prompt 缓存命中计费模式。针对固定系统提示词、标准化高频问答及静态知识库调用等重复请求,可大幅降低算力成本,是企业规模化降本的关键手段。
计费时段判定规则:所有 API 请求以接口调用发起时间作为峰谷档位判定依据。跨时段的持续请求不分段计费,统一按发起时刻对应的档位进行结算。
调价缓冲机制:定价机制正式生效前 24 小时,官方将通过邮件向企业客户发送二次通知,用户可根据业务部署情况自主确认服务使用权限。
五、企业业务优化建议
离线批量任务错峰调度:将数据清洗、文档解析摘要、向量库构建、自动化报表生成及批量内容处理等非实时业务,统一调度至夜间或周末等谷时段执行,规避高峰溢价成本。
最大化 Prompt 缓存复用率:通过标准化固化系统提示词、业务通用问答模板及固定知识库检索逻辑,利用缓存机制大幅降低未命中输入 Token 的消耗,压缩核心调用成本。
模型分级调度策略:建立业务分层调用机制。日间高峰时段的简单查询与轻量化交互优先使用 Flash 模型;复杂推理、超长文本处理等高算力需求任务,延后至谷时段调用 Pro 模型,实现成本与效率的最佳平衡。
实时业务预算精细化管控:针对智能客服、实时 AI 检索、在线交互等不可错峰的核心实时业务,需完成高峰溢价后的成本核算与预算扩容,以保障业务稳定运行。
六、行业价值
DeepSeek V4 峰谷分时定价机制在优化平台算力调度效率、提升服务稳定性的同时,即便考虑高峰时段的价格上浮,其综合调用成本仍显著低于 GPT-4o、Claude Opus 等同类顶级模型。该机制为企业 AI 规模化落地提供了高性价比且可精细化管控的算力解决方案。

