今日,据可靠消息,DeepSeek 将于 9 月 10 日前后正式发布 V4.1 Flash 模型。
模型升级与路由策略
根据官方通告及外部测试反馈,V4.1 Flash 在各项核心指标上已超越 V4 Pro。因此,在 V4.1 Flash 正式上线至 V4.1 Pro 发布前的过渡期内,所有发往 V4 Pro 的请求将统一路由至 V4.1 Flash,并严格按照 V4.1 Flash 的价格标准计费。
目前,开发者可通过设置模型名为deepseek-v4.1-flash-expires-on-0910直接调用该版本。其基础费用与现行 V4 Flash 持平,但并发数暂时限制为 20。
价格下调详情
自 9 月 10 日 12 时起,Flash 系列模型定价迎来大幅下调:
- 空闲时段:输入价格从 1.5 元/百万 Token 降至 1 元;输出价格从 4.5 元/百万 Token 降至 4 元;缓存命中输入价格从 0.05 元降至 0.02 元。
- 高峰时段:价格维持为空闲时段的 2 倍。
市场竞争力分析
鉴于 Agent 类产品实际缓存命中率通常在 95%-99% 之间,此次调价显著提升了 DeepSeek 的性价比,使其成为 GLM-5.3-Flash 的强力竞争者。尽管目前 GLM-5.3 Flash 在部分平台(如 ZCode)提供双倍额度优惠及夜间闲时免费政策,但两者的最终性价比优劣,仍需等待后续真实场景的测试数据验证。
社区初步评价显示,V4.1 Flash 在整体效果与成本效益方面表现优异。
#每日思考 #DeepSeek

