
DeepSeek V4.1 Flash 开启内测:原生多模态,速度成本双优化
智东西 9 月 8 日消息,DeepSeek 正式宣布其新一代模型DeepSeek V4.1 Flash中间版本开启内测。该模型采用全新架构,原生支持多模态处理,在显著提升推理能力的同时,实现了更快的响应速度与更低的运营成本。
开发者无需更改 base_url,仅需将模型名称设置为deepseek-v4.1-flash-expires-on-0910即可调用。当前计费标准与 DeepSeek V4 Flash 保持一致,单账号并发限制为 20。
定价策略与有效期说明
DeepSeek V4.1 Flash 内测版沿用了前代产品的定价体系。空闲时段价格为:输入(缓存命中)0.05 元/百万 tokens,输入(缓存未命中)1.5 元/百万 tokens,输出 4.5 元/百万 tokens;高峰时段对应价格分别为 0.1 元、3 元和 9 元。值得注意的是,根据模型命名规则,此次内测版本将于9 月 10 日自动过期下线。
实测性能:最高输出速度超 500 tokens/s
社交平台 X 上已有开发者分享了初步测试数据。在多项基准测试中,该模型展现出惊人的推理速度,最高输出速率达到507 tokens/s。
在一项生成 SVG 鹈鹕骑自行车 2D 动画的 HTML 代码测试中,DeepSeek V4.1 Flash 的输出速度稳定在328 tokens/s。
另一位开发者复现了相同测试,生成的动画效果流畅,其透露平均输出速度超过300 tokens/s。
多位网友反馈,手动接入该模型后,能明显感受到其极快的响应速度。
DeepSeek 近期迭代频繁,新一轮更新周期开启
近期,DeepSeek 系列模型保持着高频次的更新节奏。7 月 31 日,DeepSeek V4 Flash 正式版 API 率先上线公测;8 月 13 日,DeepSeek V4 Pro 正式版 API 发布,同日 DeepSeek Harness 开发者预览版(v0.1)开源公测,并于 8 月 19 日迭代至 v0.1.0-rc.8 版本。随后在 8 月 21 日,DeepSeek V4 Flash Vision Exp 上线 API 平台,并于月底正式开源。
此次 DeepSeek V4.1 Flash 内测版的推出,标志着 DeepSeek 可能正在开启新一轮的模型技术迭代周期。

