DeepSeek V4.1 Flash 开启中间版本内测:新架构加持,原生多模态更优
9 月 8 日,DeepSeek 官方宣布启动 DeepSeek V4.1 Flash 中间版本内测。该模型采用全新架构,支持原生多模态处理,在提升性能与速度的同时,进一步降低了使用成本。
调用方式说明
本次内测调用流程简便,开发者只需保持 base_url 不变,将模型名称修改为以下标识即可:
当前计费标准与 deepseek-v4-flash 一致,单账号并发限制为 20。模型名称中的"expires-on-0910"明确标示了其为限时预览版本(有效期至 9 月 10 日),旨在供开发者低成本尝鲜并收集反馈,以便优化正式版本。
核心升级亮点
原生多模态能力补齐短板
多模态处理曾是 DeepSeek 的相对弱项。此前推出的实验性视觉模型 V4-Flash-Vision-Exp 虽已支持图片输入及图表分析,但 V4.1 Flash 实现了质的飞跃。其“原生多模态”特性意味着视觉与文本在单一模型架构内进行一体化处理,摒弃了外挂视觉编码器的补丁式方案,标志着 DeepSeek 正式迈向原生统一架构。
新架构驱动提速降本
官方强调的新模型结构显著提升了推理效率。实测反馈显示,该 Flash 版本处理速度极快,模式更高效。结合此前 API 定价策略调整的背景,此次“成本更低”的信号表明,新架构带来的效率红利正直接转化为开发者的成本优势。
产品迭代节奏全面加速
| 时间 | 关键事件 |
|---|---|
| 7 月底 | DeepSeek-V4-Flash 正式版 API 上线公测,Agent 能力大幅增强 |
| 8 月 13 日 | DeepSeek Harness v0.1(DSH)开发者预览版开源,GitHub 24 小时获超 7 万 star |
| 8 月 21 日 | V4-Flash-Vision-Exp 多模态视觉模型上线 API |
| 9 月 8 日 | V4.1 Flash 中间版本内测:新结构 + 原生多模态 |
从 Agent 强化、开源生态建设到多模态补课及新结构内测,DeepSeek 的产品迭代密度显著提升,V4.1 Flash 正是这一快速演进路线上的最新成果。
开发者建议
deepseek-v4.1-flash-expires-on-0910,无需调整其他配置,计费规则保持不变;
参考资料:
- 澎湃新闻:原生多模态支持!DeepSeek V4.1-Flash 内测
- IT之家/凤凰科技:DeepSeek V4.1 Flash 内测采用新结构
- 财联社·科创板日报:DeepSeek V4.1 Flash 开启中间版本内测
本文基于公开资料整理,具体调用与计费信息以 DeepSeek 官方通知为准。

