DeepSeek V4.1 Flash 内测正式开启,采用新架构并原生支持多模态,输出速度高达 500 tokens/s。该版本命名为"expires-on-0910",有效期至 9 月 10 日。
DeepSeek V4.1 Flash 内测开启:新架构与原生多模态
DeepSeek 于今日下午在官方交流群宣布,DeepSeek V4.1 Flash 中间版本正式开启内测。此次更新并非简单的参数调整,而是采用了全新的模型结构,并原生支持多模态能力。官方将其定位为“能力更强、速度更快、成本更低”的新一代模型。
API 调用与限时体验
目前开发者已可通过 API 抢先体验。调用时无需修改base_url,仅需将模型名称更改为deepseek-v4.1-flash-expires-on-0910即可。当前计费标准与 DeepSeek V4 Flash 保持一致,单账号并发限制为 20。
值得注意的是,模型名称中的"expires-on-0910"明确标示了其生命周期:该中间测试版本将于 9 月 10 日过期,实际体验窗口仅剩数天。
定位猜想:意在覆盖 Pro 版能力
在内测反馈问卷中,DeepSeek 特别询问用户:"DeepSeek V4.1 Flash 中间版本能否全面替换线上的 DeepSeek V4 Pro?”这一提问暗示了该版本的战略意图:它可能不只是追求极致速度与低成本的 Flash 版本,更试图在能力上逼近甚至覆盖 Pro 模型。
实测性能与更新节奏
据社交平台开发者实测反馈,部分案例输出速度超过 500 tokens/s,多数案例维持在 300 tokens/s 以上,但这仅代表早期测试结果,非官方基准数据。
回顾近期动态,DeepSeek 的产品迭代明显加速:7 月 31 日上线 V4 Flash 正式版,8 月 13 日发布 V4 Pro,8 月 21 日推出支持图片输入的 V4 Flash Vision Exp。不到一个月后,V4.1 Flash 便已开始测试新架构与原生多模态。由此可见,V4.1 Flash 极可能是一个“过渡版本”,其背后这套新架构最终如何融入正式产品线,更值得期待。
本文来自公众号:运营派 AI Lab 作者:老曹

