DeepSeek-V4.1-Flash 正式上线千问 AI 平台,相关 API 服务与 Token Plan 同步开放。开发者既可通过 API 将模型能力接入业务系统,也可在 Qoder、千问 APP、Codex 等工具中直接调用。
模型核心特性:多模态支持与极致降本
DeepSeek-V4.1-Flash 是 DeepSeek 最新推出的多模态大模型,兼顾推理性能、速度与成本。该模型原生支持文本与图像理解,具备 100 万 Token 超长上下文窗口,广泛适用于代码开发、长文档处理、视觉分析及智能体任务。
得益于新一代缓存压缩技术,其 HBM 需求降至上一代模型的 1/4,SSD 存储需求降至 1/8,显著降低了资源门槛,更适合长上下文处理与高频调用场景。
开源协同与高效部署
本次模型上线得益于 vLLM 开源社区的协同支持。基于 vLLM 的快速适配能力,阿里云已完成模型部署并开放服务,大幅简化了开发者的调用流程。未来,阿里云将继续深化与开源社区的合作,推动更多开源模型的高效落地与应用。

