大数跨境

DeepSeek发新模型,对HBM需求降至原来1/4

DeepSeek发新模型,对HBM需求降至原来1/4 观网财经
2026-09-10
3
导读:9月10日,DeepSeek正式发布新模型DeepSeek V4.1 Flash。

(文/赖家琪 编辑/吕栋)

9 月 10 日,DeepSeek 正式发布新模型 DeepSeek V4.1 Flash。测试结果显示,这款定位为"Flash"的模型在智能度、速度及效率上均显著提升,不仅降低了对高带宽内存(HBM)的需求,更在多项基准测试中超越了此前的旗舰模型 V4 Pro。

架构革新:更小参数,更强性能

V4.1 Flash 是 DeepSeek 全新模型系列中尺寸最小的成员,拥有 5520 亿参数的 MoE(混合专家)结构,并原生支持多模态视觉理解能力。

该模型采用了全新的 Causal-Encoder-Decoder(因果编码器 - 解码器)架构,输入输出采用不对称设计:输入激活参数量仅为 80 亿,输出则为 160 亿。结合新的预训练方法与大规模强化学习,V4.1 Flash 在性能、费用、响应速度及总耗时等维度全面优于 V4 Pro。

资源优化:大幅压缩 KV Cache 成本

新一代大模型显著压缩了键值缓存(KV Cache)规模。作为处理长上下文和连续任务的关键机制,KV Cache 以往会大量占用显存与存储资源。优化后,V4.1 Flash 对 HBM 的需求降至前代的 1/4,对固态硬盘(SSD)的需求更是降至 1/8。

这一突破对智能体(Agent)场景意义重大。在 AI Agent 执行复杂连续任务时,缓存命中成本占比极高。KV Cache 的压缩不仅降低了硬件资源占用,更直接削减了 Agent 类任务的使用成本。

产品迭代:V4 Pro 有序退场,全线接入新模型

伴随模型上线,DeepSeek 同步调整产品线。V4.1 Flash 已接入 DeepSeek API 并原生支持多模态能力。开发者只需将调用名称改为"deepseek-flash"即可使用。旧模型"V4 Flash"和"V4 Flash Vision Exp"已下线,但出于兼容考虑,原调用名称暂时会自动路由至 V4.1 Flash。

鉴于 V4.1 Flash 在各项指标上已全面超越 V4 Pro,DeepSeek 计划有序让后者退场。北京时间 9 月 14 日 12 时至 V4.1 Pro 上线前,所有访问"deepseek-v4-pro"的请求将自动路由至 V4.1 Flash,并按新模型价格计费。

除 API 服务外,腾讯 WorkBuddy、CodeBuddy 及 OpenCode 等官方合作伙伴的编程工具也已全量接入该模型。

定价策略:降价上新,延续峰谷机制

受益于架构调整带来的成本优势,DeepSeek 同步下调了 V4.1 Flash 的价格。新价格已于 9 月 10 日 12 时生效。此外,该模型将继续沿用峰谷定价机制,闲时价格为高峰时段的一半,鼓励用户错峰执行任务以降低开支。

【声明】内容源于网络
0
0
观网财经
各类跨境出海行业相关资讯
内容 5845
粉丝 0
观网财经 各类跨境出海行业相关资讯
总阅读102.9k
粉丝0
内容5.8k