大数跨境

【龙头动态】DeepSeek新模型上线,长文本缓存硬盘占用暴降88%!

【龙头动态】DeepSeek新模型上线,长文本缓存硬盘占用暴降88%! 广东未来产业研究院
2026-09-10
1
导读:9月10日,DeepSeek正式发布DeepSeek V4.1 Flash,该模型采用全新架构,是一款552B参数的MoE模型,为DeepSeek全新模型架构系列中尺寸最小的成员,在性能上超越了包括D



9月10日,DeepSeek正式发布DeepSeek V4.1 Flash,该模型采用全新架构,是一款552B参数的MoE模型,为DeepSeek全新模型架构系列中尺寸最小的成员,在性能上超越了包括DeepSeek V4 Pro在内的一众旗舰模型。


新模型正式发布,架构实现迭代升级

DeepSeek 推出 V4.1 Flash 大模型,该产品为全新架构系列中尺寸最小的 MoE 模型,总参数552B,采用Causal‑Encoder‑Decoder 非对称结构,输入激活参数 8B、输出激活参数 16B,原生支持多模态视觉理解能力。官方评测显示,新模型综合性能实现突破,多项指标超越前代旗舰 V4 Pro,同时官方 App、网页端已完成模型上线,同步开放开源权重与技术报告,面向开发者提供调用服务

缓存技术突破,硬盘占用大幅下降 88%

本次模型最核心的技术亮点集中在 KV Cache 缓存优化。对比上一代产品,V4.1 Flash 将 SSD 硬盘缓存需求压缩至原来 1/8,即硬盘占用下降 88%,同时 HBM 显存需求降至前代四分之一。长文本、智能体 Agent 任务场景下,KV 缓存是硬件资源消耗的主要来源,通过缓存压缩技术,把部分记忆存储从高成本 GPU 硬件向硬盘转移,有效破解百万级长上下文任务硬件开销过高的行业痛点。

降本效应凸显,赋能 AI 产业落地应用

硬件资源消耗的大幅缩减直接带动调用成本下行,新模型同步下调 API 定价,保留峰谷差异化计费模式,闲时调用价格仅为高峰一半,降低企业与开发者使用门槛。长文本处理成本的下探,将利好文档解析、智能 Agent、知识库问答等应用场景,为国内大模型产业化落地、垂直行业 AI 规模化部署提供新的技术参考,也为未来产业大模型效率优化指明技术方向。

*转载图文,如有侵权请联系删除!

联系我们
序号 负责人职务 负责人及手机号
01 院长 罗四新
02 执行院长 范丛明 18820990700
03 研究部 分析师‍‍ 吴旭森 13719254611
04 产业研究员 徐诺 13693909813
非诚勿扰,请根据实际需求咨询相关工作人员 

【声明】内容源于网络
0
0
广东未来产业研究院
广东未来产业研究院,以服务粤港澳大湾区重大战略目标。聚焦类脑智能、量子信息、人工智能、区块链、基因技术、未来网络、深海空天开发、氢能与储能等前沿科技和产业变革领域的相关科学技术研究。
内容 1684
粉丝 0
广东未来产业研究院 广东未来产业研究院,以服务粤港澳大湾区重大战略目标。聚焦类脑智能、量子信息、人工智能、区块链、基因技术、未来网络、深海空天开发、氢能与储能等前沿科技和产业变革领域的相关科学技术研究。
总阅读8.1k
粉丝0
内容1.7k