
新模型正式发布,架构实现迭代升级
DeepSeek 推出 V4.1 Flash 大模型,该产品为全新架构系列中尺寸最小的 MoE 模型,总参数552B,采用Causal‑Encoder‑Decoder 非对称结构,输入激活参数 8B、输出激活参数 16B,原生支持多模态视觉理解能力。官方评测显示,新模型综合性能实现突破,多项指标超越前代旗舰 V4 Pro,同时官方 App、网页端已完成模型上线,同步开放开源权重与技术报告,面向开发者提供调用服务。
缓存技术突破,硬盘占用大幅下降 88%
本次模型最核心的技术亮点集中在 KV Cache 缓存优化。对比上一代产品,V4.1 Flash 将 SSD 硬盘缓存需求压缩至原来 1/8,即硬盘占用下降 88%,同时 HBM 显存需求降至前代四分之一。长文本、智能体 Agent 任务场景下,KV 缓存是硬件资源消耗的主要来源,通过缓存压缩技术,把部分记忆存储从高成本 GPU 硬件向硬盘转移,有效破解百万级长上下文任务硬件开销过高的行业痛点。
降本效应凸显,赋能 AI 产业落地应用
硬件资源消耗的大幅缩减直接带动调用成本下行,新模型同步下调 API 定价,保留峰谷差异化计费模式,闲时调用价格仅为高峰一半,降低企业与开发者使用门槛。长文本处理成本的下探,将利好文档解析、智能 Agent、知识库问答等应用场景,为国内大模型产业化落地、垂直行业 AI 规模化部署提供新的技术参考,也为未来产业大模型效率优化指明技术方向。
*转载图文,如有侵权请联系删除!

| 联系我们 | ||
| 序号 | 负责人职务 | 负责人及手机号 |
| 01 | 院长 | 罗四新 |
| 02 | 执行院长 | 范丛明 18820990700 |
| 03 | 研究部 分析师 | 吴旭森 13719254611 |
| 04 | 产业研究员 | 徐诺 13693909813 |
| 非诚勿扰,请根据实际需求咨询相关工作人员 | ||

