大数跨境

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash AI智能创作写作
2026-09-11
7
导读:2026年9月10日,DeepSeek 正式发布 V4.1 Flash 版本。

2026 年 9 月 10 日,DeepSeek 正式发布 V4.1 Flash 版本。新版模型在运算性能、响应速度及成本控制上实现全面迭代,同步推出 DeepSeek Harness v0.1.5 框架,并宣布 V4-Pro 版本即将停止服务

一、V4.1 Flash 核心参数与能力

模型架构:采用全新 CED 混合专家架构,总参数量达 552B。Prefill 阶段激活 8B 参数,Decode 阶段激活 16B 参数,专为各类 Agent 长对话业务场景优化。

核心能力:原生支持多模态交互,最大上下文长度延伸至 1M token。通过优化 KV 缓存机制,运行时显存占用降至前代的 1/4,硬盘存储占用降至 1/8,显著降低长对话及持续 Agent 任务的缓存成本。

调用标识:官方 API 调用名称为deepseek-flash。旧版 V4 Flash 及 V4 Flash Vision Exp 已全面下线,原有旧接口将临时兼容并路由至 V4.1 Flash。

性能表现:多项权威基准测试成绩优于 V4-Pro,其中 GPQA Diamond 评分达 90.9,Codeforces Rating 评分高达 3471,在 Agent 场景专项能力上表现突出。

二、V4-Pro 版本下线规则

生效时间:北京时间 2026 年 9 月 14 日 12:00。

届时,所有deepseek-v4-pro接口请求将自动路由至 V4.1 Flash,并统一按照 V4.1 Flash 的计费标准结算。该规则将持续执行至 V4.1 Pro 版本上线。

三、V4.1 Flash 计费标准

空闲时段:缓存命中输入 0.02 元/百万 token,未命中输入 1 元/百万 token,输出 4 元/百万 token。

高峰时段:工作日 9:00-12:00 及 14:00-18:00,全部计费价格翻倍。

备注:周末及法定节假日统一按空闲时段计费标准执行。

四、DeepSeek Harness v0.1.5 框架更新

新版本全面适配 V4.1 Flash 模型,针对标准接口调用、PTC 程序化工具调用及极简运行模式完成专项优化。

支持在保留 KV 缓存的前提下更新系统提示词,无需重复执行 Prefill 预热流程,有效降低长对话业务的调用成本。

Web 端功能升级,新增 PDF 与图片上传预览及工作区文件树浏览功能;扩展插件侧边栏入口,进一步提升子 Agent 协同处理能力。

五、开发者迁移适配建议

短期适配:原有 V4-Pro 接口将自动切换至新模型且计费标准变更,建议提前开展业务兼容性测试,保障系统稳定运行。

长期适配:建议将业务代码统一替换为deepseek-flash专属调用接口,以规避后续路由策略调整带来的潜在风险。

Agent 业务优化:升级 Harness 框架并依托新版 KV 缓存压缩能力,可显著降低长周期智能任务的运营成本。

【声明】内容源于网络
0
0
AI智能创作写作
1234
内容 509
粉丝 1
AI智能创作写作 1234
总阅读41.7k
粉丝1
内容509