DeepSeek 内测新模型:Flash 版挑战 Pro 性能
DeepSeek 未在官网或开发者平台公开宣传,而是通过官方交流群悄然发布了一款名为deepseek-v4.1-flash-expires-on-0910的内测模型。该模型名称明确标注有效期至 9 月 10 日,届时将自动下线。
在随内测发布的反馈问卷中,DeepSeek 直接向用户抛出核心问题:「你觉得这个模型能全面替换线上的 DeepSeek V4 Pro 么?」
DeepSeek V4 Pro 作为当前参数规模达 1.6 万亿的旗舰模型,其价格是 Flash 系列的三倍。此次推出的 Flash 内测版,显然意在以低成本挑战高端模型的性能边界。
实测表现:从 SVG 绘图到复杂游戏开发
测试通过保持 API 端口不变,仅切换模型名为deepseek-v4.1-flash-expires-on-0910进行调用。测试环境基于 Claude Code Agent Harness。
基础能力测试:鹈鹕骑车 SVG
采用经典的「鹈鹕骑车」提示词进行测试。DeepSeek V4.1 Flash 耗时 2 分钟生成 SVG 图像。结果显示,鹈鹕喉囊、自行车车架及辐条结构准确,虽与顶级模型存在差距,但作为 Flash 版本表现合格。
进阶能力测试:可交互 3D 动画
提升难度,要求生成可旋转缩放的浏览器端 3D 动画。模型耗时 12 分钟交付了包含 6 个源文件的 Three.js 项目。尽管存在车把手缺失、鹈鹕腿部结构怪异等瑕疵,但整体动画运行流畅。
压力测试:复刻「我的世界」
在极高难度的测试中,要求单条提示词生成具备地形生成、方块交互、第一人称控制及生存循环的 voxel 游戏。模型耗时 52 分钟,交付了 7550 行代码的完整项目。
代码质量令人惊喜:模型不仅自行编写了 53 个 Node.js 单元测试和 38 个浏览器集成测试且全部通过,还主动执行代码审查,修复了 15 个 Bug 并补充了回归测试。相比之下,更高难度的「怪兽城市大战」任务因超时两小时未产出结果而终止。
性能与成本分析
DeepSeek V4.1 Flash 输出速度显著,含思考时间在内可达 300 tokens/秒。
成本方面,累计消耗 1.56 亿 tokens(含未完成测试),经历 825 次 API 调用,总费用仅为 1.93 美元(约 13 元人民币)。极高的性价比使其在大规模任务中极具竞争力。
Flash 系列全线降价
同日,DeepSeek 宣布 Flash 系列模型价格调整,于 9 月 10 日中午 12 点生效。缓存命中价格由 0.05 元降至 0.02 元,降幅达 60%;空闲时段输入价格由 1.5 元降至 1 元,输出由 4.5 元降至 4 元。鉴于缓存命中在实际消耗中占比最大,此次调价将进一步降低用户使用成本。
Claude Code 接入指南
DeepSeek 模型兼容 Anthropic 接口,接入 Claude Code 只需配置以下环境变量:
export ANTHROPIC_BASE_URL=https://api.deepseek.com/anthropic
export ANTHROPIC_API_KEY=你的 API Key
export ANTHROPIC_MODEL=deepseek-v4.1-flash-expires-on-0910
如需扩大上下文窗口,可手动设置CLAUDE_CODE_MAX_CONTEXT_TOKENS=1000000。配置完成后,可通过询问模型身份验证是否切换成功。请注意,该内测版本将于 9 月 10 日到期,体验需抓紧。
综上所述,DeepSeek V4.1 Flash 在性价比维度已具备替代 Pro 版本的潜力,适合对成本敏感且需要高强度推理的应用场景。

