作者 | 博雯
编辑 | 赖捷
DeepSeek 官方正式发布 DeepSeek V4.1 Flash 模型,该模型具备原生多模态视觉理解能力,最新 API 已全面接入 WorkBuddy、CodeBuddy 和 OpenCode 等第三方 Agent 工具。
此前,DeepSeek 虽在 App 和网页端拥有识图功能,并于今年 8 月上线视觉模型 DeepSeek-v4-Flash-vision-exp,但受限于“外挂式”架构(即在纯文本底座上外接视觉编码器和对齐器),其识别效果并不理想,甚至出现将公司创始人误认为其他科技巨头的笑话。
本次 V4.1 Flash 的发布标志着技术架构的重大升级。
核心亮点:原生视觉与性能跃升
治愈“近视”,识别精准度大幅提升
DeepSeek V4.1 Flash 出厂即搭载原生视觉理解能力。实测显示,无论是复杂的梗图还是专业的数据图表,新模型均能准确识别与分析。
在面对 AI 产品周榜等复杂图表时,模型能精准分析各榜单涨幅冠军及关键数据,表现出强大的多模态解析力。
模式合并与体验优化
官方 App 与网页端原有的“快速、专家、识图”三个对话模式已合并为统一入口,简化了用户操作流程。不过需要注意的是,目前两端尚未全量接入 V4.1 Flash 模型,部分识图表现可能存在波动。
性能碾压 Pro 版本,速度费用双优
在基准测试中,V4.1 Flash 表现卓越。在软件工程(DeepSWE v1.1)、网络安全(CyberGym)及自动化任务(Automation-Bench)三项关键指标上,该模型得分最高,超越了 Kimi-k3、GLM-5.3、Opus 5 及 GPT-5.6 Sol 等竞品,仅在终端操作(Terminal-Bench)上略逊一筹。
官方宣布,鉴于 V4.1 Flash 在性能、成本及速度上全面超越 V4 Pro,自 9 月 14 日 12:00 起至 V4.1 Pro 上线前,所有指向 V4 Pro 的请求将自动路由至 V4.1 Flash,并按 Flash 的标准计费。这一“加量不加价”的策略,打破了以往"Flash 快但弱,Pro 慢但强”的命名惯例。
社区实测:前端设计能力比肩顶尖模型
海内外开发者迅速对 V4.1 Flash 进行了多维度实测,特别是在前端设计与代码生成领域,其表现令人惊艳。
创意交互与复杂场景生成
X 平台博主@Mia 通过生成 100 个 HTML 文件评估模型创造力,认为 V4.1 Flash 在前端设计效果上甚至优于 GPT-6 Astra。测试案例包括:
- 多米诺骨牌连锁反应互动网页;
- 点击触发雷电特效的雨夜场景;
- 可通过控制条调节艺术风格的故障风页面。
此外,在高难度的“鹈鹕骑车”SVG 绘图测试中,V4.1 Flash 不仅用时不到前代模型的一半,且在图像清晰度与结构合理性上均有显著进步。
全自动建模与高性价比
有博主利用 13 个 V4.1 Flash Beta Agent 协作,实现了从建模、脚本编写到渲染的全流程自动化,成功还原了 1:1 的地中海海岛场景,证明了其在复杂工程任务中的实用性。
尽管在部分极高难度的后端逻辑或特定交互功能上仍有提升空间,但对于绝大多数日常设计与开发任务,V4.1 Flash 凭借高速度、低成本和足够的性能,已成为极具竞争力的选择。
新基准测试:性能与成本的极致平衡
针对普通用户的真实需求,海外博主@OpenDesign 推出了 OpenDesign Arena 基准测试,涵盖 Web 应用、移动端 App 等五类生成任务。数据显示:
- 性能:V4.1 Flash 达到 GPT-6 Astra 的 98%;
- 成本:仅为 GPT-6 Astra 的 1.4%;
- 速度:平均响应时间 5.3 分钟,不足竞品的一半。
虽然在纯代码与后端能力上与顶级模型尚存细微差距,但 V4.1 Flash 在前端设计与性价比方面已确立明显优势。
结语
随着 V4.1 Flash 的发布,DeepSeek 不仅在技术参数上实现了突破,更在社区文化中引发了新的热议。从“治好近视”的梗图识别,到思维链中轻松幽默的表达风格,用户感受到了技术进步带来的直观体验提升。而在 V4.1 Pro 正式登场之前,这款“超级 Flash"模型无疑将成为开发者与创作者的高效利器。

