大数跨境

DeepSeek-V4.1-Flash也太快太强了吧

DeepSeek-V4.1-Flash也太快太强了吧 萝卜AI笔记
2026-09-13
9

大家好,我是萝卜哥~

前天晚上刷推的时候,看到 DeepSeek 官方发了条消息说 V4.1 Flash 正式上线了。说实话当时没太当回事,因为这两个月模型更新太密集了,多到有点麻了。

但后来顺手打开试了几下,直接给我整不会了。

怎么说呢,这速度快到有一种「我话还没说完,它已经写了三屏」的感觉。

01先说说这东西到底是啥参数、速度、价格一次看懂

V4.1 Flash 是 DeepSeek 最新发布的模型,9 月 10 号正式上线

总参数 552B,用的是混合专家架构(MoE),但实际跑的时候输入只激活 8B 参数,输出激活 16B 参数

你可以理解为

一个巨大的团队里,只派最合适的几个人上场干活。效率拉满的同时,成本压到了地板。
Image
SPEED速度快到夸张

最让我吃惊的是速度。

社区测试下来大概是 每秒 400 到 427 个 token 的输出速度,长文本推理场景下能跑到 420 tokens/s

这是什么概念呢?

我拿它生成一段两千字的文章,眨两下眼的工夫就刷完了。


CONTEXT上下文窗口直接拉满

上下文窗口直接拉到了 100 万 token,最大输出 38.4 万 token

也就是说,你可以把一整本书丢进去,它能消化完,还能给你写一篇几万字的分析。

适合场景:长文档总结、代码生成、网页应用原型、批量内容生产、结构化分析,都很适合用 V4.1 Flash 来做第一轮快速产出。


PRICE价格也很狠

当然,也是降价了。

V4.1 Flash 非高峰时段的价格,输入缓存命中的情况下是 每百万 token 0.003 美元,输出是 每百万 token 0.6 美元

Image

假如你要处理一个十万字的文档,然后让模型写一万字的总结,用 Claude Opus 5 大概花几块钱,用 V4.1 Flash 可能几分钱就搞定了。

梁圣正式回归。


02跑分上直接跟旗舰打但也有明显短板

DeepSeek 官方很自信。

9 月 14 号开始,所有发往 V4 Pro 的 API 请求会自动转到 V4.1 Flash 上处理,计费也按 Flash 的价格来。

这说明 DeepSeek 自己都认为 Flash 已经全面超越了 Pro,没有必要让用户继续为 Pro 付更高的价格了。

这种「自己革自己命」的做法,在商业上是比较少见的。

对开发者来说当然是好消息:

不用改代码,模型自动升级,费用还降了。

BENCHMARK好几个榜单直接赢旗舰

在一些第三方评测里,它跟 GPT-5.6 Sol 和 Claude Opus 5 这种顶级旗舰直接正面对决,而且好几个榜单上赢了。

软件工程能力

在 DeepSWE v1.1(软件工程能力评测)上:

V4.1 Flash:74.2

Claude Opus 5:74.0

GPT-5.6 Sol:73.0

Flash 一个「闪电侠」定位的模型,居然在写代码这件事上压了两个旗舰一头。

自动化任务能力

AutomationBench 上差距更大:

V4.1 Flash:54.8

Claude Opus 5:50.3

GPT-5.6 Sol:45.8

这个测的是模型做自动化任务的能力,说白了就是让 AI 帮你干活的综合水平。

网络安全与编程竞赛

CyberGym 网络安全评测:

V4.1 Flash:88.1

GPT-5.6 Sol:84.5

Codeforces 编程竞赛评分达到了 3471,比 V4 Pro 的 3348 又涨了一截。

Image

LIMIT公道话也要说

当然也要说公道话。

在长时间自主任务(Terminal-Bench 3.0 和 4.0)上,Claude Opus 5 还是明显领先的。

在知识密集型测试(HLE)上:

Claude Opus 5:56.3

V4.1 Flash:36.8

差距不小。

所以这个模型的强项非常突出,短板也确实明显。

跑分总结

短平快的任务,V4.1 Flash 特别猛;但拉长战线的复杂任务,它还是比不上海外旗舰大模型。


03好了,说点好玩的真实案例才是重点

跑分终究是跑分,大家最关心的还是实际用起来到底怎么样。

下面这几个案例我都附上了完整的 Prompt,你可以直接复制到 DeepSeek 里跑,亲眼看看效果。


CASE013D 城市

先来一个简单的。

Plain Text

帮我生成一个南京市3DHTML页面,可以全面的展示南京市的全貌,可以进行模式切换,可以拖动旋转等等,页面渲染要丝滑,整体排版要美观,配色要优美

说实话这个效果有点牛啊。

最厉害的是点一下就能看到对应的地标大厦名称,当然我也不知道准确不,看名字应该差不多,哈哈哈。


进阶测试上海弄堂 3D 模型

再来生成一个上海弄堂的 3D 模型。

Plain Text

使用 Three.js 建构一个可完全探索的上海老城区街巷。必须是真正的 3D 模型,但每帧画面在视觉上应类似于精心绘制的手绘动画背景。
打造蜿蜒的弄堂小巷、石库门建筑群(红砖外墙搭配拱形门头)、沿街晾晒着被单和衣服的竹竿、斑驳的老虎窗、堆满杂物的公房阳台、梧桐树遮蔽的人行道、停放拥挤的电瓶车和自行车、街角的烟杂店和早餐铺(蒸笼冒着热气)、老式绿色邮筒、头顶纵横交错的电线、地面的窨井盖和积水反光、远处浦东天际线的摩天楼轮廓若隐若现。避免明显重复的素材。
实现一致的卡通渲染色带、可控的深色轮廓线、大气透视、温暖的午后晚霞、飘动的梧桐落叶以及细腻的环境动画(蒸笼的蒸汽缓缓升腾、晾晒的床单微微摆动、远处高架上偶尔驶过的车流光影)。当镜头在环境中自由移动(而非仅限于单一主角视角)时,效果必须依然令人信服。

这个效果我觉得真的很不错了。

虽然不知道上海的弄堂是不是都是这么红哈,但是如果忽略这个细节,整体很优秀。


复现 Reddit 爆火案例自由建造城市地图

最后再来复现一个 Reddit 上非常火的案例

一句话生成一个可以自己随意建造建筑的城市地图。

Image

因为这个感觉要用到 Agent 能力,所以我选择了 WorkBuddy,还是海外版的。

因为现在目前 DeepSeek V4.1 Flash 完全免费,哈哈哈。

Image

直接来看效果,真的很惊艳很好玩。

Image

我们可以一点点按照自己的想法来创建城市,还是非常有成就感的。


CASE02一句话生成游戏
3D 赛车游戏

这个案例直接把我看傻了。

一个 Prompt 扔进去,它在几分钟之内就给你生成一个能跑的 3D 赛车游戏。

Prompt 直接使用下面这个就好。

Plain Text

请用纯HTML + CSS + JavaScript写一个3D赛车游戏,要求:
使用Canvas或CSS 3D实现赛道的透视效果,赛道要有弯道和起伏
玩家用键盘方向键控制赛车的左右移动和加减速
赛道上随机生成障碍物和加速道具
有速度仪表盘、当前排名、圈数计时
碰到障碍物减速,碰到道具加速,有简单的碰撞反馈动画
整体视觉风格参考马里奥赛车,色彩鲜艳,有卡通感
请在一个HTML文件内完成所有代码。

跑出来的结果让我挺意外的。

赛道能渲染出来,车能操控,撞到东西还有碰撞反馈。

当然画面精细度跟真正的游戏没法比,但一个 Flash 模型几分钟搞定一个能玩的赛车游戏,这件事本身就很离谱了。


2D 热血街头

这个 Prompt 覆盖了角色动画、敌人 AI、combo 连击、粒子特效、波次系统、BOSS 战、音效合成这些维度,跑出来的效果应该相当能打。

Plain Text

用纯 HTML+CSS+JS(单个文件,不依赖任何外部资源)做一个热血风格的 2D 横版快打小游戏。要求如下:
角色与画面:用 Canvas 绘制所有内容。主角是一个像素风格的格斗家,有站立、行走、出拳、飞踢、受伤五种动画帧。敌人至少两种类型,一种是近战小兵(红色系),一种是远程投掷飞刀的精英怪(紫色系)。背景是一条夜晚的霓虹街道,有路灯、垃圾桶、涂鸦墙等场景元素,背景随角色移动缓慢卷轴滚动产生纵深感。
操作方式:方向键移动(上下左右四方向),J 键普通拳,K 键飞踢(伤害更高但有 0.8 秒冷却),空格键跳跃。支持连按 J 键触发三连击 combo,第三击有击飞效果把敌人打出屏幕。移动时角色有朝向翻转。
战斗系统:主角生命值 100,小兵攻击扣 5,飞刀扣 8。小兵生命值 30,精英怪 60。命中时产生"打击火花"粒子特效和屏幕微震(shake)。敌人被击败后掉落金币,金币自动吸附到主角身上。每击败 10 个敌人出现一个 BOSS(体型比普通敌人大 1.5 倍,血量 200,攻击扣 15),BOSS 有冲撞和砸地两种攻击模式。
界面:左上角显示主角血条(红色渐变)和分数。右上角显示当前波次 "WAVE X"。主角死亡后显示 Game Over 画面,附带最终得分和"再来一局"按钮。游戏开始前有一个标题画面,写"街头怒火 STREET FURY",按任意键开始。
波次设计:第一波 3 个小兵,第二波 5 个小兵 + 1 个精英怪,第三波出 BOSS,之后循环递增难度(敌人数量增多、移动速度加快)。每波敌人从屏幕右侧分批走入。
额外细节:角色跳起时有重力抛物线,落地产生小型灰尘粒子。打击音效用 Web Audio API 合成(不需要音频文件),拳头命中是短促的低频噪声脉冲,飞踢命中是更响亮的中频音。整体色调偏暗但霓虹灯光照亮局部区域,营造90年代街机厅的热血氛围。

我体验了一下,感觉挺不错的。

毕竟是纯网页游戏,除了人物出拳有点奇怪之外,其他感觉没毛病。


CASE03Trello 看板从零搭建

这种前端交互复杂的项目,以前扔给模型基本都要来回改好几轮。

V4.1 Flash 一把过。

Plain Text

用HTML + CSS + JavaScript实现一个Trello风格的任务看板应用,功能要求:
默认三个列表:待办、进行中、已完成
可以新增和删除列表,可以编辑列表标题
每个列表内可以添加卡片,卡片支持编辑标题和描述
卡片可以在列表内上下拖拽排序,也可以跨列表拖拽
用原生drag and drop API实现,不依赖第三方库
界面简洁美观,配色参考Trello的蓝白风格
数据存在localStorage里,刷新不丢失
所有代码放在一个HTML文件里。

测试结果是:

列表和卡片的增删改查全部正常

拖拽排序很流畅

跨列表拖拽也能跑通

localStorage 刷新后不丢失

这个项目光是拖拽的交互逻辑就挺复杂的,它能一次性写对,确实有点东西。


CASE04拍立得相机,2 分钟交货

这个 Prompt 短,但考验的是模型对空间关系和光影效果的理解。

Plain Text

用HTML + CSS + JavaScript创建一个交互式拍立得相机组件。要求:
相机外观逼真,有镜头、取景器、快门按钮、闪光灯、出片口
点击快门按钮时有按压动画和闪光灯效果
拍照后从底部缓缓吐出一张拍立得照片,照片上显示随机风景或渐变色彩
照片有逐渐显影的动画效果,从白色慢慢显现画面
整体有立体感,用CSS阴影和渐变模拟光照
一个HTML文件搞定。

2 分钟之内就出来了。

组件之间的空间关系建模准确,光影效果也做得有模有样。

点一下快门,闪光灯亮一下,照片从底下慢慢吐出来,还有显影效果。

说实话,比我预期好不少。

Image

但是这样生成的还是差点意思。

来简单优化一下,带着电脑摄像头和简单编辑器,立刻不一样了。

Image

请忽略我衣衫不整就出镜哈,根本来不及解释。


CASE05科幻飞船驾驶舱,居然有层次感

这个我要重点说一下,因为它体现了 V4.1 Flash 在视觉设计理解上的进步。

Plain Text

用HTML + CSS + JavaScript创建一个科幻飞船驾驶舱HUD界面。要求:
深色背景,霓虹蓝绿配色,赛博朋克风格
中央区域是前方太空视野,有缓慢移动的星星粒子效果
左侧面板:飞船状态仪表盘,包括能量、护盾、引擎温度,用环形进度条展示,数值实时跳动
右侧面板:雷达扫描界面,有一条扫描线在360度旋转,随机出现敌方目标红点
底部面板:通信频道状态和导航坐标,文字有打字机滚动效果
不同面板的动画速度要有差异,制造出"各个系统独立运行"的真实感
整体有轻微的CRT扫描线和噪点效果
一个HTML文件。

跑出来之后我愣了一下。

仪表盘在缓慢转动,雷达在扫描,旁边的状态面板又是另一套刷新频率,底部通信文字在一行一行地打出来。

整个画面看起来真的像那么回事,有一种你坐在驾驶舱里的沉浸感。

关键是这个 Prompt 信息量很大,要同时处理粒子效果、动画节奏差异化、CRT 滤镜好几个维度的东西,它都兼顾到了。

它不只是把元素堆到页面上,而是能理解「不同系统独立运行」这种抽象设计要求,并用不同动画节奏表现出来。


CASE06纯代码画一幅动态水墨山水

前面几个案例证明了它能写功能,这个案例专门测审美。

Linux DO 上有人说 V4.1 Flash 的「审美水平提升了一大截」,我就想看看到底提升到什么程度了。

Plain Text

用纯HTML + CSS + JavaScript创建一幅动态中国水墨山水画,不使用任何图片素材,所有视觉效果全部用代码实现。要求:
背景是宣纸质感,带微微泛黄的底色和细腻的纤维纹理(用CSS噪点或渐变模拟)
远景:淡墨晕染的连绵山脉,有浓淡虚实的变化,用多层半透明SVG路径叠加实现
中景:一棵苍劲的松树立在山石上,枝干用贝塞尔曲线绘制,松针用随机散布的短线条实现
近景:一叶扁舟在水面缓缓漂移,水面有淡淡的波纹涟漪动画
天空区域偶尔有一两只飞鸟掠过,用简笔画风格的"人"字形表现
整个画面有缓慢的墨色晕开动画,像墨汁在宣纸上自然渗透扩散的效果
画面右上角竖排落款文字"山静似太古",用衬线字体模拟毛笔字效果
整体色调控制在黑白灰加一点赭石色点缀,严格遵循传统水墨画的配色克制感
一个HTML文件完成。

这个 Prompt 的难点在于,

画出来只是及格线,画得好看才是真正的实力。

水墨画最讲究的就是留白和浓淡虚实的分寸,这些全是审美判断,代码只是手段。

V4.1 Flash 跑出来的效果让我挺意外的。

宣纸底色有纹理感

远山层次确实有浓淡变化

水面波纹也很克制

没有做得太花哨

整体留白意识不错

当然跟真正的水墨画没法比,但作为一个 AI 用代码「画」出来的东西,它的配色分寸感和留白意识已经超出了我对 Flash 级别模型的预期。

GitHub 上有个专门的 DeepSeek v4 Flash HTML 作品集,收录了 100 个纯代码视觉作品,从极光到万花筒到粒子网络都有,有兴趣的可以去翻翻看。


对比测试K3 和 GLM-5.3 Flash

我也分别对比了 K3 和 GLM-5.3 Flash。

K3 效果,感觉有点没有抓到水墨画的神。

Image

GLM-5.3 Flash 的效果,个人感觉比 K3 要好一些,但是整体还是不如 V4.1 Flash。

Image

CASE07一句话生成完整 PPT

前端玩够了,来点办公场景的。

我让 V4.1 Flash 直接生成一套完整的 PPT,主题是:

「2026 年 AI 行业趋势分析」

不光要有封面和目录,中间还得插柱状图和饼图,最后来一页总结,整套商务风格。

JSON

生成一份完整的PPT HTML,带有PPT文件下载功能,主题是"2026年AI行业趋势分析报告"。具体要求:
封面页:大标题居中,下方写副标题"行业洞察与机会分析",再下方写日期和作者"AI研究院",背景用深蓝渐变色
目录页:列出4个章节标题,用编号排列
第一章"市场规模":左边放一段分析文字(3-4句话,包含具体数字),右边插入一个柱状图,展示2022-2026年全球AI市场规模增长(数据你自己合理编造)
第二章"技术趋势":用SmartArt风格的布局展示5个技术趋势关键词,每个关键词下面带一句话解释
第三章"竞争格局":插入一个饼图,展示主要AI公司的市场份额(OpenAIGoogle、Anthropic、Meta、其他),数据合理编造
第四章"投资建议":用3个并排的色块展示3条核心建议,每个色块带标题和2-3句说明
总结页:3个要点总结,下方放"谢谢观看"和联系方式
每页都要有页码,整体配色统一用深蓝+白色+亮橙色点缀。字体大小层次分明,标题、正文、注释要有区分。

跑完之后我把生成的代码执行了一下,打开 PPT 的时候有点惊到。

封面页的布局很规整,柱状图和饼图都成功渲染出来了,配色确实统一。

当然细节上还需要手工微调,比如字体间距、图表标签位置这些,但作为一个初稿来说完成度相当高了。

然后可以接着说改成其他风格,比如仙侠风。

感觉人物稍微有点弱,其他还是很靠谱的。


CASE08原生多模态,看图也能整

V4.1 Flash 还有一个大升级,就是原生多模态。

以前 DeepSeek 的视觉能力是通过单独的 Vision 模型实现的,等于是拼装的。

现在 V4.1 Flash 从训练阶段就把视觉编码器集成进去了,文字和图像在同一个语义空间里处理。

也就是说,你给它一张图,它理解图片内容和理解文字一样自然。

看图和理解文字这两件事是同时发生的,不需要中间再「翻译」一道。


你可以这样试试
(上传一张你手边任意物品的照片)
请用极其细致的观察力描述这张图片。不要泛泛而谈,要像一个侦探一样注意所有细节:物品的材质、磨损程度、光线方向、背景中的环境线索。然后根据这些细节推测一下拍摄者可能是在什么场景下拍的这张照片。

它的描述细致程度和推理能力,会让你觉得有点不可思议。

Image

基本上完全还原了图片的细节,每个角落都照顾到了。

Image

04写在最后快,不等于万能

从跑分数据也能看出来,V4.1 Flash 在那种短平快、讲究效率的场景里特别能打。

但遇到需要长时间自主运行的复杂任务,或者知识密度特别高的分析,旗舰模型还是更稳。

它更像一个反应极快的特种兵:突击任务交给它效率惊人,但让它一个人去打一场持久战,可能还差点意思。

V4.1 Flash 最适合快速生成、快速试错、快速搭建原型。它很强,但不是所有任务都应该交给它。真正重要的是:你要知道什么任务适合用它,什么任务应该交给更稳的旗舰模型。

工具再快再强,最后做决策的还是你自己。

选哪个模型,用在哪个场景,这个判断本身就是能力。

先用起来再说。

好不好,试了才知道。


以上就是今天的分享,觉得有帮助,帮请帮一键三连:点赞、转发,再看留言,你的反馈对我很重要!


【声明】内容源于网络
0
0
萝卜AI笔记
做有温度的AI人
内容 187
粉丝 1
萝卜AI笔记 做有温度的AI人
总阅读12.1k
粉丝1
内容187