大数跨境

中国大模型「再现盛夏三连击」——DeepSeek V4 Flash、MiniMax H3、Seedance2.5上新 我们慢慢需要习惯领先

中国大模型「再现盛夏三连击」——DeepSeek V4 Flash、MiniMax H3、Seedance2.5上新 我们慢慢需要习惯领先 吴嘉阳跨境电商营销研究者
2026-08-02
9
导读:2026年7月31日,一个普通的工作日。但如果你同时打开DeepSeek的更新日志、MiniMax的官网公

2026 年 7 月 31 日,一个普通的工作日。但如果你同时打开 DeepSeek 的更新日志、MiniMax 的官网公告和字节跳动的产品发布页,会发现一个惊人的巧合:三家中国 AI 公司,在同一天,放出了各自的重磅更新。

DeepSeek V4 Flash:2840 亿参数,但“只激活了 130 亿”

先看第一击。

DeepSeek V4 Flash 正式版上线公测。从参数来看,这不算一个“大模型”——总参数 2840 亿,但每次调用只激活 130 亿参数。在动辄万亿参数起步的军备竞赛里,这个数字小得几乎像个“迷你版”。

但就是这个“迷你版”,在第三方的成绩单上交出了让人意外的表现。

Artificial Analysis 智能指数50 分,仅比 OpenAI 的 GPT-5.6 Luna(51 分)低 1 分。Arena.ai 前端代码竞技场1586 分登顶,比三个月前的 V4-Pro 预览版还高出 121 分。在衡量终端操作能力的 Terminal-Bench 2.1 中得分82.7,超过了智谱 GLM-5.2 的 81.0——而它的参数量只有后者的一个零头。

更关键的是:这次升级没有改架构、没有加参数、没有扩上下文。纯靠后训练,就把 Agent 能力拉上去了。

这其实打破了行业里一个根深蒂固的假设——“大模型必须越做越大”。DeepSeek V4 Flash 证明了另一条路:数据质量和训练策略的权重,正在超过参数规模的权重。如果你能给模型“更好的教材”和“更好的老师”,它不需要变成庞然大物也能考出好成绩。

价格层面同样凌厉。输出定价0.28 美元/百万 token,单任务成本比 GPT-5.6 Luna 低约 60%。关键原因是 DeepSeek 提供了约98% 的缓存命中折扣——业内普遍只有 90%。这不是靠烧钱补贴打价格战,而是算法效率碾压后自然溢出的成本优势。

MiniMax H3:不再分“文生图”还是“文生视频”——一个模型全搞定

如果说 DeepSeek 打的是“效率牌”,那 MiniMax H3 打的是“统一牌”。

在 H3 之前,视频生成领域有一个很割裂的现象:文生图是一个模型,图生视频是另一个,视频编辑又是另一个,声音生成还要再开一个。创作者要在不同工具之间反复横跳,每一步都可能丢失上一步的信息。

H3 做的事情很直接:把这些任务全部合到一个模型里。你给它一段文字描述、几张参考图、一段背景音频,它直接输出一段带原生双声道音效的 2K 视频。不区分“文生视频”还是“图生视频”,不区分“编辑”还是“生成”,模型自己理解你的创作意图。

这背后的技术思路值得注意。H3 的团队在博客里写了一段很诚实的话:“我们抛弃了曾经给我们带来显著架构优势的 Hailuo-02 架构,因为它在以任务泛化为核心的模型定义中会带来额外的复杂性。”翻译成大白话:为了通用性,宁愿推翻重来。

结果是硬的。在 Artificial Analysis 视频模型榜单中,H3 的视频编辑能力排名全球第一。价格:0.8 元/秒(2K 分辨率),约为业内同类旗舰的三分之一。

还有一条容易被忽略的信息:H3 设计初期就考虑了多款国产芯片的兼容性,并且宣布将在近期开源模型权重。这是 MiniMax 的首款开源多模态模型——当闭源的视频生成模型还在靠封闭生态筑墙的时候,中国企业选择了开门。

Seedance 2.5:从“生成一个片段”到“完成一段创作”

字节跳动的 Seedance 2.5,第三击,打在了一个不同的维度上。

过去一年,AI 视频生成进步很快,但有一个天花板一直没捅破:几乎所有模型都只能生成 5-15 秒的片段。你能做一段“炸裂的转场”,但你做不了一个有完整叙事的短片。创作者要把几十个片段手动拼接,对节奏,搭字幕,调音轨——AI 其实只帮你完成了最前面的 10%,剩下 90% 还是人工。

Seedance 2.5 把这个问题往前推了一大步。单次生成 30 秒,支持多轮延长至数分钟。模型可以在 30 秒内组织多个有逻辑关联的镜头,让故事按铺垫、推进、转折、收尾的完整结构展开。

多模态参考能力也大幅扩充:单次可输入最多30 张图片、10 段视频、10 段音频作为参考素材。白模参考支持用无纹理 3D 模型预先规划空间结构和镜头机位;绿幕编辑支持在保持主体不变的前提下替换场景,并根据不同场景的物理规则自动渲染光影、衣物飘动、步态节奏等细节。

更值得关注的是落地。Seedance 2.5 发布当天,徐工集团、小鹏汽车、灵初智能、微分智飞、穹彻智能等企业确认合作。不是“未来可期”式的意向协议,而是已经进入工业培训、产品设计、具身智能训练数据生成等具体生产环节。

这意味着 AI 视频生成不再只是一个“创意工具”,而正在变成一种“生产力基础设施”

为什么能「再现」?三把钥匙

如果只是一家公司发了一个好产品,那是“单点突破”。但三家在同一天打出三张牌,而且每一张打的都不是同一个方向——这就不是巧合了。背后有一套共同的底层逻辑在同时催化。

第一把钥匙:后训练时代来了。

DeepSeek V4 Flash 的故事已经说得很清楚:不改架构、不加参数,只靠后训练就把 Agent 能力拉上去。MiniMax H3 团队在技术博客里也反复提到“数据质量”和“训练策略”的权重。Seedance 2.5 的进步同样依赖更精准的训练数据和更强的指令遵循优化。

这不是个案。整个中国大模型行业正在经历一次“训练范式的切换”——从“大力出奇迹”的预训练 Scaling,转向“巧力出精品”的后训练精调。算力不够多的团队,反而在这个拐点上占了先手:因为被逼得更早去思考“怎么用更少的资源做更多的事”。

第二把钥匙:通用架构取代专用模型。

H3 统一了文生图、文生视频、视频编辑、音频生成;Seedance 2.5 统一了多镜头叙事和音视频联合生成。两个团队不约而同地选择了“做一个能处理所有任务的模型”,而不是“做一堆各管一摊的专家模型”。

这对应用层的影响是巨大的。以前你做一个视频,要调 A 模型生成画面,调 B 模型加特效,调 C 模型配音——每一步都会丢失信息,误差层层累积。现在一个模型端到端完成,创作流程的摩擦消失了。

第三把钥匙:算法补算力,从被动到主动。

H3 的高压缩 VAE 带来了4 倍的序列长度收益,In-context Regeneration 用基模自身能力替代了传统超分模块。DeepSeek 的 98% 缓存命中率同样是算法优化的成果。这不是“省着用算力”,而是在算力有限的前提下,重新设计了整条技术路径——而这条路走通之后,反而变成了成本结构上的竞争优势。

三个维度,开始习惯领先

“我们慢慢需要习惯领先”——这句话如果放在一年前,可能会被当成口号。但今天,它有了三个很具体的支撑。

性价比领先。DeepSeek V4 Flash 单任务成本比 GPT-5.6 Luna 低 60%,MiniMax H3 视频生成价格是竞品的 1/3,而且这不是补贴,是技术效率的自然结果。海外企业已经开始“倒戈”:从硅谷 AI Agent 初创公司到加密货币巨头 Coinbase,越来越多的企业把核心技术栈迁移到中国大模型。迁移后的推理成本普遍下降 30% 到 95%。

开源领先。MiniMax H3 宣布开源,DeepSeek V4 系列持续开放权重。当全球最大的开源模型阵营出现在中国,开源就不再是“社区福利”,而是一种定义行业标准的战略能力。谁能主导开源生态,谁就掌握了下一阶段开发者社区的话语权。

落地领先。Seedance 2.5 进入工业制造和自动驾驶产线,不是 Demo,是生产。中国大模型的商业化不是“卖 API",而是嵌入产业链——从写诗画画到造车盖楼,这才是 AI 真正的价值释放。

心态转变:从「追赶叙事」到「领先叙事」

过去两年,中国 AI 行业的主旋律是“追赶”。“差距缩小到 X%"“迎来斯普特尼克时刻”“接近国际先进水平”——这些话我们太熟了,熟到已经成为一种条件反射式的叙事框架。

但今天的情况已经变了。斯坦福 AI Index 2026 报告显示,中美顶级模型的性能差距已收窄至仅 2.7%。在代码生成、视频生成、Agent 能力等具体维度上,中国模型已经在多个榜单上实现反超。更重要的是,从性价比到开源生态到产业落地,中国大模型正在走出一条不同于“单纯堆算力”的差异化路径。

当然,“习惯领先”不是自满。算力瓶颈仍然存在,十万卡级集群的建设和运营、底层训练框架的自主可控、基础研究人才的持续供给——这些短板不会因为三个产品的成功发布就自行消失。

真正的姿态应该是:自信但不膨胀,领先但不松懈。

三连击之后

7 月 31 日的三连击,也许会成为中国大模型发展史上的一个重要节点。不是因为三家公司各自很强,而是因为它们同时亮剑,展示出的不是一个“单点突破”,而是一种系统性的产业能力

从年初 DeepSeek-R1 让全世界“第一次正视中国 AI",到这个盛夏 V4 Flash + H3 + Seedance 2.5 的集体登场,中国大模型只用了大半年,就完成了从“跟跑”到“并跑”的身份转换。

而从“并跑”到真正的“领跑”,考验的不再是单点突破的能力,而是生态厚度、产业深度和持续创新的耐力。

三连击不是终点。它是新阶段的发令枪。

【声明】内容源于网络
0
0
吴嘉阳跨境电商营销研究者
川流SaaS CEO 吴嘉阳 11年跨境电商经验 精通SEO SEM 联盟营销等 亚马逊中国3年资深流量产品经理 阿里巴巴国际4年资深流量产品经理
内容 529
粉丝 0
吴嘉阳跨境电商营销研究者 川流SaaS CEO 吴嘉阳 11年跨境电商经验 精通SEO SEM 联盟营销等 亚马逊中国3年资深流量产品经理 阿里巴巴国际4年资深流量产品经理
总阅读14.8k
粉丝0
内容529