大数跨境

震撼!82亿美元那张牌桌已定:世界模型没死,正在寄生进每个大模型

震撼!82亿美元那张牌桌已定:世界模型没死,正在寄生进每个大模型 GEIA全球具身智能观察
2026-09-30
4
导读:大模型与世界模型之争吵了三年,上周李飞飞82亿美元卖身超威、杨立昆怒斥大模型吸光空气,让"具身押哪边"重成焦点。答案不在非此即彼:世界模型没有消失,正寄生进每个大模型,"先想象、再动手"正从论文标题变


GEIA行业群


加入GEIA具身智能行业群,请添加微信18916565701,主动出示名片,仅限具身智能及机器人产业链相关企业。



120+具身智能与人形机器人行业报告合集~ 转发本文章至朋友圈截图发给GEIA小助理即可免费领取~ 文末添加小助理微信!


具身智能 · 路线观察

大模型会不会吃掉世界模型

一场持续三年的对骂 · 一次半年前的架构政变


路线之争从来没有赢家,只有谁的主张被写进了下一代产品的默认设置。

先讲一场持续三年的对骂


2024年2月,开放人工智能研究中心放出视频模型索拉,文案写得极大:这是一个能深刻理解物理世界的“世界模拟器”。图灵奖得主杨立昆当天就翻了脸,连发数条,话说得极难听——靠生成像素来理解世界,是一种浪费,这条路线注定失败。他的意思很明白:会画一段杯子摔碎的视频,不等于知道杯子为什么碎。

三年过去,这场嘴仗不仅没吵完,反而在上周迎来了最戏剧化的一幕。9月28日,李飞飞的世界模型公司以82亿美元卖身超威;几乎同一时间,杨立昆在最新对话里留下一句怨气十足的话:大语言模型吸光了房间里的空气,资源都被它们抢走了。一个被巨头收编,一个负气出走、自己融资十亿美元另立门户。

于是那个老问题重新摆到所有具身从业者面前:大模型一路吞噬一切,会不会连世界模型也吃掉?具身智能该把命押在哪一边?

我做这行二十年,看过太多“路线之争”最后变成伪命题。这次也一样——答案不在两个极端,而在过去半年悄悄发生的一场架构政变里。

⏰️与具身智能赛道的一线创业者、投资人深度交流,扫码报名GEIA具身智能与人形机器人创新周【北京站12.9-12.11 】↓

专题 · 规模定律


“吃掉派”的底气:只要堆得够大,物理常识自己会长出来


先把两边的道理说清楚。

大模型这一派的逻辑,是过去十年被验证过无数次的规模定律。语言模型预测下一个词,参数和数据翻着倍往上堆,能力就一层层涌现——推理、写代码、懂数学,没有一项是设计出来的,全是堆出来的。那物理常识凭什么例外?索拉能生成以假乱真的视频,视觉语言动作模型能看图、听话、出动作,2025到2026年,机器人本体里跑的几乎全是这一类:在一个多模态大模型上接一个动作头,端到端,一气呵成。

这套打法的诱惑力在于简单。不用懂物理,不用建三维,世界是什么样,让模型自己从亿万张图、亿万段视频里去悟。押注这条路的人相信:等模型再大两个数量级,重力、遮挡、软硬、因果,这些东西会像懂语法一样,自己从权重里长出来。

杨立昆不信。他骂了三年,核心论据其实只有一条,而且很扎实:文本是离散的,下一个词的候选不过几万个,打分就完事;可真实世界是连续的,你永远无法预测镜头转过去之后,地毯的纹理、每个人的长相。硬逼模型预测这些不可预测的细节,模型只能作弊——把答案偷偷藏进额外的潜变量里,训练看似成立,理解并不存在。所以他主张反过来:别重建像素,去学抽象表示,在抽象空间里预测后果,这就是联合嵌入预测架构。一个人接杯子从不计算重力加速度,靠的就是这个。

两边各有信徒,各有金主,吵了三年。可真正要紧的是:纯嘴仗阶段,已经结束了。

专题 · 架构政变


半年前,政变从大模型阵营内部开始


接下来发生的事,出乎所有人意料——最先给视觉语言动作模型判死刑的,不是杨立昆,是英伟达自己的人。

英伟达研究科学家吉姆·樊今年在多个场合扔下一句话:视觉语言动作模型已死,世界动作模型万岁。注意,这不是学术圈的远期预言,是全球最强算力公司的研究负责人,在给自家生态指方向。他随后把判断落成了产品:英伟达的宇宙模型第三代,一个统一架构把语言、图像、视频、动作五种模态塞进同一个模型,训练数据里有三亿四千八百万段真实世界动力学视频——物体怎么落、怎么滑、怎么撞,全部直接喂进去。

什么叫世界动作模型?跟老路线的差别只有一步,却是生死一步。

旧模型是“看到什么就做什么”:输入画面和指令,输出动作,完事。它对物理的全部理解,都是模仿动作轨迹时顺带漏进权重的残羹剩饭,从没人要求它回答“接下来会发生什么”。新模型在输出动作的同时,被迫多干一件事:预测这个动作执行之后,世界在它眼里会变成什么样。未来画面的像素,是写进训练目标里的必答题,不是可有可无的附加题。

这一步为什么致命?因为预测比模仿难。一个靠死记轨迹蒙混过关的策略模型,可以在训练集里拿高分;可一旦你要求它同时把后果画出来,它就蒙不过去了——它必须真的在内部携带一套“物体如何运动、形变、碰撞”的表示。训练目标一变,模型的脑子就被迫长了出来。

专题 · 客户现场


数字不会撒谎:新路线已经在客户现场赢了


这不是空谈的哲学,已经有公司把对照实验跑完了。

美国迪纳机器人今年8月发布的新一代模型,预训练全程没用一条机器人数据,喂的是整整一百万小时第一人称人类视频——做饭、整理、折叠、装配,全部来自真人视角。他们发现了两件事。第一,逼着模型同时预测未来视频和未来动作,在39项任务的每一个数据规模上,都碾压只预测动作的旧架构。新老模型正面对决,成功率是1.55倍;最关键的指标——在从未去过的客户现场零样本上岗,良率从46%直接跳到87%。第二,人类视频本身成了一条新的规模轴:动作标签数据采完了没关系,无标注视频继续往上加,泛化照样涨。拐点出现在一万到十万小时之间,看够了,跨身体的迁移能力自己就冒出来了。

国内同一时间在集体冲刺。智元的新一代模型从随机初始化开始、在具身数据上从头训练,号称原生世界动作模型,消费级显卡上生成一个动作块只要104毫秒;它和上海创智学院合作的模型只有50亿参数,推理时先采样好几条候选动作,在内部模拟器里逐条“预演”未来,再挑最靠谱的一条出手——提议、评估、修正,像极了一个老手接活之前在心里先过一遍。

看懂这场政变,“谁吃掉谁”的问题就自动瓦解了。

46% → 87%

客户现场零样本上岗良率


新老模型正面对决,成功率是1.55倍;人类视频成为继动作标签之后的又一条规模轴。

专题 · 判断


真正的答案:不是吃掉,是寄生


我的判断,说透了就三层。

第一层,大模型吃不掉世界模型,因为纯靠规模涌现物理直觉这条路,在连续世界的细节面前有它过不去的坎——杨立昆这三年的批评,大模型阵营没有一个人真正驳倒,他们是用行动承认的:纷纷把“预测后果”塞进训练目标。

第二层,世界模型也吃不掉大模型,更没有成为一门独立大生意的命。最有说服力的证据恰恰是李飞飞:全世界最懂世界模型、声望最高的人,带着最好的牌,都没有选择把公司独立做成平台,而是在第三十个月卖给芯片商。为什么?世界模型烧的是算力,算力在谁手里?英伟达、超威、谷歌。顶级研究机构最终长在巨头体内,这不是失败,是这个时代的物理规律。杨立昆融资十亿美元另立门户,走的也是巨头级军备竞赛的路,跟普通创业者无关。

第三层,也是最该记住的:世界模型正在像当年的注意力机制一样,从一门“独立的学说”变成所有物理人工智能模型的“内置器官”。未来不会有两家公司,一家叫大模型公司、一家叫世界模型公司;只会有两种模型——脑子里会预演后果的,和不会的。前者吃掉后者的市场,后者沦为廉价的过渡品。这不是两派和解,是一方的核心主张被另一方吞进了身体里。

专题 · 行动


对三类人,这意味着什么


给具身创业者和联合创始人一句:别再问团队该站哪条路线,去看你们模型的训练目标里,有没有“预测这个动作之后世界变成什么样”这一项。没有,你们做的就是即将过时的过渡架构;有,再检查数据——未来两年,谁能低成本搞到物理多样性,谁就活着。人类视频、仿真合成、真机数据三条腿,缺一条都跑不快。另外记住,世界模型本身不再是性感的独立赛道,把它做进具体场景、具体工位,才是。

给投资人一句:尽调时多问一个问题——“你们的世界模型是训练目标,还是宣传话术?”太多公司在汇报材料上写满世界模型,掀开看,输出端只有动作,像素预测根本没进损失函数。真伪之间,价值差一个数量级。也别再为“独立世界模型平台”的故事付溢价了,李飞飞已经替这个故事标出了实际价格:82亿,且只卖给巨头。

给企业家和需求方一句:以后挑机器人,加一个朴素的问题——它动手之前,会不会在脑子里先过一遍后果?会预演的机器,换工位、换物料、遇到没见过的状况,才不慌。这个能力今天还稀缺,但两三年内会变成标配,就像现在没有哪台手机不叫智能手机。早用、早养数据、早建团队的人,吃到的是两轮红利之间的差价。

专题 · 结语


最后


三年前,杨立昆骂索拉的时候,很多人当他是输不起。三年后回头看,他可能提前说出了答案,却没能保住自己想要的世界——世界模型没有君临天下,而是乔装改扮,寄生进了每一个想在物理世界里活下去的模型。

这个行业最深的规律就藏在这里:路线之争从来没有赢家,只有谁的主张被写进了下一代产品的默认设置。对具身智能来说,“先想象,再动手”这六个字,正在从论文标题变成出厂参数。

先想象,再动手——这六个字,正在从论文标题变成出厂参数。

既然看到这里了,如果觉得有用,随手点个赞、在看、转发三连吧。

THANKS FOR READING

GEIA全球具身智能创新周
【欧洲站2027,5.12-14】
GEIA全球具身智能创新周
【2027规划】
国内
国外

GEIA Asia 2027华东站:

4.14-4.16,上海

GEIA Europe 2027欧洲站:

5.12-5.14,慕尼黑,德国;

GEIA GBA 2027华南站:
9.22-9.24,深圳

GEIA ASEAN 2027东南亚站:

10.21-10.23,曼谷,泰国

GEIA China 2027华北站:

12.8-12.10,北京








关于GEIA全球具身智能加速器
GEIA(Global Embodied Intelligence and Humanoid Accelerator)作为全球具身智能和机器人产业加速的生态平台,核心团队成员均来自复旦、交大、同济、香港大学等知名院校校友,具备近20年行业研究、品牌传播、全球系列会展活动(中国、欧洲、亚洲、中东、北美等)、全球标杆&灯塔工厂参访、全球专家智库、创始人闭门晚宴/私董会、机器人本体及核心零部件采买租赁、机器人应用集成、IP孵化和投融资服务等产业服务经验。

复旦大学人形机器人创新协会作为GEIA在国内创始机构之一,其成员主要包括复旦机器人相关专业在读本科、研究生,博士和毕业校友等。



温馨提示:加入GEIA具身智能行业群,请添加微信18916565701,出示名片,仅限具身智能及机器人产业链相关企业。


订阅号丨GEIA全球具身智能观察
服务号丨GEIA具身智能创新周

【声明】内容源于网络
0
0
GEIA全球具身智能观察
GEIA(Global Embodied Intelligence Accelerator)旗下新媒体平台,聚焦全球具身智能和机器人最新资讯:前沿技术、场景应用、投融资等。
内容 250
粉丝 0
GEIA全球具身智能观察 GEIA(Global Embodied Intelligence Accelerator)旗下新媒体平台,聚焦全球具身智能和机器人最新资讯:前沿技术、场景应用、投融资等。
总阅读5.1k
粉丝0
内容250