过去三年,我们见惯了“一句话生成视频”的魔法。但魔法终究是表演,世界模型才是真正的造物。
快乐生蚝不大,但它第一次让AI学会了主动推演因果—这不是工具的迭代,是创作者权利的重新分配。
阿里巴巴发布了一款名为HappyOyster(快乐生蚝) 的世界模型产品。
注意,它不是我们熟悉的文生视频工具。
你写一段提示词,模型吭哧吭哧渲染,最后给你一段固定视频,你只能被动观看。
而HappyOyster属于世界模拟器流派
和谷歌的Genie 3同一条技术路线。
它通过学习海量长视频,以及文本、动作、图像等控制信号,主动理解空间、物理规律和因果逻辑。
它不是在“播放”一段视频,而是在“推演”一个世界会怎么演化。
智东西4月16日报道,刚刚,阿里ATH创新事业部发布了其首款开放式世界模型HappyOyster(快乐生蚝)。
基于原生多模态架构,该模型支持多模态理解、音视频联合生成以及实时世界构建与交互。
▲一个自由行走的伐木棕熊,角色与场景在转向后都可以保持一致性
在HappyOyster中,仅凭一行文本或一张图片,用户就可以生成一个完整的物理世界。并且,其生成的并非仅仅是视频片段,而是一个持续运行的物理世界。在这个世界里,光照、重力、角色动作以及场景间的因果关系都保持时间和逻辑上的连续一致。
▲真实还原梵高画作风格和细节,元素依照物理规律放置,随着视角转换无畸变现象
与传统的「写提示词—等待渲染—收到成片」一次性工作流的AI视频工具不同,在整个生成过程中HappyOyster可以实时接收指令,场景会实时作出反应,并随着用户的持续指令不断演化。同时,用户生成的数字世界,不仅能被完整保存,还能开放给其他用户进行二次创作。
▲用户可以创造出一个实时滑雪的场景,角色转向自如,雪地上的滑板印清晰明显
智东西第一时间获取了邀请码,体验后发现HappyOyster在“世界一致性”上确实带来了惊喜,主角形象、场景风格和物体位置都可以保持稳定,没有出现常见的畸变或错乱。同时,实时修改指令后,世界画面能够立刻响应。不过目前,模型的流畅度还有待提升,控制人物移动与镜头旋转,都能感知到卡顿。
自3月阿里巴巴CEO吴泳铭带队组建ATH以来,团队动作不断。此前在开发者圈引发热潮的HappyHorse尚未登场,HappyOyster就已试图将布局拓展至更远:从 “生成视频”,正式迈向AI领域专家李飞飞所提出的 “生成世界” 全新高地。
体验地址:https://www.happyoyster.cn/
免责声明:本文仅代表个人观点,供参考交流,不构成任何建议。如有侵权请联系删除。
解更