据媒体披露,今年 8 月,张一鸣在 Seed 团队会议上为大模型研发定调:坚持长期主义与延迟满足,拒绝“用别人的输出换榜单排名”。字节正以自研技术为核,全力攻坚 AI 战略。消息称,字节正在研发一款实时空间视频生成模型。若成功落地,其 AI 版图将从视频生成延伸至机器人、自动驾驶及虚拟现实领域,实现跨越式发展。 字节即将推出全新模型
字节布局实时空间视频生成模型
近日消息显示,字节正开发面向实时空间视频生成的 AI 模型,并协调多部门调配算力资源。若进展顺利,该模型或于 2026 年 10 月亮相。该模型属于“世界模型”,旨在让 AI 理解环境运转规律并预测动作变化。2026 年,字节确立四项 AI 重点任务:推进世界模型训练、保持 Seedance 视频生成优势、提升 Coding 与 Agent 能力、推动豆包商业化。Seed 全员会上,吴永辉设定目标:2026 年底前发布至少一版世界模型,性能对标 Google Genie 3。为此,字节大幅提高数据预算,采购范围覆盖长视频、三维空间及机器人动作数据,投入规模约为部分国内团队的三至四倍。据悉,新模型可按需生成空间视频,速度达每秒 20 帧,响应延迟约 0.05 秒,实现用户动作与虚拟世界的近乎零延迟同步。