据媒体报道,北京极佳视界科技有限公司联合清华大学自动化系正式发布我国首个超长时长、高性价比的 Sora 级视频生成大模型“视界一粟”(YiSu)。
核心性能:原生 16 秒至分钟级生成
该大模型具备原生的 16 秒超长视频生成能力,并支持扩展至 1 分钟以上。相较于同类产品,YiSu 在成本控制、生成速度及端侧部署能力上具有显著优势。
技术架构:超越 DiT 的自研创新
年初 Sora 的爆火引发了业界对 DiT 架构的广泛关注与复现热潮。然而,“视界一粟”并未止步于此,而是基于团队自研技术,融合了大型语言模型(LLM)与扩散模型的优势。该自研架构在多模态融合、训练与推理效率以及最终生成效果等维度实现了全面优化。
此前,该团队曾推出 WorldDreamer,这是全球首次以 Transformer 和 LLM(Masked Token 路线)为核心的视频生成研究工作,为此次发布奠定了坚实基础。
迭代规划:周更小版本,月更大版本
此次发布的是 YiSu-Beta V0.5 版本。项目正按照“每周一个小版本、每月一个大版本”的节奏快速迭代。预计未来几个月内,模型在视频时长、可控性、推理速度、运行成本及对物理世界的理解能力等方面将迎来大幅提升。
团队背景:顶尖院校与权威奖项加持
极佳科技核心团队拥有逾十年的 AI 技术积累,成员主要来自清华大学、中科院、中科大等知名学府。团队累计发表 AI 顶级论文 200 余篇,并多次斩获全球权威 AI 赛事世界冠军。

