大数跨境

重磅!Wan3.0开启公测

重磅!Wan3.0开启公测 阿里云开发者
2026-08-06
5

全新一代视频生成模型 Wan3.0 正式开启公测。该模型在生成时长、多模态输入、真实感还原等核心维度实现全面升级,单次支持生成 30 秒高清视频,并首次兼容 doc、xls、ppt、pdf 等多种文档格式,真正践行“万物皆可生视频”的理念。

生成时长增至 30 秒

Wan3.0 将单段视频生成上限提升至 30 秒。这一突破不仅意味着参数的提升,更赋予了创作者更大的叙事自由度。连续运镜、一镜到底等复杂镜头语言得以完整呈现,推动 AI 视频从“生成单一镜头”向“讲述完整故事”跨越。

模型新增智能时长推荐功能,可根据提示词自动匹配最佳时长;结合视频延长功能,用户可轻松延展剧情走向,让创意自然生长。

万物皆可生视频

Wan3.0 已从单纯的视频生成工具跃迁为综合信息表达载体。除了支持文本、图片、音频、视频基础模态外,模型现已具备读取结构化信息的能力,可直接解析 doc、xls、ppt、pdf、md 等格式文件(单文件不超过 100MB,页数不超过 50 页)。

用户上传产品 PPT 或业务报表,配合提示词即可快速生成教学课件、产品演示片或动态数据图表。这背后得益于 Wan3.0 强大的指令遵循能力,它能将多源异构信息转化为连贯的视频表达,大幅降低办公素材的视频化门槛。

准确还原真实世界

针对 AI 生成内容常见的“油腻感”与人物同质化问题,Wan3.0 在文生视频模式中实现了“千人千面”。模型能敏锐刻画五官皮肤细节,自然呈现人物情绪与微表情联动,即使在群像场景中也能细腻区分不同角色的复杂神态。

在一致性控制方面,Wan3.0 表现出极高的稳定性。无论是角色特征(发型、服饰)、道具细节(材质、Logo),还是场景空间关系与影视风格调性,均能精准复刻参考素材,有效避免画面出戏或风格混淆。此外,模型还提升了数字化信息的审美水准,确保图表与界面内容兼具质感与流畅度。

值得注意的是,Wan3.0 的视频编辑能力显著增强,支持对画面、剧情及台词进行修改,但在声音质感与文字准确度方面仍有迭代空间。

多维场景应用落地

从 Wan1.0 到 Wan3.0,万相模型家族历经 8 次迭代,新模型的能力升级紧扣行业真实诉求,已深入多个生产链路:

影视创作

凭借 30 秒长视频生成、真实场景还原与高一致性优势,Wan3.0 将为 AI 短剧、音乐 MV 及生活 Vlog 带来更佳体验,显著降低创作者的制作成本。

广告营销

突破传统图文局限,Wan3.0 可在家电、汽车、快消、3C 等行业提供从产品展示到品牌叙事的定制化创意方案,满足广告业对高质量内容的迫切需求。

设计创意

在产品 UI 演示、软件功能动画及数据可视化领域,Wan3.0 能在保留设计审美的基础上,将静态方案直接转化为动态作品,省去繁琐的中间制作环节。

文旅传播

利用真实的场景还原能力,无需大规模实拍即可低成本、高效率地完成城市形象片与文化场景数字化,让自然风光与人文景观生动呈现。

公测信息与访问方式

即日起,Wan3.0 已在千问 AI 平台开启公测,并在千问 APP 灰度开放。API 接口将于近期全量上线,480P/720P/1080P 分辨率的价格分别为 0.3 元/秒、0.6 元/秒和 1.2 元/秒。

用户可通过千问 AI 平台直接体验最新功能,驱动 AI 生产力升级。

【声明】内容源于网络
0
0
阿里云开发者
阿里巴巴官方技术号,关于阿里的技术创新均呈现于此。
内容 3826
粉丝 0
阿里云开发者 阿里巴巴官方技术号,关于阿里的技术创新均呈现于此。
总阅读90.8k
粉丝0
内容3.8k