通过同一提示词一次性生成四条视频,AI 视频生成的“抽卡”模式正逐渐演变为类似导演在监视器前选镜头的高效工作流。相较于传统实拍需反复重拍以对比表演效果,AI 技术可大幅缩短制作周期,实现一次生成、直接优选。
这一功能由 LibTV 首发上线的 MiniMax H3 模型提供支持,单段提示词甚至可同时输出八条视频方案。
批量生成与人物一致性突破
在国风悬疑游戏预告片的实战测试中,MiniMax H3 展现了极高的实用性。用户只需在 LibTV 中上传参考图、输入提示词并选择该模型,即可设置一次性生成多条成片。
针对 AI 生成随机性大、指令遵循度不稳定的痛点,H3 的“一抽四”功能为短剧和广告制作提供了高效解决方案。基于同一组素材和提示词生成的四个版本,可直接对比表演细节、动作幅度及运镜方式,从而筛选出最优方案。
值得注意的是,即便在动作幅度较大的情况下,H3 依然保持了出色的人物一致性:转身与后撤时面部无漂移,手部与道具无粘连,衣物飘动符合物理惯性,各项指标均达到后期剪辑标准。
在成本方面,MiniMax H3 兼具高质量与低价格优势。LibTV 活动期间,768p 分辨率低至 0.1 元/秒,2K 分辨率低至 0.2 元/秒。同等预算下,使用 Seedance 2.0 仅能生成一条视频,而 H3 可生成四条。
此外,MiniMax H3 在参考素材限制上更为宽松。不同于部分模型对真人图片上传需经过严格合规验证,H3 完全支持人脸图片及含人脸视频作为参考,且能精准还原原图中的细微特征(如衣物褶皱、遮挡文字等),极大简化了真人短剧、口播及广告中固定演员的制作流程。
竞品对比:MiniMax H3 vs Seedance
将 MiniMax H3 与目前常用的 Seedance 2.0 进行同条件对比(相同界面截图、提示词、画幅及时长),两者表现各有千秋:
- Seedance 2.0:对原始界面的还原更为克制,信息层级关系完整清晰。
- MiniMax H3:文字渲染更加锐利,运镜变化丰富,镜头跟随线索移动自然,呈现出类似已剪辑完成的功能演示效果。
两款模型均能满足商用项目需求,且都支持多模态理解,允许混合输入多达 12 个参考素材(涵盖图片、视频、音频)。用户无需将颜色、字体、运镜等细节逐一转化为文字提示,模型即可自动整合品牌调性,生成人物、场景、色彩与运镜连贯的统一镜头,特别适用于游戏 PV、产品广告及网页动效的批量制作。
智能工作流与一键出海
针对竖屏广告投放需求,LibTV 集成了超过 100 个技能(Skill),覆盖影视、广告、漫剧等多个领域。用户无需手动拆解分镜再替换元素,只需在画布右侧的 AI 对话中调用“爆款复刻”技能并描述需求,AI 便会像执行副导演般多次沟通确认,确保生成效果精准。
实测显示,生成的视频在节奏和转场上高度还原参考爆款,仅替换画面内容,大幅降低了手动制作的时间成本。
本地化适配能力
在跨境电商与短剧出海场景中,LibTV 展现了强大的本地化重构能力。当要求将宣传视频调整为“英国市场版本”时,系统不仅自动搭建工作流,更实现了深度的视觉与文化适配:
- 字幕与标题:不仅是翻译字幕,英文标题卡的字体也进行了重新设计。
- 视觉风格:整体色调从中式转为英伦风。
- 场景与角色:中式建筑变为维多利亚风格街道,古装角色转换为黑色斗篷造型。
这种深度的自动化本地化处理,显著减少了跨境业务中的外包沟通成本。
体验地址:liblib.tv
AI 创作的魅力往往在于意外之喜。随着试错成本的降低,创作者拥有了更多“抽卡”机会,能够在同等预算下尝试更多创意方向,发掘预设之外的精彩作品。

