刷到一个爆款视频,动作干净利落,运镜行云流水。你想让自己的角色也来这么一段,把原视频丢给 AI 当参考。结果生成的画面里,人物穿的和原视频一模一样,背景也是原视频的场景,连色调都带过来了。你要的是“动作和运镜”,AI 却把整个视频都“抄”了。
不是 AI 不听话,是你给它的信息太多了。
原视频里有人脸、有服装、有背景、有光影、有颜色——这些信息全部混在一起,AI 分不清哪些是你想要的,哪些是干扰。你只想复刻一个运镜,它却把原视频的世界观都带过来了。
今天,深度视频捕捉功能正式上线 AixTV。
它解决的就是这件事:让你从一段视频里,只提取“动作和运镜”,其他全部剥离。
什么是深度视频?
简单说,就是把一段普通视频,变成只有明暗和轮廓的“灰白视频”。
浅色部分是人物,深色部分是空间。没有颜色,没有纹理,没有人脸细节。留下的只有:人物姿态、空间远近、镜头运动。
当这段深度视频作为参考输入给 AI 时,它读到的不是“这个人长什么样”“背景是什么风格”,而是“这个人在怎么动”“镜头在怎么走”“空间关系是什么样的”。
AI 不再“抄画面”,它开始“抄动作”。
为什么深度视频比直接拿原视频当参考更好?
因为信息过滤。
直接拿原视频当参考,AI 会连带原图的人物、服装、背景、光影一起继承。画风容易打架,动作也容易跑偏。
深度视频做的是一件事:把颜色、人脸、材质全部拿掉,只告诉 AI “人怎么动、镜头怎么走、东西在哪里”。
参考素材不是越完整越好。有时候把干扰先拿掉,AI 反而更容易抓住真正重要的部分。
这就像你给一个演员讲戏——你不需要告诉他“你穿什么衣服、背景是什么季节”,你只需要告诉他“从左边走到右边,在第 3 秒转身,镜头跟着你推近”。演员自己会带入自己的造型和表演。
在 AixTV 上怎么用?
操作很简单,三步。
第一步:生成深度视频。 选中你想要参考的视频,选择“逐帧拉片 > 深度动作捕捉”,自动生成对应的深度视频。原视频里的复杂动作、环绕运镜、打斗镜头,全部转换成干净的深度参考。
第二步:连接节点。 在 AixTV 无限画布上,上传新的素材,把它作为参考输入。
第三步:写一句提示词引导。 需要写明“运镜/动作/画面参考@深度视频”,然后再简单描述一下画面内容。因为深度视频里只能看到明暗和轮廓,一些轮廓不明显的物品需要告诉 AI——比如“第 3 秒手中出现的是刀”“第 5 秒出现的人物是友军”。
其他内容,比如角色参考、场景风格,按正常方式填写即可。不用大段描述运镜,不用逐帧解释动作,深度视频已经把这些都说清楚了。
它能帮你做什么?
复刻爆款运镜。 某部电影里有一段非常厉害的镜头语言,你把它做成深度视频,生成自己的视频时只参考其中的运镜方式,其他内容都不采用。保持原创性的同时,借用了一个厉害的运镜效果。
复刻舞蹈/武打动作。 找一段舞蹈跳得好的短视频,捕捉深度视频,再用自己设定的角色来生成。动作节奏完全对得上,但跳的人是你自己的角色。
复刻复杂镜头运动。 环绕、跟拍、长镜头调度、多机位切换——这些过去只靠提示词很难描述清楚的镜头运动,现在可以通过深度视频精准捕捉。你想要一个环绕主角360度旋转的镜头?找一段有类似运镜的视频,提取深度视频,接入你的角色,镜头轨迹完全跟着走。过去需要反复抽卡碰运气的复杂运镜,现在变成了可控可复刻的标准操作。
先用低成本模型验证,再做正式生成。 拿不准一段提示词的效果是否符合预期,先用低成本模型和低分辨率生成一段演示视频,确认效果没问题后,把演示视频做成深度视频,最后生成正式分镜时参考它。看起来多做了一个演示视频,但相比直接生成正式视频后产出废片,这种方式反而更省算力。
这是 AI 视频从“生成画面”走向“精准控制”的关键一步。
为什么说深度视频是必然方向?
回顾 AI 视频创作的进化:
最早,只能用文字生成,几乎所有内容都无法精准控制。
然后,有了多模态输入,上传人物设定图,角色可以一比一还原。
后来,有了导演台,可以精确控制画面结构和摄像机走位。
现在,深度视频补齐了最后一块拼图:人物动作和复杂运镜的精准控制。
从画面层,到结构层,再到动作层。AI 视频的每一个组成部分,正在被逐一攻克。
在 AixTV 上,它和你的创作流程连在一起
深度视频捕捉已接入 AixTV 无限画布。它不是孤立的工具,它和你的整个生产流程直接相连:
和 Seedance 2.5 联动——深度视频作为动作和运镜参考,直接输入视频节点,配合角色资产和场景参考,批量生成镜头。
和 Agent 智能体联动——自动识别需要捕捉的视频片段,自动生成深度参考,自动连接到下游节点。
和故事板工作台联动——深度视频、角色资产、分镜脚本全部铺在同一块故事板上,一站式完成从动作捕捉到成片的全部流程。
它不是“多了一个功能”。它是 AixTV 全链路创作体系中,补齐“动作控制”环节的那块拼图。
它最适合谁?
短剧/漫剧创作者——武打戏、动作戏、复杂运镜,不用逐帧描述。一段参考视频丢进去,动作精准复刻,角色换成自己的。
自媒体创作者——刷到好的运镜方式,不用羡慕。捕捉深度视频,生成自己的内容,画面是你的,节奏是爆款的。
广告/MV 创作者——高难度镜头调度、舞蹈编排、产品动态展示,精准控制每一帧的动作和运镜。
任何想让 AI 视频“更听话”的人——深度视频让你从“抽卡式生成”走向“导演式控制”。
上线信息
深度视频捕捉已上线 AixTV,所有用户可登录无限画布直接调用。
Muses 通用积分计费,不分模型额外收费。
扫码加入AixTV创作者社群
参考素材不是越完整越好。有时候,拿掉干扰,AI 反而更懂你要什么。
AixTV,从创意到成片,让专业创作触手可及。 🚀
评论区聊聊:如果你能轻松复刻一个视频的动作和运镜,你最想复刻哪一段? 💬

