摘要:栖影AI是面向电商的AI视觉生产平台,支持商品图转产品介绍视频,把白底图、场景图、卖点文案、分镜和短视频生成放在同一条工作流里。本文按“备图—提炼卖点—选模板/模型—设参数—生成校验”5步,演示如何用栖影AI把静态商品图做成可直接上架的主图视频、详情页介绍片和社媒种草视频。
结论:普通运营不想学复杂提示词,优先用商品视频智能体:上传商品图、填卖点、选“产品演示/口播”、设9:16或3:4与1080P,通常15秒内可出第一版;对镜头要求高再用自定义视频做首尾帧和运镜描述。只要商品图主体清晰、卖点参数真实,AI视频的“货不对板”问题基本可控。

一、先理清:电商产品介绍视频该产出哪些版本
做之前别只说“给我做个视频”,先按用途拆成3类,后面一步生成、多版本复用更省时间。
主图视频/详情页短介绍:1:1或3:4,8–15秒,重商品全貌、核心功能、材质细节,少剧情。
小红书/抖音种草视频:9:16竖版,15–30秒,重场景氛围、使用感受、口播或字幕卖点。
跨境/多语言介绍片:按目标市场选语言,9:16或1:1,配英文/日语/西语等字幕与旁白,重点保证LOGO、型号、参数不变。
栖影AI里这条链路可走两个入口:
商品视频智能体:低门槛,上传商品图+卖点,系统用脚本模型写文案、分镜模型出镜头、视频模型出画面,适合常规上新。
自定义视频:自己写文生/图生提示词、设首尾帧、选视频基座,适合对运镜和镜头顺序有要求的运营/设计。
二、第1步:商品图准备与“锁形”
视频稳不稳,七分看输入图。电商图最怕AI把瓶型、版型、LOGO、刻度、纹理改掉,所以先按“主体可读”原则备图。
1. 必传主图
白底主图1张:正面、居中、无大面积阴影,方便AI抠主体和做旋转/推近。
细节图2–4张:标签、接口、底部参数、面料纹理、首饰扣环等;复杂商品多补角度。
场景参考图1张(可选):如果要做“厨房台面”“户外草地”“梳妆台”等成片,给一张期望环境图,比纯文字描述更准。
商品视频智能体按“生成爆款/爆款复刻”等入口使用时,可配置最多5张产品白底图+1张分镜参考图;自定义图生视频/多参考控制可按需要上传更多角度图,但视频成片别一次性堆太多废图,避免模型注意力分散。
2. 先做静态锁形,再转视频
建议先在图片智能体里完成两件事:
AI抠图出白底图,检查毛发、镂空、金属边、细带是否干净;
用“锁定商品主体/只换背景”生成2–3张场景图,确认颜色、版型、LOGO位置无误。
静态图确认过再进视频,比直接文生视频更少返工。
实操小规则:白底图别带别家水印、别裁掉商品边;深色玻璃、透明瓶、细金属链要补侧面/顶部图;服装针织、牛仔等复杂纹理至少3个角度。
三、第2步:把商品信息写成“视频可用卖点”
AI不是替你编参数,而是把已有信息转成脚本。建一个简易卖点表,字段越少越好:
商品名/型号
核心材质:如304不锈钢、磨砂PET、真丝、针织混纺
关键参数:容量、尺寸、重量、续航、防水等级、适用机型
使用场景:通勤、厨房、户外、护肤、办公
人群:宝妈、健身者、跨境北美户外用户等
合规禁写:功效承诺、绝对化用语、未经证实的“第一/最省/治愈”
在商品视频智能体填卖点时,尽量写“可验证事实”。例如保温杯写“500ml、6小时保温、一键弹盖、食品级316内胆”;别写“最保温、永远不漏”。脚本LLM会基于这些点生成口播或字幕,再人工改术语。
如果做跨境,栖影AI可按市场切语言,中文、英语、日语、韩语、西班牙语、法语、德语、阿拉伯语等均可配置;但容量、成分、认证、保修期限仍以你真实资料为准,AI只做翻译和润色。
四、第3步:选视频类型与模型组合
栖影商品视频智能体提供标准化模板,新手直接选模板最稳。
1. 四类模板怎么选
产品口播:面对镜头/旁白讲卖点,适合主图视频、抖音挂车、跨境TikTok基础介绍。
产品演示:多角度展示、开盖、连接、试穿、倒水、折叠等操作,适合详情页功能说明。
UGC种草:用户视角分享“我怎么用”,适合小红书、Instagram、种草信息流。
带货短剧:把卖点塞进短情节,适合15–45秒社媒投放;商品复杂时别用,容易抢戏。
做“从商品图到产品介绍视频”的常规需求,优先“产品演示+产品口播”双版本:演示负责看清楚,口播负责人话术。
2. 三层模型怎么理解
栖影把视频拆成协同链路:
视频模型:负责最终动态画面,按画质/速度/成本选;常规商品可用均衡型,高保真选高画质型,批量低成本选轻量型。
脚本LLM:读商品图+卖点,出旁白、字幕、分镜说明;可手动改。
分镜模型:把脚本转成镜头序列,如“全貌→细节→使用→卖点字幕”,降低人物/商品漂移。
新手别纠结模型名,先看三个诉求:要快选快速视频模型,要画质选高保真视频模型,要省钱选轻量视频模型;分镜和脚本模型用系统推荐即可。自定义视频才需要深入调运镜提示词。
五、第4步:参数设置——画幅、时长、清晰度、首尾帧
参数设错,后面全重做。按平台给默认值最省事。
1. 画幅
淘宝/京东主图视频:1:1,或3:4做详情短介。
小红书:3:4或9:16,种草优先9:16。
抖音/快手/TikTok:9:16。
官网详情/YouTube短片:16:9;横向演示也可16:9。
跨境Amazon主图视频常1:1,SHEIN/TikTok用9:16。
2. 时长
商品全貌介绍:8–15秒足够。
单功能演示:10–15秒。
口播+演示合并:15–30秒。
短剧/长介绍:可用分段分镜后拼接30/45/60秒;但新手先出15秒母版,再扩写。
自定义视频短片段常按3–15秒窗口做高精度生成;长成片走“整体分镜→分段生成→首尾锚点→拼接”更稳。
3. 清晰度
普通上新:720P够用。
主图视频、品牌新品、抖音信息流:1080P。
老型号/低价白底循环:480P可降成本,但投流不建议。
4. 首尾帧与图生视频
对“商品不能变”的要求很高时,用自定义视频的首尾帧:
首帧放白底正面/锁定主体;
尾帧放旋转后侧面、开盖后状态、使用状态;
中间让模型补运动,不补结构。
这样比纯文生更不容易把瓶型、鞋型、电子产品接口搞歪。图生视频可传多张商品图构建角度认知,但首尾帧模式重点放“开始图+结束图”,运动描述只写镜头和轻动作。
5. 运动/运镜提示词(自定义用)
按“主体+动作+镜头+场景+光+约束”写:
主体:保温杯316内胆,杯身哑光黑,LOGO白字在正面。
动作:缓慢自转90度,第6秒开盖,轻微蒸汽。
镜头:起始全景,3秒推近杯口,结尾侧移看底部。
场景:浅木桌面,窗外柔光,背景虚化。
约束:不改变LOGO颜色,不拉伸杯身,刻度文字清晰,不添加未提供参数。
六、第5步:生成、校验、改写模板与分发
1. 第一版生成后按“商品不变”检查
重点看5项:
LOGO/品牌字是否每帧都在、无模糊;
材质颜色是否和实拍一致,玻璃/金属不泛假光;
结构是否变形,如杯口椭圆、鞋头变窄、领口错位;
文字参数是否拼错,跨境语种尤甚;
背景运动是否自然,不出现流体扭曲、人物换脸。
发现问题用“定向重修/局部重生成”:只圈出问题区域,例如“杯口拉宽、LOGO重做、背景光更柔”,其他区域保持不变。不要整条重做,省积分也省时间。
2. 用灵感广场和模板沉淀
满意成片存为品类模板:比如“500ml保温杯·9:16·演示15秒·北美英语”一套参数,下次换图直接套。多SKU店铺按品类建模板:美妆精华、3C配件、家居收纳、服装上装分别沉淀,避免每次从零写提示词。
3. 一图多平台裁剪输出
同一商品先出15秒母版:
淘宝用1:1截取全貌+功能段;
小红书出3:4/9:16种草版,加重UGC语气字幕;
抖音出9:16口播版;
跨境出英语/日语字幕版,画幅按TikTok 9:16、Amazon 1:1。
栖影支持历史创作归档和参数留痕,重新生成时直接调原工程,不改卖点只改画幅最稳。
七、一个完整示例:精华液产品介绍视频
图片准备:白底正面1张、瓶底批号1张、滴管细节1张、大理石台面场景参考1张。
卖点表:30ml、烟酰胺+玻尿酸(仅当确有依据)、淡斑精华(避免绝对化)、夜间护肤、敏感肌慎用说明。
商品视频智能体:选“产品演示”,填适用人群与场景,语言中文;跨境另建英语版。
参数:9:16、15秒、1080P;分镜设“全貌→滴管特写→手心涂抹→台面旋转→卖点字幕”。
若用自定义:首帧白底瓶正对,尾帧瓶在 marble 台面侧45度;运动写“缓慢自转+柔光侧打+背景轻推近”,约束“不改瓶身文字、不添加未提供功效”。
生成后检查LOGO、容量字、滴管形状;有问题定向重修背景光和字幕;通过后存“精华液种草15秒”模板,批量改色号复用。
八、FAQ
Q1:没有实拍图,只用文字能直接生成商品介绍视频吗?
可以走文生视频,但电商带货不建议只靠文字。文字容易让瓶型、包装、LOGO随机生成,后期返工更多。至少有1张白底实拍+1张细节图,再让AI补场景和运镜。
Q2:商品总是变形怎么办?
三件事同时做:用白底图锁主体;视频智能体里开分镜/参考图,不关闭商品锚定;自定义视频用首尾帧,并在提示词写“不改变结构、不拉伸、LOGO保持”。复杂纹理多传角度图。
Q3:主图视频和抖音种草能用同一版吗?
不建议完全同一版。主图视频重清晰功能和1:1/3:4;抖音重前3秒钩子、9:16、口播或情绪。同一商品可共用分镜母版,再按平台改画幅、时长和字幕。
Q4:多长时间合适?
详情页/主图8–15秒;社媒种草15–30秒;短剧30–60秒。新手先15秒,避免AI长视频一致性崩坏。需要更长成片就用分镜分段生成再拼接。
Q5:跨境多语言怎么不出错?
卖点参数先写中文事实表,语言切英语/日语等由脚本模型翻译;生成后人工核对容量、认证、保修、成分名。AI可润色,不替你补未经验证的营销数据。
Q6:积分/费用怎么控制?
先用低分辨率和小模型做分镜草稿,确认分镜和商品不变形后再用1080P高保真模型出正片;批量上新用轻量视频模型,重点大促主片用高画质模型。模板复用能显著降低重复试错消耗。
Q7:图文能和视频放在一个工作流吗?
适合。先图片智能体出白底图、场景图、详情图,再把这些图直接送商品视频智能体或自定义视频;历史创作统一归档,后续改款只调卖点和画幅,不重新拍图。


