这是我的第473篇Ai笔记,本篇5265、累计笔记8428359
彩蛋:文末给你准备了一个人物设定生图提示词智能体,还包含智能体主提示词、完整知识库和使用手册,记得取!
你有没有发现一个特别扎心的现象?
同样都是用AI生视频,别人作品里的人物,不管正脸、侧脸、远景还是特写,看起来始终像同一个演员。
轮到自己上手,情况就变了。
第一秒还是清纯女主,镜头一转,脸型变了;
再换个场景,发型、妆容、身材也跟着变了。
一个十几秒的视频,看起来像是请了好几个人轮流出演。
最让人困惑的是,别人写的提示词,好像也没什么特别玄乎的地方。
为什么最后效果差这么多?
我最近翻了大量人物设定图、妆造拆解图和角色三视图后,发现了一个很关键的问题:大神并不是直接从视频开始做。
他们在正式生成视频以前,通常已经先把人物的脸型、五官、妆容、发型、服装、身体比例和不同角度,提前做成了一整套人物母版。
你看到的是成片。
真正决定人物稳不稳的工作,往往在开拍之前就做完了。
这两年,AI模型的能力确实越来越强了。
以前很多东西都得你自己写得特别细。
现在模型会自己补光影、补构图、补细节,视频模型甚至还能补动作、表情和镜头。这当然是好事。但问题也很直接:
模型越强,通常也越贵。
尤其是做人物视频时,脸崩了要重做,衣服变了要重做,镜头切换像换了个人,还是要重做。
看起来你省掉了前期准备的时间,最后却可能用更多返工把这点时间全补回去。
所以现在最不划算的做法,就是一上来直接抽卡。
真正省钱的做法,是先把人物准备好:
先确定她是谁
再确定她长什么样
再把正面、侧面、背面、妆容、服装和细节固定下来
最后再进入视频环节
说白了,前期准备并不是多此一举。
它是在减少后面的无效生成。
下面,我就用5组不同案例,直接测试一件事:
不提前上传人物照片,只通过文字,能不能直接生成一套后续可复用的人物资产。
01|真人美女:雾杏奶油妆模特设定表
第一组,我先做一张完整的真人美女妆造设定表。
不是单独生一张好看的脸。
而是一次性把人物多角度、妆容细节、身体细节、服装材质和色彩全部做出来。
提示词:
生成一张高完成度的“雾杏奶油妆模特设定表”,竖版9:16构图,纯白偏暖背景,高级美妆杂志排版,中文标题和栏目清晰准确。人物设定:19岁中国女性,身高168cm,体重46kg,身材纤细匀称。小巧鹅蛋脸,面部轮廓柔和,眉眼清透灵动,自带轻微清冷感,气质温柔、干净、自然。发型:柔软蓬松的棕色微卷长发,轻薄空气刘海,发丝自然有光泽。妆容主题:雾杏奶油妆。底妆轻薄通透,呈现细腻奶油肌;眼妆使用低饱和裸杏色,眼线纤细自然,睫毛根根分明;腮红淡淡铺在面中;唇妆为水润裸杏色,带轻微镜面感。服装造型:米白色短款针织开衫,内搭同色系吊带,浅杏色缎面半身裙,裸色低跟鞋,佩戴小巧珍珠耳饰。服装材质柔软、轻盈,整体配色统一。页面上方展示人物多角度全身图,依次为正面、45度、标准侧面和完整背面。所有角度必须保持同一张脸、同一发型、同一妆容、同一服装和相同身体比例。页面右上方展示人物高清正脸特写,并排列眼妆、睫毛、唇妆、肌肤质感和侧脸轮廓五张局部特写。页面中部设置“妆容解析”栏目,分别展示底妆、眼影、眼线、睫毛、眉妆、腮红、高光和唇妆,并为每个部分搭配对应的化妆产品示意图。页面下方设置“身体细节展示”,包括锁骨、肩颈、手部、腰部、腿部和鞋履细节。最下方设置色板与材质参考,包括米白色、雾杏色、奶油粉、裸肤色,以及针织、缎面、珍珠和柔软薄纱材质。整体风格清透、温柔、高级,真实摄影质感,人物在所有区域保持高度一致,排版精致清晰,无水印。
成品展示:
成品介绍:
这一张图,已经把后续最常用的人物信息全部固定住了。
脸、角度、妆容、服装、材质都清楚了。
后面不管拿去做单图还是做视频,都会稳很多。
02|短剧女主:猫系甜酷角色选角卡
第二组,我不继续做同一种美妆设定表。
这一次,我直接测试短剧女主。
短剧里,好不好看当然重要,但更重要的是:
这张脸,到底适合演什么。
提示词:
生成一张“猫系甜酷短剧女主角色选角卡”,竖版9:16,整体采用时尚杂志与影视选角资料结合的排版方式,黑、白、灰为主色,使用少量莓红色强调。角色设定:21岁中国女性,适合都市甜宠短剧和轻复仇题材。小巧鹅蛋脸,面部骨骼纤细,眉眼灵动,眼尾轻微上扬,鼻梁秀气,嘴唇饱满,整体带有明显猫系特征。角色气质:外表甜美,内在清醒,有轻微攻击性和反差感。静态时清冷,笑起来甜美,挑眉时带一点狡黠,适合“前期乖巧、后期反杀”的短剧女主。妆发设定:黑茶色蓬松长卷发,高颅顶,轻薄碎发修饰脸型。底妆干净通透,眼线微微上挑,睫毛纤长,腮红克制,嘴唇使用水光感豆沙红。服装设定:黑色修身短上衣,灰黑色短外套,高腰半身裙,长靴,佩戴小巧银色耳饰。整体甜酷,但不夸张。页面左侧展示角色高清半身定妆照。页面右侧展示五种表情:无辜、轻笑、挑眉、冷脸和委屈。五张表情图必须保持完全相同的脸型、五官、发型和妆容,只改变细微表情。页面中部设置“角色适配度”栏目,用视觉评分方式展示:甜宠女主95%、校园女神88%、豪门千金82%、复仇女主90%、职场新人75%。页面下方展示正面、45度和侧面三种面部角度,并设置“脸型特征”“镜头优势”“表演关键词”“适配服装”“适配场景”五个栏目。脸型特征:小巧鹅蛋脸、猫系眼型、五官集中、面中饱满、下颌线流畅。镜头优势:近景眼神戏、回眸、挑眉、委屈落泪、反杀冷脸。适配场景:校园走廊、豪宅客厅、公司电梯、雨夜街头、咖啡馆对峙。整体像专业影视项目中的女主选角卡,信息密度高,人物真实自然,所有区域保持同一角色,无水印。
成品展示:
成品介绍:
这张图解决的,不只是人物一致性。
它还提前把这个人适合拍什么内容、演什么角色,一起定下来了。
后面写剧情、做封面、做分镜,方向会清楚很多。
03|动漫漫剧:甜酷少女三视图
第三组,我把风格切到动漫。
动漫角色最容易出现的问题,不是不好看,而是:
每个角度都像不同的人。
所以动漫角色最需要的,就是三视图。
提示词:
生成一张“甜酷AI漫剧少女全角度角色设定板”,竖版9:16,纯白背景,专业动画角色设定稿风格,兼具现代漫剧质感和轻微时尚感。角色设定:18岁中国动漫少女,深棕色长直发,发丝柔顺自然,薄刘海,头顶佩戴小巧黑色猫耳发饰。脸型为小巧鹅蛋脸,眼睛大而清亮,瞳色为暖棕色,鼻部线条简洁,唇色淡粉,气质甜美中带一点清冷和叛逆。服装设定:黑灰条纹短款针织开衫,黑色吊带短上衣,高腰黑色直筒长裤,银色细链腰饰,黑灰色厚底鞋。整体为甜酷街头风。身体比例:少女体型,身材纤细,头身比例自然,四肢修长,避免夸张漫画比例。页面左上方展示角色高清正脸头像。页面主体展示四个完整视角,依次为正面全身、45度全身、标准侧面全身和完整背面全身。所有视角必须保持完全一致的脸型、发型长度、猫耳位置、服装纹理、身体比例和配饰位置。页面右侧展示五种表情设定:元气微笑、傲娇侧目、害羞低头、冷淡直视和委屈含泪。页面下方展示发型结构图、眼睛细节、猫耳发饰、上衣纹理、腰链结构和鞋履细节。增加角色色板:深棕、黑色、炭灰、银灰、暖肤色和淡粉色。画面整体像专业动画公司制作的角色设定稿,线条干净,造型完整,风格统一,适合后续制作AI漫剧和连续分镜,无水印。
成品展示:
成品介绍:
这组一旦做好,角色的脸、头发、衣服和比例就基本稳住了。
后面拿它去做漫剧、角色PV、分镜图,都会比直接盲生轻松很多。
04|机械角色:仿生女战士工业蓝图
第四组,我故意把难度提上去。做一个机械感角色。
因为这类角色除了脸要稳,机械结构也必须稳。
提示词:
生成一张“仿生女战士X-07工业角色蓝图”,竖版9:16,未来工业设计手册风格,深灰色背景,搭配银白色线稿、冷蓝色发光标记和少量红色警示标识。角色设定:外观年龄23岁的亚洲仿生女性,面部结构精致冷峻,狭长眼型,鼻梁挺直,下颌线清晰,肤色冷白,黑色利落中长发,眼神理性克制。机械改造:右眼为透明蓝色机械视觉模块,右侧太阳穴存在细小接口;左臂从肩部开始为完整机械义体,采用银灰色钛合金与黑色碳纤维结构;锁骨下方存在一条蓝色能量指示灯;背部脊柱两侧排列细小机械接口。服装设定:黑色贴身战术内甲,银灰色轻型肩甲和腰部装甲,腿部为高弹性黑色战术材料,脚穿轻型机械战靴。服装简洁克制,符合真实工业结构,不要堆砌装饰。页面中央展示角色正面完整站姿。页面左右分别展示侧面和背面完整视图。页面上方展示高清面部特写,并标注机械视觉模块、太阳穴接口、颈部连接器和能量状态灯。页面下方以局部爆炸图的形式,展示机械眼、机械左臂、手指关节、肩部装甲、脊柱接口和机械战靴。增加材质说明:拉丝钛合金、磨砂黑碳纤维、透明蓝色能量晶体、柔性战术织物。增加角色参数:型号X-07,身高172cm,战斗定位为侦察与近距离作战,能源状态稳定,机械义体覆盖率32%。所有视图中的机械部件位置、大小、形状和材质必须完全一致。人物面部、发型、身体比例和装甲结构保持统一。整体像电影工业设计团队制作的专业角色蓝图,结构清晰,细节精密,具有真实制造逻辑,无水印。
成品展示:
成品介绍:
这组最能说明设定图的价值。
如果直接一句“仿生女战士在未来城市战斗”去生视频,机械结构很容易每个镜头都不一样。
有了这张蓝图后,哪些地方是皮肤,哪些地方是机械,哪些地方发光,全部提前定死了。
05|真人男主:六镜头人物连续性测试板
第五组,我直接往视频前期再走一步。
测试一下:只靠文字,能不能先做出一个人物,再让他稳定出现在六个不同镜头里。
提示词:
生成一张“城市青年男主六镜头连续性测试板”,横版电影分镜排版,包含六个独立画面。六个镜头中必须始终是同一个人物,保持相同的脸型、五官、发型、体型和服装。人物设定:25岁中国男性,身高180cm,身材清瘦匀称,小麦色自然皮肤,脸型偏窄,下颌线清晰,单眼皮或轻微内双,鼻梁挺直,短碎发,整体气质干净、安静、有轻微疲惫感。服装设定:深灰色连帽卫衣,外搭黑色短款夹克,深色直筒长裤,白色运动鞋,背一个黑色单肩包。六个镜头中服装不得变化。镜头一:清晨,人物站在出租屋镜子前整理衣领,半身中景,窗外自然光。镜头二:地铁车厢内,人物单手握住扶手,侧脸看向窗外,近景。镜头三:写字楼电梯中,人物低头看手机,镜面反射出完整侧脸,中近景。镜头四:办公室工位前,人物坐在电脑前轻轻揉眼睛,桌上放着一杯冰美式,中景。镜头五:傍晚街头,人物背着单肩包独自穿过人群,远景跟拍。镜头六:夜晚便利店门口,人物拿着一瓶水抬头看向镜头,面部近景。整体使用真实电影摄影质感,光线随时间自然变化,但人物身份始终保持一致。六个镜头中,不得改变人物年龄、脸型、发型、肤色、身体比例、服装和配饰。排版像专业影视分镜测试板,每个镜头下方标注景别、时间和场景。重点测试同一角色在不同距离、不同角度、不同光线和不同场景下的人物连续性。
成品展示:
成品介绍:
这张图已经非常接近真正的视频前期了。
如果六个镜头里的脸、发型、服装都能稳住,就说明这个人物已经具备继续做视频的价值。
五组案例测完以后,答案已经很清楚了。
别人AI视频里的人物更稳定,不只是因为模型更强。
更大的原因是:
他们没有让模型每一次都重新猜这个人是谁。
人物设定表,解决的是脸和妆造。
选角卡,解决的是脸型和角色气质。
三视图,解决的是不同角度。
工业蓝图,解决的是复杂结构。
连续性测试板,解决的是不同场景和镜头。
这些工作看起来是增加步骤,实际上是在减少返工。
所以,做好准备从来不是浪费时间。
特别是在模型越来越贵的今天,它是在实打实地帮你省钱。
最后,老规矩,我用三句话总结一下:
1. 人物一致性的关键,不是一句“保持同一个人”,而是先把脸型、妆容、发型、服装和角度做成完整母版。
2. 模型越强、生成越贵,越不能靠乱试;前期准备越充分,后面返工越少。
3. 未来真正高效的AI视频流程,是先做人设,再做分镜,最后才进入视频生成。
看完上面的提示词,很多人估计已经开始头大了。
因为真正麻烦的,从来不是“我想做一个美女”这种一句话。
真正麻烦的是,你得把她的脸型、妆容、服装、材质、视角、排版全部讲清楚。
所以这一次,我专门做了一个:《人物设定生图提示词智能体》
你不需要自己硬凑长提示词。
只要像聊天一样告诉它:
我想做一个适合都市复仇短剧的冷艳女主
我想做一个甜酷风漫剧少女,要有三视图
我想做一个机械感很强的仿生角色
它会继续追问你的需求,然后自动帮你整理成一整套可直接拿去生图的完整提示词。这次资料包一共包含三部分:
🎁 人物设定生图提示词 智能体主提示词 可直接导入GPT、Claude、Gemini、千问等支持自定义智能体的平台。
🎁 人物设定知识库包 整理了常见脸型、五官、妆容、发型、服装、角色气质、镜头角度、材质和排版方式。
🎁 智能体使用手册 从创建、导入知识库,到怎么描述需求、怎么修改结果、怎么继续生成视频参考图,全部写清楚了。
扫码回复关键词【人物智能体】,即可自动领取完整资料包。

