【提示词创作第六十七节】AI资产怎么做,画面才稳定?
很多人做AI视频时,会把问题全部归结到提示词上。
内容预览
教程内容
导语:很多人做AI视频时,会把问题全部归结到提示词上。
人物变脸了,就觉得是提示词不够精准。
场景变乱了,就继续往提示词里加“保持一致”。
打斗不好看,就把“激烈”“电影感”“震撼”这些词写得更满。
色彩不统一,就在后面补一句“高级配色”。
但真正做过完整项目的人都知道,提示词只能解决一部分问题。
如果前期没有资产,AI每一张图、每一个镜头都像是在重新猜。它不知道这个角色的正脸是什么样,不知道侧脸比例是否一致,不知道服装背面有没有图案,不知道房间左边是什么、右边是什么,也不知道一个技能释放出来到底是什么形态。
所以AI视频想稳定,不是先写一段很长的提示词,而是先把AI需要理解的信息准备好。
这就是AI资产的意义。
AI资产不是随便找几张参考图,也不是把好看的图放进文件夹里。它更像是给AI建立一套“视觉说明书”。这套说明书告诉AI:角色是谁,长什么样,穿什么衣服,在什么空间里活动,会使用什么道具,整体色彩应该保持什么方向。
当这些信息足够清楚时,提示词才会真正发挥作用。
这一节我们就从零开始讲清楚,AI资产到底该怎么做,人物、场景、道具、色板分别要准备什么,以及最容易踩的坑在哪里。
一、为什么AI创作一定要先做资产
很多人刚开始做AI视频时,都会有一个误区:以为一张角色图就能生成一整条片子。
比如你生成了一个很满意的女主,正脸好看,服装也不错,然后直接拿这张图去做后面的所有镜头。第一张可能还可以,第二张侧脸开始变,第三张背影衣服变了,第四张动作一大,脸直接换成另一个人。
这不是模型故意不听话,而是你给它的信息太少。
AI看到一张图时,它只能知道这个角色在这个角度、这个光线、这个表情下大概长什么样。它并不知道这个人的侧脸结构,也不知道后脑勺发型,不知道衣服背面细节,更不知道她运动时表情该怎么变化。
所以你写“同一个女孩”“保持人物一致”“same character”,只能起到很有限的作用。
真正有效的方法,是在前期把角色拆成可控资产。
人物要有脸部资产、妆造资产、表情动作资产。
场景要有多角度资产和空间布局。
道具要有实体道具和虚拟道具。
色板要有颜色、属性和使用场景。
这样AI生成时,不是在凭空想象,而是在已有视觉资料里做延展。
这也是为什么越复杂的AI视频,越不能只依赖一句提示词。提示词负责下达任务,资产负责提供依据。没有依据,提示词写得再漂亮,也很容易失控。
二、人物资产:先让AI认清楚这个人是谁
人物资产是所有AI资产里最重要的一类。
因为观众对人物变化最敏感。场景里的椅子变一点,观众不一定马上能发现,但人物的脸型、眼睛、发型、气质一变,观众一眼就会觉得不对。所以你想让AI稳定生成同一个角色,第一步不是直接做视频,而是先把这个角色的人物资产建立出来。
很多人理解人物资产时,会停留在“有一张角色图就够了”。但实际上,一张图只能告诉AI这个角色在某一个角度、某一种光线、某一个状态下长什么样。它并不能完整告诉AI,这个人的正脸结构是什么,侧脸骨骼是什么,背面发型是什么,服装正反面又分别是什么样。
这也是为什么很多人第一张图做得很好看,到了第二张、第三张就开始变脸。因为AI没有真正“认清楚”这个人,它只是在根据一张图去猜。
所以人物资产的核心,不是一张图,而是一套能让AI读懂人物结构的信息板。
1.制作人物资产之前,先准备一张基础人物图
在做人物资产之前,你首先要有一张清晰的人物图片,作为后续生成资产的基础图。
这张图不一定非要来自参考图,也可以先通过前面的课程方法去生成一个原创角色。如果你手里还没有稳定的人物基础图,可以先通过【提示词创作第六十五节:不用参考图,也能捏出原创AI角色脸】(点击跳转)的方法,先做出一张你满意的人物正面图。等这张图的人脸、气质、发型和基础妆造都确定下来之后,再进入人物资产制作阶段。
这张就是我的人物图
这里要注意,基础人物图最好满足几个条件。
第一,人脸要清晰。
第二,发型和头部轮廓要明确。
第三,服装最好有一定识别点。
第四,画面不要太花,尽量避免过重的氛围特效、过强的镜头光斑和太复杂的背景。
因为这张图不是最终成片,它更像是后面所有资产的“母图”。母图越清晰,后面转出来的资产越稳定。
2. 用 nanobanan pro 把人物图转成四视图资产
当你有了一张稳定的人物基础图之后,下一步就可以使用 nanobanan pro(工具入口可参考这个教程https://www.super-i.cn/info-2796.html),把这张图转化为人物资产图。
这一步的目的,不是简单“换个版式”,而是把一个角色拆解成更适合AI读取的信息结构。也就是说,你要让AI不只看到“这个人很好看”,而是看到“这个人正脸长什么样、侧脸长什么样、服装结构是什么样、背面造型又是什么样”。
目前你这里可以直接用两套模板。它们都能做人物资产,但用途和优缺点不一样。
模板一:横版四视图
一张正脸大图 + 全身三视图
这是比较标准的一套人物资产模板。它的结构很直观:左边是一张精细正脸特写,右边是正面、侧面、背面三张全身图。
它适合刚开始搭建人物资产时使用,因为信息结构清楚,AI也比较容易理解。
提示词如下(直接使用上面的主图使用nanobanan pro去生成):
“生成图中人物的真人形象四视图,白底图,左侧部分展示了角色的精细真人特写肖像。其面部特征、骨骼结构、神态表情、发型及头部配饰必须与参考图严格一致,呈现自然的皮肤纹理、毛孔和发丝细节,高解析保留毛孔、细纹、绒毛、眉睫、发际线碎发与皮肤受光后的微小起伏,不磨皮、不锐化过头、不做人像美容,摄影棚质感,需要完全正脸,无动作,真人定妆照。右侧部分展示了该角色完全相同的全身真人照片,呈标准 A-pose 站姿,并以精确的三视图排列:正视图、侧视图和背面图。超模的身体比例、完整的服装设计、布料层次、鞋子及整体穿搭风格必须严格遵循。所有服装和配饰均呈现真实的物理材质质感。”
优点
这套模板的优点,是结构标准,生成逻辑比较稳定。左侧的大正脸可以帮助AI固定五官结构,右侧的全身三视图可以帮助AI理解角色的身体比例、服装轮廓和背面造型。如果你只是想先快速建立一个角色基础资产,这套模板是够用的。
缺点
但它也有一个明显缺点,就是它只有一张大正脸,没有侧脸大图。这样一来,后续在生成视频时,如果镜头转到半侧脸或者侧脸,AI有时还是会自己补结构,导致人脸一致性下降。
另外,右侧那张纯侧视图虽然在理论上是三视图的一部分,但它在很多实际视频生成场景里利用率并不高。因为纯正侧面的人体站姿参考,在镜头里并不是最常见的使用角度,很多时候它只是“存在”,但不一定真正高频被用到。也正因为这样,这整张图的信息利用率其实不算最高。
所以这套模板更像是一个标准版、基础版人物资产。它很适合入门,也很适合角色初步