【提示词创作第七十五节】别只写提示词,三种条件图让AI生成更可控
怎么更好的控制生成?
内容预览
教程内容
导语:怎么更好的控制生成?
提示词负责描述想要什么,条件图负责限定画面必须怎样生成。学会深度图、法线图和动态轮廓图,单张图片也能延展机位、人物细节与产品动画。
很多人使用AI生成图片或视频时,仍然把主要精力放在提示词上:不断补充景别、光线、镜头、材质和动作,希望模型能够完整理解自己的意图。
但当任务涉及动作复刻、机位变化、人物结构保持或产品形态转换时,仅靠文字往往不够。文字擅长描述内容,却不擅长精确规定每一个区域应该位于哪里,也很难持续约束同一个主体在多个画面中的结构。
这时,真正有效的方法不是继续堆叠形容词,而是给模型增加一种更直接的视觉条件。
深度图告诉模型前后距离,法线图告诉模型表面朝向,轮廓图告诉模型外形边界。它们不是最终画面,而是介于参考图与结果图之间的“结构说明书”。
这套方法来自早期扩散模型和三维制作中的控制思路,但放进现在的图像模型、视频模型和代码工具中,依然可以解决很多新的问题。
因为今天的模型更擅长补充材质、光影和真实细节,我们不必再让条件图承担全部生成工作,只需要让它负责最容易失控的部分:空间、表面和形状。
一、先理解条件图到底控制什么
普通提示词是在说“画面里有什么”。
例如:
一名穿黑色长裙的女性站在草地上,低机位拍摄,阴天,电影感。
模型会根据这段文字自行决定人物距离、身体姿态、衣服褶皱和背景层次。每次生成时,这些决定都有可能变化。
条件图则是在说“这些内容必须按照什么结构出现”。
深度图会把离镜头近的区域和远的区域分开;法线图会用不同颜色记录表面朝向;轮廓图只保留主体边缘,让模型明确外形从哪里开始、在哪里结束。
因此,提示词与条件图并不是替代关系。
提示词控制题材、风格、材质和氛围,条件图控制空间、结构和变化路径。真正稳定的工作流,通常是“文字描述+视觉条件+主体资产”共同完成,而不是依赖某一段万能提示词。
二、深度图:把平面图片变成可以重新取景的空间
深度图是一张灰度图。
通常离镜头较近的部分更亮,较远的