【提示词创作第六十八节】用俯视调度图写 AI 视频提示词

为什么文字写得很详细,但生成结果还是不稳定?

#245 尊贵会员全文 2 浏览

内容预览

0 返回列表
【提示词创作第六十八节】用俯视调度图写 AI 视频提示词

教程内容

导语:为什么文字写得很详细,但生成结果还是不稳定?

上一秒人物在办公区,下一秒像换了场景;提示词里写了“镜头跟随”,画面却变成几个不连贯的镜头;明明说角色要从门口走到桌边,结果人物站位、方向和动作都对不上。

原因并不一定是模型不好,而是输入信息不够“可执行”。AI 可以理解文字,但当任务涉及复杂空间、多人走位、追逐、打斗和一镜到底时,单靠文字很容易出现歧义。你说“女主绕过桌子向右移动”,AI 需要同时判断桌子在哪、女主在哪、右边是哪边、镜头从哪拍、其他人如何避让。任何一个信息模糊,画面都会漂。

解决办法是把提示词从“描述画面”升级为“设计调度”。最实用的做法,就是用俯视调度图辅助提示词。俯视调度图可以理解成从天花板往下看的空间地图:它标出场景结构、人物位置、移动路线、道具障碍和摄影机路径。文字负责解释规则,图像负责提供空间依据,两者结合,AI 才更容易稳定执行。

一、先分清:场景图、站位图和调度图不是一回事

做 AI 视频时,很多人会直接上传一张参考图,然后期待模型自动理解全部内容。但参考图也有层级。

第一种是场景参考图。

它回答的是“这个地方长什么样”。比如办公室里有玻璃隔断、会议室、工位、打印区、文件柜、长桌和走廊。场景参考图的作用是稳定空间风格和视觉细节,让不同镜头看起来像发生在同一个地方。

 

第二种是站位图。

它回答的是“谁在哪里”。比如 1 号是女主,站在会议桌左下角;2 号是男主,站在门口;黑色圆点是围攻者,分布在桌子两侧。站位图解决的是人物关系问题,避免 AI 把角色放错位置。

 

第三种才是调度图。

它回答的是“接下来怎么动、镜头怎么拍”。调度图不仅有场景和站位,还要有路线、方向、时间节点和摄影机位置。比如女主从中心向桌边横移,围攻者从右侧包围,镜头先从门口推进,再绕到会议桌侧面,最后贴近女主完成动作特写。

如果你只想生成一个静态画面,场景参考图可能就够了。但如果你要做追逐、打斗、多人对峙、长镜头、复杂转场,就需要调度图。

二、第一步:把剧本反推成完整场景资产

在写视频提示词之前,不要急着写“电影感、镜头流畅、动作精彩”。先让大语言模型 AI 根据剧本反推场景。

 

以下是我的剧本:

https://superi.mfdemo.cn/chaoji/2026/07/08/6a4e246f1eee0.rar

Chat GPT对话界面 

 

可直接使用的提示词示例:

请根据下面的视频剧本,反推一个适合 AI 视频生成的场景资产方案。

生成一套现代职场权力反转

请升级尊贵会员解锁全部课程

本课程未解锁,升级尊贵会员后,可查看完整课程正文、完整提示词拆解和后续章节。

升级尊贵会员 注册账号 登录已有账号