AI 视频的提示词不是越长越稳定。真正决定结果的是:这个镜头要让观众看到什么变化、主体做什么动作、镜头从哪里看、哪些元素必须保持不变。把这些拆开描述,比一次塞进大量风格词更容易得到可剪辑的片段。

一镜只解决一个问题
先写镜头目的,例如“让观众看见角色发现线索”或“展示产品从静止到启动”。再补主体、动作、机位、时长和环境变化。若同一镜既要换地点、换服装、做复杂动作又要讲信息,失败率会明显上升。
| 镜头字段 | 应说明的内容 | 检查点 |
|---|---|---|
| 目的 | 本镜头的唯一信息 | 一句话能否说清 |
| 主体 | 人物或物件的固定特征 | 与前镜是否一致 |
| 动作 | 开始、过程、结束状态 | 是否可见且有限 |
| 镜头 | 景别、机位、移动方式 | 是否服务于目的 |
提示词写成分镜说明
生成一个原创短视频镜头。镜头目的:【目的】;固定主体设定:【主体】;动作从【起始状态】变化到【结束状态】;镜头为【景别与机位】,环境只保留【关键元素】。画面不出现文字、商标或已有作品角色。动作自然、物体关系连续,声音如无法可靠生成则不加入具体台词。
生成后先在时间轴上检查首尾帧,而不是只看中间最漂亮的一帧。若主体、服装或道具跳变,回到固定设定减少变量。角色一致性的做法可参考短剧图片的连续性设定表。
发布前检查
确认人物、音乐、素材、标识和故事均有使用权;对现实人物和事件避免造成误认。生成视频不等于事实记录,涉及新闻、医疗或公共安全信息时应明确来源与限制。




