人像生成常见的问题是“第一张很惊艳,后续全变了”。原因往往不是模型不行,而是提示词只写了风格,没有定义哪些元素要稳定、哪些元素允许变化。把人物设定、镜头、光线、服装和交付用途分层描述,才能把偶然好看变成可迭代的创作流程。

先写“不可变”与“可变”
不可变部分可以是成年人角色设定、发型轮廓、服装类别、画面气质和品牌色;可变部分可以是背景、镜头角度、表情和季节。不要使用真实个人肖像作为商业素材或暗示未经授权的身份关系;涉及人物参考时,先确认拥有相应的使用权。
| 提示词层级 | 写什么 | 检查点 |
|---|---|---|
| 角色设定 | 成年人、职业感、外观轮廓 | 不冒充真实人物 |
| 镜头构图 | 景别、视角、留白与主体位置 | 是否适配版面 |
| 光线材质 | 主光方向、色温与质感 | 前后是否统一 |
| 负面约束 | 不要的元素和失真风险 | 是否影响可用性 |
用“镜头卡”控制一致性
为每一组图建立镜头卡:角色版本、提示词版本、种子或参考编号、变化项和审核结果。AI 可据此生成多个构图候选,设计者再选择能承接下一张的版本。产品概念图的迭代规则,也可参考 AI 绘图做概念图的评审流程。
发布前检查使用边界
检查手部、五官、文字和背景中的无意元素;核实素材授权、平台规则和客户要求。对于广告、人物肖像和易被误解的场景,保留人工审核与版本记录,而不是只看生成结果是否“漂亮”。
一个简洁的提示词结构
成年人角色设定 + 用途 + 构图与镜头 + 光线与色彩 + 必须保持的要素 + 可变化的要素 + 不需要的元素 + 输出比例。分层比堆砌风格词更容易复用。




