Be Known通知设置

课程库 AI 视觉生成 控制与一致性 › 第 2

人物、产品与品牌一致性——从一张好图到一套好图

普通课55 分钟

本课导读

到上一课为止,你的所有产出都是"单张"。但真实需求几乎全是"系列":绘本主角要在 30 页里是同一个人,产品要在 12 张详情图里是同一件货,品牌物料要在全渠道保持同一张脸。一致性是"玩 AI"和"用 AI 生产"之间最宽的一道沟——单张抽卡靠运气就够了,系列生产必须靠系统。本课给出这套系统:五层一致性模型(诊断用)+ 视觉圣经(资产用)+ 四件工具(执行用)。L4 埋的"关键特征外置",在这里长成完整方法。预计 55 分钟。

为什么系列这么难:每次生成都是"新抽卡"

L1 讲过原理:生成是采样,不是检索。模型没有"记忆"——它不记得上一张画的角色长什么样,每次生成都从噪声重新出发。你以为在画"同一个人的第二张图",模型只是在画"符合同一段描述的另一个人"。

而文字描述天然是欠定的(L4 的结论:语言的信息密度不够)——"红裙短发女孩"能对应一万张不同的脸。一致性问题的本质就是:如何把"同一个"这个信息,用比语言更强的手段钉进每一次生成。

五层一致性:先诊断断在哪层

"不像同一个人/同一个牌子"是笼统的抱怨,动手修之前先定位断层。系列图不一致,从下往上查:

层次控制对象断掉的典型表现
身份一致五官、发型、年龄、体型换了张脸;胖了瘦了老了
造型一致服装、配饰、产品结构裙子款式变了;logo 位置漂了;按键少了一个
风格一致线条、材质、色彩、颗粒一张厚涂一张扁平;色调忽冷忽暖
世界观一致建筑、道具、时代、文化背景现代厨房里出现中世纪烛台
叙事一致动作、空间关系、事件连续性上一张在雨里,下一张衣服是干的

分层的意义在于每层的药方不同:身份断了用角色参考图,风格断了用固定风格块,世界观断了要补设定文档。不诊断就乱修,是新手在一致性问题上烧掉最多额度的方式。

视觉圣经:把"设定"变成"资产"

影视和游戏行业管这套东西叫 bible——项目开工前先把"什么是对的"定义清楚。AI 生产里它由三份文档组成,全部用你 unit-1 的技能制作:

1. 角色设定表(做人物系列时):

· 标准像:正面/侧面/背面三视图 + 表情组(喜怒哀惊各一张)
  ——用多轮编辑(L4)打磨出"官方脸",这几张图就是后续一切的锚
· 文字规格:可量化的身份特征(年龄段、脸型、发型发色、体型、
  标志性特征如雀斑/圆眼镜)——写成可复用的提示词块
· 服装表:每套造型一张标准图 + 文字描述(颜色写具体:藏青而非"深色")

2. 产品标准视图(做产品系列时):正面/45 度/侧面/细节特写四张定妆照,加一段"结构清单"(有几个按键、logo 在哪、接缝在哪)——质检时逐项对照,产品结构错一处就是废图。

3. 品牌资产包(做品牌物料时):色板(写具体色值或色彩描述进提示词)、字体气质(L5 的方法)、风格关键词块、构图惯例(如"主体永远偏右+大留白")、禁止清单(品牌绝不出现的元素)。

提示

圣经的制作成本会在第三张图时回本:没有圣经,每张图都要重新描述+反复抽卡;有了圣经,每张图=固定资产+只写变化的部分。这和 L2「模板复用」是同一个经济学,只是单位从提示词升级成了资产包。

四件工具:把圣经钉进每次生成

工具一:角色/产品参考图(最强的锚)。L4 参考图五用法里的"角色参考"和"产品参考"在这里成为主力:每次生成都挂上标准像,身份层和造型层直接被图像锚定。这就是"关键特征外置"的完整形态——脸交给图,不交给形容词

工具二:固定提示词块(风格层的锚)。把风格描述冻结成一字不改的"风格块",系列内每条提示词都以它结尾:

【风格块 v1.2——绘本项目「小灯」,冻结于 2026-07-21】
温暖的手绘水彩绘本风格,柔和的铅笔线条,米白纸张纹理,
低饱和暖色调(主色:赭黄/雾蓝/奶白),柔和漫射光,无描边阴影

关键词是冻结:风格块要改就升版本号并记录(v1.2 → v1.3 改了什么),绝不随手临时改——临时改一次,系列就裂一次。

工具三:种子与参数管理(微调阶段的锚)。同模型+同提示+同种子=同一张图(L1 的可复现性在此兑现)。实用场景:某张图九成满意,固定种子后只微调提示词的一处,变化会集中在你改的地方附近。注意种子是同参数下的复现工具,跨提示词它不保证"同一张脸"——别把它当成身份锚用,身份锚是工具一。

工具四:世界观文档(设定层的锚)。一段冻结的场景描述(时代、地点、建筑风格、常见道具、绝不出现的东西),凡是画到这个世界的图都带上。它防的是第四层断裂——单张都对,拼起来不像同一个世界。

生产与质检流程

① 制作圣经     标准像/定妆照/风格块/世界观文档(一次性投入)
② 派生生成     每张新图 = 参考图锚 + 风格块 + 本图变化描述
③ 并排质检     新图和标准像并排放,按五层从上往下扫
④ 失败归层     不合格的图标注断在哪层,按层选药方重试
⑤ 圣经升级     发现圣经本身的漏洞(如缺侧面像)就补资产、升版本

第 ③ 步强调并排:人对"渐变的漂移"极不敏感(L4 的教训),单看每张都行,并排立刻现形。系列越长,越要定期把最新一张和第一张并排——和视频课"验尾帧"是同一个原理。

动手任务:视觉圣经 + 四场景系列

基础路线(约 90 分钟,本 Track 目前最大的作业,值得):

  1. 选定一个角色一个产品(建议沿用你 L3/L4 一直在用的主体,资产延续);
  2. 制作圣经:角色走"标准像三视图+表情组+文字规格+至少一套服装表";产品走"四视角定妆照+结构清单"。外加一个冻结的风格块(带版本号和日期);
  3. 四场景派生:让同一主体出现在四个差异明显的场景(如:清晨厨房/雨夜街头/图书馆/海边),每张 = 参考图 + 风格块 + 场景描述,共产出 8–12 张(每场景 2–3 张挑最好);
  4. 失败样本分析:挑 2 张最失败的,各写两行:断在五层的哪一层?证据是什么?换哪个工具能修?
  5. 终检:四场景的最终图和标准像并排拼在一起看一眼——这张拼图就是你的一致性成绩单。

进阶路线(可选):把其中一个场景的图交给另一个模型,带同样的参考图和风格块,看一致性体系的跨模型迁移能力——你会发现参考图迁移得好,风格块的"方言"需要按模型微调,这是 unit-3 多模型生产的伏笔。

随堂测验

随堂测验0 / 4 题正确

1. 系列第 5 张图里,主角的脸明显变了。按本课方法,第一步和对应药方是?

2. 「风格块要冻结,改动必须升版本号」,这条纪律防的是什么?

3. 关于随机种子(seed)的正确理解是?

4. 为什么质检要求把新图和标准像「并排」看,而不是逐张单独审?

划选正文任意文字可高亮、批注或加入复习卡

讨论

载入中…