课程库 › AI 视频生成 › 连续性与表演 › 第 1 课
人物、产品与场景一致性——七层连续性与资产系统
普通课约 55 分钟
本课导读
unit-1 毕业作业里,四个镜头拼起来最刺眼的问题几乎一定是:主角第三镜换了件衣服、场景的门一会儿在左一会儿在右、光线方向镜镜不同。这就是 L1 预告的"核心战场"——连续性。视觉课 L6 刚给了你五层一致性模型和视觉圣经;本课把它们扩展到视频:时间维度让五层变七层,视觉圣经长成九件套资产系统,外加影视行业百年前就发明的那件工具——连续性表。预计 55 分钟。
说明
本课默认你已学过视觉课 L6(五层一致性、视觉圣经、参考图锚定、风格块冻结)。没学过的先补——本课的所有方法都建立在它之上,只讲视频新增的部分。
从五层到七层:时间带来了什么
视觉课的五层(身份/造型/风格/世界观/叙事)管的是"多张图之间";视频里,镜头内部有时间流逝,镜头之间有空间和因果衔接,于是长出四个新层,合并整理为七层:
| 层级 | 控制内容 | 断掉的典型表现 | 主要来源 |
|---|---|---|---|
| 身份一致 | 五官、年龄、发型、体型 | 三号镜头换了张脸 | 视觉课已有 |
| 造型一致 | 服装、首饰、道具、产品结构 | 项链消失了;瓶身 logo 变形 | 视觉课已有 |
| 动作一致 | 姿态衔接、运动方向、行为逻辑 | 上一镜在跑,下一镜悠闲站着且无过渡 | 时间新增 |
| 空间一致 | 出入口、人物位置、视线、轴线 | 从左出画却从左入画;对话双方视线不接 | 时间新增 |
| 光线一致 | 主光方向、时段、色温 | 同场景一镜黄昏一镜正午 | 时间新增 |
| 声音一致 | 声线、环境音、空间混响 | 角色换了嗓音;室内忽然有室外风声 | 时间新增 |
| 叙事一致 | 事件顺序、因果关系 | 湿衣服下一镜干了;喝掉的咖啡又满了 | 视觉课的叙事层扩展 |
风格层和世界观层去哪了?没消失——它们被吸收进资产系统(风格块照用),七层表专注镜头之间接不接得上这个视频特有的问题。
诊断纪律和视觉课相同:先归层,再开药。观众说"出戏了",你要能说出断的是哪一层。
资产系统九件套
视觉圣经(角色标准像、产品定妆照、风格块)继续服役,视频项目在此之上补六件。听起来多,实际上每件都是一页纸/一张图的轻量文档——它们的共同使命是:把"什么是对的"在开机前写下来,让每个镜头有处可查:
承接视觉课的三件
① 人物设定表 标准像三视图 + 文字规格(= 视觉课角色设定表)
② 产品标准视图 四视角定妆照 + 结构清单
③ 风格块 冻结的风格描述,全片提示词通用
视频新增的六件
④ 表情表 关键情绪的角色定妆图——表演镜头的首帧原料
⑤ 服装道具表 每套造型/每件关键道具的标准图 + 出场镜头清单
⑥ 场景地图 场景的简笔平面图:门窗方位、家具位置、人物动线
——空间层的宪法,手绘拍照即可
⑦ 光线方向图 在场景地图上标注主光来向 + 时段色温
——同场景所有镜头共用
⑧ 声音规范 角色声线描述、环境音清单、配乐情绪关键词
⑨ 连续性表 逐镜状态记录(下一节专讲)
⑥ 和 ⑦ 值得强调:空间和光线是最容易被忽略、又最容易被观众潜意识捕捉的断层。一张手绘平面图+一个光源箭头,成本两分钟,却是"轴线标注"(L2)和"光线连续"唯一可靠的执行依据——靠脑子记,第四个镜头必乱。
连续性表:百年老工具的 AI 复活
传统剧组有个职位叫场记(script supervisor),全职盯一件事:这条拍完,记下演员左手还是右手拿杯子、烟烧到几厘米——因为下一条可能三天后才拍,接不上就是穿帮。
AI 生产里你就是场记。每生成完一个镜头,趁记忆新鲜填一行:
连续性表 —— 项目:晨跑者 30 秒
镜号 | 人物状态 | 位置/方向 | 光线 | 道具状态
镜1 | 马尾辫/浅灰运动服 | 远景,向右跑 | 晨光低角度左来 | 耳机戴着
镜2 | 同上,微出汗 | 中景,向右 | 同上 | 同上
镜3 | 同上 | 近景,面朝右 | 同上 | 耳机线可见
镜4 | 停步,转头看右 | 路口,视线向右 | 同上 | 抬腕看表→表在左腕
它的用法是双向的:生成前查上一行(镜 5 的提示词就知道该写"左腕戴表、从画面右侧入画");验收时对本行(生成结果和表格不符=返工或改表)。AI 的特殊之处在于模型完全没有跨镜头记忆,连续性表是唯一的"项目记忆体"——这正是 L1 原则三"提示词不是唯一控制手段"的又一实例:表格也是控制条件。
生产流程:圣经先行,首帧派生
把资产系统接进 unit-1 学过的图生视频主力工作流,就得到视频版的一致性生产线:
① 建资产 九件套开工前做齐(图像工作流制作,成本集中在前期)
② 首帧派生 每个镜头的首帧 = 角色/产品参考图 + 风格块 + 场景地图
约束下的构图 —— 用视觉课全套技能在图像阶段锁定一致性
③ 镜头生成 图生视频(L4),提示词只写运动,方向按场景地图/轴线
④ 逐镜验收 七层各扫一眼 + 对照连续性表本行 + 验尾帧(L4)
⑤ 填表推进 合格 → 填连续性表下一行,进入下一镜
核心洞察在 ②:视频的一致性问题,大头要在图像阶段解决。首帧对了(同一张脸、同一件衣服、光从同一边来),视频模型只需要"别在几秒内跑偏"(L4 的漂移管理);首帧就不一致,后面全是无用功。这就是两个 Track 共享地基的设计意图——视觉课的一致性功夫,在视频里全额兑现。
注意
一个降本技巧再强调一次(L2 提过):主动减少场景和角色数量。每多一个场景=多一套地图/光线图/首帧组;每多一个角色=多一套设定表+每镜多一个漂移源。30 秒短片 2 个场景 1 个主角是舒适区——职业制作的「省钱」和创作上的「克制」在 AI 生产里是同一件事。
动手任务:四镜头连续片段
把 unit-1 毕业作业升级为"有资产系统撑腰"的版本:
基础路线(约 90 分钟):
- 沿用你 30 秒项目的主角和主场景,补齐轻量版资产包:人物设定表(正/侧面标准像+文字规格)、一张手绘场景地图(标注门窗、动线、主光方向箭头)、冻结风格块;
- 选连续的 4 个镜头(必须含至少一次"人物在场景中移动"+一次景别变化),先把 4 个首帧全部用"参考图+风格块"派生出来,四帧并排质检(视觉课 L6 的并排法)通过后再进入视频生成;
- 逐镜生成,每完成一镜立刻填连续性表一行,下一镜生成前先查表;
- 拼接四镜,交付:资产包、连续性表、成片;
- 复盘:对照七层表逐层给自己的片段打分(每层:稳/偶尔断/明显断),找出最弱的一层——它就是你 unit-2 后半程的重点。
进阶路线(可选):把镜 2 故意不带参考图重新生成一次,插回成片对比——直观感受资产系统到底值多少钱。
随堂测验
1. 成片里角色从画面左侧走出画,下一镜却又从左侧走入画,观众感觉她「瞬移折返」了。断的是七层里的哪层,该查哪件资产?
2. 连续性表在 AI 工作流里被称为「唯一的项目记忆体」,根本原因是?
3. 「视频的一致性问题,大头要在图像阶段解决」的含义是?
4. 预算紧张时,「把剧本从 4 个场景砍到 2 个」在一致性工程上的收益是?
划选正文任意文字可高亮、批注或加入复习卡
讨论
载入中…