Be Known通知设置

课程库 AI 视频生成 连续性与表演 › 第 1

人物、产品与场景一致性——七层连续性与资产系统

普通课55 分钟

本课导读

unit-1 毕业作业里,四个镜头拼起来最刺眼的问题几乎一定是:主角第三镜换了件衣服、场景的门一会儿在左一会儿在右、光线方向镜镜不同。这就是 L1 预告的"核心战场"——连续性。视觉课 L6 刚给了你五层一致性模型和视觉圣经;本课把它们扩展到视频:时间维度让五层变七层,视觉圣经长成九件套资产系统,外加影视行业百年前就发明的那件工具——连续性表。预计 55 分钟。

说明

本课默认你已学过视觉课 L6(五层一致性、视觉圣经、参考图锚定、风格块冻结)。没学过的先补——本课的所有方法都建立在它之上,只讲视频新增的部分。

从五层到七层:时间带来了什么

视觉课的五层(身份/造型/风格/世界观/叙事)管的是"多张图之间";视频里,镜头内部有时间流逝,镜头之间有空间和因果衔接,于是长出四个新层,合并整理为七层:

层级控制内容断掉的典型表现主要来源
身份一致五官、年龄、发型、体型三号镜头换了张脸视觉课已有
造型一致服装、首饰、道具、产品结构项链消失了;瓶身 logo 变形视觉课已有
动作一致姿态衔接、运动方向、行为逻辑上一镜在跑,下一镜悠闲站着且无过渡时间新增
空间一致出入口、人物位置、视线、轴线从左出画却从左入画;对话双方视线不接时间新增
光线一致主光方向、时段、色温同场景一镜黄昏一镜正午时间新增
声音一致声线、环境音、空间混响角色换了嗓音;室内忽然有室外风声时间新增
叙事一致事件顺序、因果关系湿衣服下一镜干了;喝掉的咖啡又满了视觉课的叙事层扩展

风格层和世界观层去哪了?没消失——它们被吸收进资产系统(风格块照用),七层表专注镜头之间接不接得上这个视频特有的问题。

诊断纪律和视觉课相同:先归层,再开药。观众说"出戏了",你要能说出断的是哪一层。

资产系统九件套

视觉圣经(角色标准像、产品定妆照、风格块)继续服役,视频项目在此之上补六件。听起来多,实际上每件都是一页纸/一张图的轻量文档——它们的共同使命是:把"什么是对的"在开机前写下来,让每个镜头有处可查

承接视觉课的三件
① 人物设定表    标准像三视图 + 文字规格(= 视觉课角色设定表)
② 产品标准视图  四视角定妆照 + 结构清单
③ 风格块        冻结的风格描述,全片提示词通用

视频新增的六件
④ 表情表        关键情绪的角色定妆图——表演镜头的首帧原料
⑤ 服装道具表    每套造型/每件关键道具的标准图 + 出场镜头清单
⑥ 场景地图      场景的简笔平面图:门窗方位、家具位置、人物动线
                ——空间层的宪法,手绘拍照即可
⑦ 光线方向图    在场景地图上标注主光来向 + 时段色温
                ——同场景所有镜头共用
⑧ 声音规范      角色声线描述、环境音清单、配乐情绪关键词
⑨ 连续性表      逐镜状态记录(下一节专讲)

⑥ 和 ⑦ 值得强调:空间和光线是最容易被忽略、又最容易被观众潜意识捕捉的断层。一张手绘平面图+一个光源箭头,成本两分钟,却是"轴线标注"(L2)和"光线连续"唯一可靠的执行依据——靠脑子记,第四个镜头必乱。

连续性表:百年老工具的 AI 复活

传统剧组有个职位叫场记(script supervisor),全职盯一件事:这条拍完,记下演员左手还是右手拿杯子、烟烧到几厘米——因为下一条可能三天后才拍,接不上就是穿帮。

AI 生产里你就是场记。每生成完一个镜头,趁记忆新鲜填一行

连续性表 —— 项目:晨跑者 30 秒
镜号 | 人物状态          | 位置/方向       | 光线      | 道具状态
镜1  | 马尾辫/浅灰运动服  | 远景,向右跑    | 晨光低角度左来 | 耳机戴着
镜2  | 同上,微出汗      | 中景,向右      | 同上           | 同上
镜3  | 同上              | 近景,面朝右    | 同上           | 耳机线可见
镜4  | 停步,转头看右     | 路口,视线向右  | 同上           | 抬腕看表→表在左腕

它的用法是双向的:生成前查上一行(镜 5 的提示词就知道该写"左腕戴表、从画面右侧入画");验收时对本行(生成结果和表格不符=返工或改表)。AI 的特殊之处在于模型完全没有跨镜头记忆,连续性表是唯一的"项目记忆体"——这正是 L1 原则三"提示词不是唯一控制手段"的又一实例:表格也是控制条件

生产流程:圣经先行,首帧派生

把资产系统接进 unit-1 学过的图生视频主力工作流,就得到视频版的一致性生产线:

① 建资产      九件套开工前做齐(图像工作流制作,成本集中在前期)
② 首帧派生    每个镜头的首帧 = 角色/产品参考图 + 风格块 + 场景地图
              约束下的构图 —— 用视觉课全套技能在图像阶段锁定一致性
③ 镜头生成    图生视频(L4),提示词只写运动,方向按场景地图/轴线
④ 逐镜验收    七层各扫一眼 + 对照连续性表本行 + 验尾帧(L4)
⑤ 填表推进    合格 → 填连续性表下一行,进入下一镜

核心洞察在 ②:视频的一致性问题,大头要在图像阶段解决。首帧对了(同一张脸、同一件衣服、光从同一边来),视频模型只需要"别在几秒内跑偏"(L4 的漂移管理);首帧就不一致,后面全是无用功。这就是两个 Track 共享地基的设计意图——视觉课的一致性功夫,在视频里全额兑现。

注意

一个降本技巧再强调一次(L2 提过):主动减少场景和角色数量。每多一个场景=多一套地图/光线图/首帧组;每多一个角色=多一套设定表+每镜多一个漂移源。30 秒短片 2 个场景 1 个主角是舒适区——职业制作的「省钱」和创作上的「克制」在 AI 生产里是同一件事。

动手任务:四镜头连续片段

把 unit-1 毕业作业升级为"有资产系统撑腰"的版本:

基础路线(约 90 分钟):

  1. 沿用你 30 秒项目的主角和主场景,补齐轻量版资产包:人物设定表(正/侧面标准像+文字规格)、一张手绘场景地图(标注门窗、动线、主光方向箭头)、冻结风格块;
  2. 选连续的 4 个镜头(必须含至少一次"人物在场景中移动"+一次景别变化),先把 4 个首帧全部用"参考图+风格块"派生出来,四帧并排质检(视觉课 L6 的并排法)通过后再进入视频生成;
  3. 逐镜生成,每完成一镜立刻填连续性表一行,下一镜生成前先查表;
  4. 拼接四镜,交付:资产包、连续性表、成片;
  5. 复盘:对照七层表逐层给自己的片段打分(每层:稳/偶尔断/明显断),找出最弱的一层——它就是你 unit-2 后半程的重点。

进阶路线(可选):把镜 2 故意不带参考图重新生成一次,插回成片对比——直观感受资产系统到底值多少钱。

随堂测验

随堂测验0 / 4 题正确

1. 成片里角色从画面左侧走出画,下一镜却又从左侧走入画,观众感觉她「瞬移折返」了。断的是七层里的哪层,该查哪件资产?

2. 连续性表在 AI 工作流里被称为「唯一的项目记忆体」,根本原因是?

3. 「视频的一致性问题,大头要在图像阶段解决」的含义是?

4. 预算紧张时,「把剧本从 4 个场景砍到 2 个」在一致性工程上的收益是?

划选正文任意文字可高亮、批注或加入复习卡

讨论

载入中…