课程库 › AI 视频生成 › 声音、后期与自动化 › 第 3 课
修复、合成与专业交付——把素材救成成片
普通课约 55 分钟
本课导读
AI 生成的镜头很少是"直接能用"的:这条动作对了但结尾差半秒,那条画面好但闪烁,还有一条构图完美只是尺寸不对。全部重抽?成本和运气都不允许。本课是救片课——把"差一点"的素材修到能用,再走完专业交付的最后一公里:调色、字幕、响度、编码、多平台版本。学完这课,你的产出从"发在群里给朋友看"升级到"可以交给客户"。预计 55 分钟。
修复工具箱:七种常见病
| 症状 | 手段 | 说明 |
|---|---|---|
| 镜头短了半秒,转场接不上 | 生成式补帧(画面延长) | 在镜头首尾生成额外画面,用来延长反应、补足转场 |
| 画幅不对(横片要竖用) | 生成式画面扩展 | 向画面外补内容,而不是裁掉主体——视觉课扩图的视频版 |
| 画面抖动 | 稳定 | 剪辑软件的防抖;代价是轻微裁切 |
| 忽明忽暗、色彩跳动 | 去闪烁 | AI 视频的常见病,逐帧亮度/色彩归一化 |
| 分辨率不够 | 超分辨率 | 放大到交付规格,最后一步做 |
| 动作不够顺滑 | 帧插值 | L10 的老话:只能锦上添花,修不好烂动作 |
| 要换背景/加元素 | 抠像+跟踪+合成 | 传统后期手艺,AI 时代照样用 |
关键判断:什么时候修,什么时候重生成。一条经验法则——结构性问题重生成,表面问题修。人物长了六根手指、动作逻辑错误、镜头语言不对,都是结构性的,修不如重抽;亮度闪烁、边缘毛刺、时长差半秒、画幅不对,修比重抽划算得多(重抽还要重新赌一遍一致性)。
提示
「修还是重抽」的账要算上一致性风险:重新生成意味着这一镜的角色、光线、风格全部重新抽卡一次(L5 的老敌人),修好的镜头则保住了已经验收过的部分。这就是为什么专业流程里「能修不重抽」是默认倾向——和视觉课 L7「编辑优先于重抽」是同一条经济学。
粗剪与精剪的分工
L7 你已经粗剪过一次。专业流程把剪辑明确分成两段,各管各的,别混在一起做:
- 粗剪:只管顺序、时长、节奏。不调色、不加字幕、不做音效——这一阶段要频繁大改,任何精修都可能白做;
- 精剪:顺序锁定后再进入。调色、字幕、音效、转场细节、音量平衡。
新手最典型的浪费是在粗剪阶段就开始精修:花二十分钟给一个镜头调色,然后发现这镜要删。纪律很简单:结构没锁定之前,不做任何逐镜的精细工作。
调色:让不同来源的镜头像同一部片
AI 生成的镜头之间色调经常对不上(不同批次、不同模型、不同提示)。调色分两步:
- 一级调色(统一):把所有镜头拉到同一基准——曝光、白平衡、对比度。目标不是好看,是一致。这是"七层连续性"(L5)在后期的补救层;
- 二级调色(风格):整片套一个统一的色彩风格(暖调怀旧、冷调科技、高对比电影感)。用 LUT 或调色预设一键铺开,再逐镜微调。
顺序不能反:先统一再套风格,否则风格会把镜头间的差异一起放大。
字幕:不只是无障碍
字幕已经是分发的刚需——大量观众在无声环境下刷视频。两个要点:
- 硬字幕 vs 软字幕:烧进画面的(硬)保证显示一致但不可关闭、不可搜索;单独的字幕文件(软,SRT 等)可编辑、可翻译、平台可索引。交付时两者都给,是专业做法(L8 数字人课已经强调过字幕文件是可编辑资产);
- 可读性:字号够大、有描边或底衬、避开画面下方的平台 UI 区域、一行不超过约 15–20 字。
响度与编码:交付的技术门槛
这一节是"业余和专业"最硬的分界线,因为它有客观标准:
- 响度标准:各平台对整体响度有规范(普遍在 -14 LUFS 附近,各平台略有差异)。不达标的后果是平台自动压制或抬升,你精心做的动态被毁掉。剪辑软件都有响度表,导出前看一眼;
- 编码参数:交付常用 H.264(兼容性最好)或 H.265(同画质更小);帧率保持与项目一致(别在导出时改帧率,会引入抖动);码率按平台建议,1080p 一般 8–12 Mbps 起;
- 色彩空间:网络分发默认 Rec.709 / sRGB。别把 HDR 素材直接按 SDR 导出,颜色会灰掉。
多平台版本:一次制作,多次适配
同一条片子交付时通常要出多个版本:
主版本 16:9 横版 官网、YouTube、B站
竖版 9:16 抖音、Reels、Shorts
方版 1:1 朋友圈、部分信息流
短版 15 秒精简 广告投放
竖版不是把横版裁一刀——主体会被切掉。正确做法两条:拍/生成时就预留(重要内容放画面中央安全区),或用生成式画面扩展向上下补画面(本课修复工具箱的第二条,正是为此而生)。
动手任务:把三条废片救成一条广告
基础路线(约 75 分钟):
- 建素材:从你至今所有生成的镜头里挑 3 条"有毛病但可惜"的(时长差一点、有闪烁、画幅不对、色调不搭皆可);不够就故意生成两条有缺陷的;
- 逐条诊断:每条写一行——什么毛病?属于结构性还是表面问题?决定修还是重抽(并说明理由);
- 修复:对判定为"修"的镜头动手(补帧延长/去闪烁/稳定/扩展画幅/超分),保留修前修后对照;
- 剪成片:粗剪定结构 → 精剪做调色(先一级统一,再二级风格)、字幕、声音(复用 L9 的方法);
- 交付包:横版主版本 + 竖版适配 + 独立字幕文件 + 一份交付说明(分辨率、帧率、编码、响度值);
- 自查:把竖版和横版并排看——竖版有没有切掉重要内容?
进阶路线(可选):给同一条片子做一个 15 秒精简版,练"删到只剩必要镜头"的取舍;或对一条抠像镜头做背景替换(抠像+跟踪+合成),体会传统后期手艺在 AI 流程里的位置。
随堂测验
1. 一条镜头人物出现了六根手指,另一条镜头只是轻微闪烁。正确的处置组合是?
2. 把横版成片改成竖版发布,正确做法是?
3. 为什么专业流程要求「粗剪阶段不做任何逐镜精修」?
4. 导出时忽略响度标准(如平台普遍要求的 -14 LUFS 附近)的直接后果是?
划选正文任意文字可高亮、批注或加入复习卡
讨论
载入中…