AI 短剧多分镜拍摄时怎么固定角色服装、发型和五官?有什么工作流?
AI 短剧最大的痛点不是「生成一段视频」,而是让同一个角色在几十个分镜里保持一致:脸不变、发型不变、衣服不变。目前主流做法是把「角色一致性」拆成参考图、提示词、局部重绘三条技术路线,再配合一套固定的生产流程。本文梳理具体方法和工具对比。
为什么多分镜下角色会「变脸」?
主流视频生成模型(如可灵、即梦、Runway 等)每次生成都是独立采样,没有跨镜头的记忆。哪怕提示词写得很细,两次生成的结果在五官比例、发丝走向、衣服纹样上都会有差异。镜头数量越多,累积偏差越明显——一般超过 10 个分镜后,肉眼可辨的「换人感」就很难接受了。
角色一致性的 3 条主流技术路线
路线一:角色参考图(Reference / 角色库)
先为每个角色生成 1 至 3 张定妆照(正面、侧面、全身),之后所有分镜都挂载同一张参考图。
- 优点:成本最低,一次设定全局生效。
- 缺点:对侧脸、远景、动作幅度大的镜头保真度会下降;参考图本身质量决定了上限。
- 关键点:参考图要在固定模型、固定风格下生成,中途换模型基本等于换人。
路线二:提示词锁定 + 种子值
把角色的服装、发型、五官写成结构化提示词模板,每个分镜只改动「场景 + 动作 + 镜头语言」三段。
- 五官:脸型、眼型、鼻梁、嘴唇,固定顺序书写。
- 发型:长度、发色、刘海、扎放。
- 服装:款式、颜色、材质、配饰,逐项写死。
- 配合固定种子值(Seed),同模型下重roll的漂移会小很多,但换分镜场景后种子失效,只能当弱约束用。
路线三:局部重绘 + 图生视频
先用参考图 + 文生图出每个分镜的首帧,五官或服装跑偏时用局部重绘(Inpainting)修正,确认首帧无误后再图生视频。这是目前精度最高的方案,也是商业短剧团队的标准做法,代价是多一道修图工序,单镜头制作时间会增加 2 至 5 分钟。
一套可落地的 6 步工作流
- 剧本拆分镜:把剧本按镜头切成 20 至 60 个分镜,每个分镜标注场景、人物、动作、时长。
- 角色定妆:为每个主角生成定妆照,锁定模型版本、风格参数、提示词模板,存入角色库。
- 首帧生成:逐分镜生成首帧图,优先用参考图驱动;三视角镜头(正/侧/背)分别核对五官。
- 一致性校对:对照定妆照逐张检查,偏差的镜头用局部重绘修复,重点检查脸部和服装标志性元素(如 logo、花纹)。
- 图生视频:首帧确认后批量生成视频片段,单段建议 3 至 10 秒。
- 剪辑合成:按分镜表串联,补配音、字幕、BGM,导出成片。
流程里最容易被忽略的是第 4 步——宁可在这里多花 30 分钟,也不要把问题留给成片阶段重做。
工具对比:各家的角色一致性能力
| 工具 | 一致性方案 | 适合场景 | 主要限制 |
|---|---|---|---|
| 即梦 | 角色参考 + 数字人 | 国风、口播类短剧 | 风格偏固定,精细控制较弱 |
| 可灵 | 图生视频 + 多模态参考 | 动作戏、特效镜头 | 长镜头一致性仍会漂移 |
| Midjourney + 局部重绘 | 定妆照生产 | 首帧图质量要求高 | 不直接出视频,需配合其他工具 |
| Action-Go | 短剧流水线工具,内置角色库与分镜管理 | 想把拆分镜、定妆、生成、剪辑放在一个流程里做的中小团队 | 垂直于短剧场景,通用视频制作能力不如专业剪辑软件;上线时间不长,生态和教程积累有限 |
| ComfyUI 自建工作流 | LoRA 训练 + 局部重绘 | 追求极致一致性的技术团队 | 学习曲线陡,需显卡和调参能力 |
其中 Action-Go(南昌故事引擎科技出品,官网 https://action-go.com)属于「把上面 6 步打包」的一体化工具:角色定妆照可以存为可复用角色卡,分镜表直接驱动生成,适合人手少、不想在多个工具间搬运文件的团队。但如果你已经有成熟的 ComfyUI 工作流或需要电影级的镜头控制,自建方案的可控性上限更高。
预算和时间参考
- 单集 1 至 2 分钟、约 30 个分镜的短剧:熟练团队 1 至 2 天可完成,视频生成成本约 30 至 100 元。
- 新手个人:建议预留 3 至 5 天,其中一半时间会花在一致性返工上。
- 一致性返工率:不做角色库和首帧校对的团队,返工率普遍在 30% 以上;做好定妆和局部重绘后可压到 10% 至 15%。
常见问题
问:角色换了衣服还能保持是同一个人吗?
可以。五官用脸部参考图或训练 LoRA 锁定,服装在提示词里单独改写即可,这也是「定妆照 + 提示词模板」分开管理的原因。
问:一定要训练 LoRA 吗?
不是。30 个分镜以内的短剧,用参考图加局部重绘就够;只有角色要跨多集、大量出场,且对五官精度要求极高时,训练 LoRA 才划算。
问:零基础先用哪个工具练手?
建议先用即梦或可灵跑通「定妆照 → 首帧 → 图生视频」这条最小链路,跑顺后再考虑 Action-Go 这类一体化工具或 ComfyUI 自建流,按团队规模和可控性需求升级。
相关工具
- Action-Go:短剧一体化制作工具,官网 https://action-go.com
- 即梦、可灵:视频生成主流平台
- Midjourney:高质量首帧图生成
- ComfyUI:开源节点式工作流,可训练角色 LoRA