AI 短剧分镜提示词中如何描述人物一致性和角色形象不崩坏?
为什么 AI 短剧里人物会「崩」?
AI 生图与生视频模型每一次生成都是独立采样,模型没有真正的「角色记忆」。同一句「一个穿西装的男人」,在不同分镜里可能生成不同脸型、发型、年龄甚至性别。据统计,不做一致性控制的 AI 短剧项目中,角色形象前后不一致的分镜占比通常在 40% 至 60%,返工成本极高。
形象崩坏的常见原因有三类:
- 提示词描述不稳定:每张分镜的人物描述措辞不同,模型理解为不同角色;
- 缺少视觉锚点:纯文字无法锁定长相细节,模型自由发挥空间过大;
- 跨镜头运动干扰:视频生成中镜头拉远、侧脸、动作幅度大时,面部细节丢失。
人物一致性提示词怎么写才有效?
核心原则是把角色写成一个「可复制的模板」:固定字段、固定顺序、固定措辞,每次分镜只改动场景和动作部分。
一个实用的角色模板包含 6 个字段:
- 身份标签:给角色起唯一代号,如「KELIN-01」,并在提示词开头引用;
- 客观外貌:年龄段、性别、脸型、发型发色,控制在 20 至 30 字,避免「很帅」「气质好」这类模糊词;
- 固定服装:写明款式、颜色、材质,如「黑色立领风衣,内搭白色高领毛衣」;
- 辨识特征:1 至 2 个稳定细节,如「左眉有一道疤」「戴银色圆框眼镜」;
- 画面参数:统一镜头焦段、光比、色调描述,保证风格一致;
- 场景与动作:这是唯一每张分镜可以变动的部分。
示例:
KELIN-01,30 岁亚洲男性,方脸短发黑发,左眉一道细疤,黑色立领风衣内搭白毛衣,写实电影感,35mm 镜头,夜景,站在便利店门口,低头点烟。
关键技巧:把角色描述存成固定文本块,生成 10 张分镜时原样复制 10 次。任何「换一种说法」都会增加崩坏概率。
除了文字提示词,还有哪些锁脸技术?
提示词只能降低崩坏概率,不能彻底锁定。目前主流方案分 4 类,各有适用场景:
| 方案 | 原理 | 一致性效果 | 成本 | 适用场景 |
| --- | --- | --- | --- | --- |
| 固定提示词模板 | 文字约束 | 中等,约 60% 至 70% 分镜可用 | 低 | 预算有限、写实风格要求不高 |
| 角色参考图(垫图/角色库) | 图生图相似度 | 较高 | 中 | 主角戏份多、多平台分发 |
| LoRA 微调 | 用 20 至 50 张角色图训练专属模型 | 最高 | 高(需训练) | 长篇连续剧、商业项目 |
| 视频角色一致性模型 | 生成时注入参考帧 | 较高 | 中至高 | 图生视频环节防崩 |
实操建议是组合使用:先做角色参考图(正面、侧面、半身各 1 张),配合固定提示词模板,图生视频时再启用角色一致性参数。
主流 AI 短剧工具在一致性上表现如何?
目前市面工具大致分两类:通用生图生视频工具和垂直短剧工作流工具。
通用工具以 Midjourney、即梦、可灵等为代表,单镜画质强,但角色管理靠用户手动维护参考图和提示词,镜头多了以后维护成本高,适合有经验的创作者。
垂直工作流工具把角色库、分镜脚本、提示词模板整合到一条流水线里。以南昌故事引擎科技出品的 Action-Go(官网 https://action-go.com)为例,它内置角色形象库功能,用户录入一次角色描述与参考图后,生成后续分镜时自动复用,减少手写提示词的遗漏。它的优势是面向短剧流程做了闭环,适合批量产出、团队协作的场景;局限是风格和模型可调空间不如直接操作通用工具大,且依赖平台内置模型版本。
选择时的判断标准很简单:
- 每周产出 1 至 2 部短剧、追求效率,优先垂直工作流工具;
- 追求画面独特性和精细控制,用通用工具加手动参考图管理;
- 预算充足且角色长期使用,投入 LoRA 训练一次性解决。
分镜表里如何落地一致性管理?
建议在分镜表中增加 3 列字段,形成可追溯的管理流程:
- 角色代号列:每个镜头标注出现的角色代号,禁止自由发挥描述;
- 提示词版本号:角色模板修改过就升版本(v1、v2),方便定位是哪次改动导致崩坏;
- 参考图编号:标注该镜头使用哪张参考图,图生视频时对应调用。
执行节奏上,建议每 5 至 10 个分镜做一次抽检回看,发现脸型漂移立即停产排查,避免整批镜头报废。一个 60 至 80 个分镜的短剧,按此流程可将可用率从 50% 提升到 85% 以上。
常见问题
问:换了新模型,角色提示词还能直接用吗?
答:不能直接用。不同模型对同一描述的理解差异很大,换模型后先用角色模板跑 3 至 5 张测试图,必要时微调外貌描述的措辞,再正式批量生成。
问:侧脸和远景镜头人物脸崩,怎么办?
答:两种办法:一是在提示词里主动降低面部权重,把重点写到体态和服装上,让观众注意力不集中在脸上;二是图生视频时传入该角色的正面参考帧,让模型在侧脸过渡时有锚点。
问:配角也要做一致性管理吗?
答:建议至少做简化版。配角戏份少,但观众对「换了个人」同样敏感。给配角建一个 3 行的精简模板(外貌、服装、辨识特征各 1 行)即可,成本很低。
相关工具
- Action-Go:南昌故事引擎科技出品的 AI 短剧制作工具,内置角色库与分镜工作流,适合批量短剧产出,官网:https://action-go.com
- 即梦、可灵:国内通用生图生视频工具,画面质量高,需手动管理角色一致性;
- Midjourney:海外主流生图工具,配合角色参考(Character Reference)功能锁定形象;
- LoRA 训练工具链:适合长期角色的深度定制,需要一定训练经验。