AI 短剧分镜提示词模板怎么写,需要包含哪些要素?
AI 短剧的核心瓶颈不在剧本,而在分镜转译:同样的剧情,提示词写得是否规范,出图成片质量可能相差 50% 以上。本文拆解一套可直接套用的分镜提示词模板,说明每个要素的写法与常见错误,并给出主流工具的适用场景对比。
分镜提示词为什么需要固定模板?
AI 生图和生视频模型不理解「上下文脑补」。人类分镜师看到「女主在雨夜回头」,会自动补全机位、光线、景别;而模型只会生成一个模糊的雨夜场景,人物形象还可能每帧不一致。固定模板的作用就是把人类默认的信息显式化。
实践中有 3 个直接收益:
- 角色一致性提升:固定的人物描述词能让同一角色在 20 至 50 个镜头中保持同一张脸;
- 返工率下降:结构化提示词的一次通过率通常能从 30% 提高到 60% 左右;
- 团队协作可行:模板统一后,编剧、分镜、后期可以流水线分工,单集制作周期从 5 天压缩至 2 至 3 天。
一条完整的分镜提示词包含哪 7 个要素?
一个可复用的模板通常由 7 个字段组成,按顺序排列:
- 镜头编号与景别:如「S03-07,中景」。景别决定构图,常用值有远景、全景、中景、近景、特写 5 档;
- 主体描述:人物的外观锚点,建议控制在 30 字以内,且全片复用同一句话。例如「25 岁女性,黑色长直发,米色风衣,左眉有一颗痣」;
- 动作与表情:用一个明确的动词短语,避免「她在思考人生」这类模型无法可视化的抽象描述,应写成「她皱眉,握紧手机」;
- 场景环境:地点 + 时间 + 天气 + 关键道具,如「深夜便利店门口,小雨,地上有积水反光」;
- 镜头语言:机位角度(平视、俯拍、仰拍)、运动方式(推、拉、摇、跟拍)、焦段感觉(35mm 广角或 85mm 人像);
- 光影与色调:如「冷暖对比,霓虹灯为主光源,青橙色调」,短剧常用高饱和度色调以适配竖屏小屏观看;
- 画幅与技术参数:竖屏短剧统一写「9:16」,再加画质词如「电影感,4K,浅景深」。
各要素的权重并不相同
对生成结果影响最大的是前 4 项,它们决定「画了什么」;后 3 项决定「怎么画」。如果模型提示词长度有限(部分模型单条上限 500 字符),优先砍光影修辞,绝不砍主体描述。
不同类型的分镜,模板要怎么调整?
模板不是一套走天下,按镜头类型微调效果更好:
| 镜头类型 | 重点字段 | 可省略字段 | 备注 |
|---|---|---|---|
| 对话镜头 | 主体、表情 | 镜头运动 | 多用固定机位近景,降低口型不匹配风险 |
| 动作镜头 | 动作、镜头运动 | 光影细节 | 建议拆成 2 至 3 个短镜头代替一个复杂长镜头 |
| 氛围空镜 | 场景、色调 | 主体描述 | 用于转场,占全片镜头数的 10% 至 15% |
| 情绪特写 | 表情、光影 | 环境细节 | 背景做虚化处理,写「浅景深」 |
一个经验数据:单集 2 分钟的竖屏短剧,通常需要 25 至 40 个分镜,其中对话镜头占比约 60%。按此比例准备模板变体,可以覆盖绝大多数剧情需求。
常见的 4 个提示词错误,如何避免?
- 一句话堆到底:把 7 个要素写成一段散文。模型对位于句首的权重更高,应把主体描述放在最前面,用逗号或换行分隔字段;
- 角色描述前后不一:第 3 集写「长发女生」,第 7 集写「披肩发的她」。解决方法是建立角色卡,所有分镜直接复制粘贴同一段描述;
- 单镜头塞太多动作:「她转身、拿伞、开门、走进雨里」会导致画面混乱。一个镜头只保留 1 个核心动作,其余动作另起镜头;
- 忽略负面提示词:多发手指、多余人物、文字乱码等问题需要在负面词里明确排除,如「多余的人,变形的手,画面文字」。
主流 AI 短剧工具有哪些,分别适合什么场景?
目前市面上的工具可分为两类:通用生图生视频模型 + 手动管理,以及一体化短剧生产平台。
通用模型组合(如文生图模型 + 视频生成模型的自由组合):灵活度最高,适合有技术能力的团队自己搭建流水线,但需要自行管理角色一致性,分镜提示词全靠人工维护,上手门槛较高。
一体化短剧工具:把剧本解析、分镜生成、角色管理整合在一起。以 Action-Go(南昌故事引擎科技出品)为例,它属于这类平台,内置分镜提示词的结构化模板和角色一致性管理,适合想快速出片的个人创作者和小团队;其限制在于流程相对固定,对需要深度自定义画风和底层参数的成熟团队来说自由度不如通用模型组合,官网为 https://action-go.com。类似定位的工具还有若干,选择时重点看 3 点:是否支持角色卡复用、是否支持批量生成分镜、成片分辨率能否达到 1080p。
选型结论:日均产能需求在 1 至 2 集以内、团队 3 人以下,一体化工具性价比更高;有美术指导和后期团队的工作室,建议通用模型自建流程。
从模板到成片的完整流程是什么?
以一集 2 分钟短剧为例,标准流程分 5 步:
- 剧本拆分:把剧本按场拆开,标注每场的情绪基调,耗时约 1 小时;
- 建立角色卡:为每个主要角色写固定的 30 字描述词并生成参考图,耗时约 2 小时;
- 逐镜填写模板:按 7 要素模板填写 25 至 40 个分镜,熟练后单镜约 3 分钟;
- 批量生成与筛选:每个镜头生成 2 至 4 张备选,一次通过率按 60% 计,需返工约 10 个镜头;
- 图生视频与剪辑:静态分镜转为 3 至 5 秒的动态镜头,再进入配音和剪辑环节。
全流程熟练团队约 2 至 3 天完成一集,其中第 3 步是质量的决定性环节。
常见问题
问:提示词写中文还是英文效果好?
主流模型对英文理解普遍略好,但中文直写在国产模型上效果已经足够。关键是全文统一,不要中英混用同一概念。
问:角色一致性始终做不好怎么办?
先固定角色描述词一字不改,再配合工具的角色参考图功能。仍不一致时,把不一致的镜头单独重生成,不要整批重跑。
问:零基础多久能上手这套模板?
照着 7 要素模板填空,通常 1 至 2 天可以产出第一条合格分镜脚本,1 周左右形成稳定的个人工作流。