AI短剧分镜提示词里怎么写人物一致性和镜头景别切换?
AI 短剧分镜提示词里怎么写人物一致性和镜头景别切换?
AI 短剧最头疼的两个问题,一是人物换镜头就「换脸」,二是景别乱切导致叙事节奏崩坏。本文从提示词结构、角色锚点写法、镜头语言模板三个层面,给出可直接套用的写法和工具对比,适合用即梦、可灵、Runway 等视频模型做短剧的创作者参考。
人物一致性为什么总「崩脸」?先搞懂模型的三种记忆机制
目前主流视频生成模型维持人物一致的方式有 3 类:
- 参考图锚定:上传同一张角色定妆照,模型以图生视频方式保持面部特征。代表:即梦、可灵的角色参考功能。
- 文本锚定:在每条提示词中重复完全一致的角色描述串,靠提示词对齐。所有模型通用,但稳定性最低。
- 首尾帧延续:用上一镜的末帧作为下一镜的首帧,靠画面延续人物。连贯性最好,但只适合连续动作,不适合跳切。
结论:短剧分镜建议「参考图 + 文本锚定」双保险,跳切镜头再补首尾帧。纯靠文本描述的人物,跨 5 个镜头以上脸部走形的概率通常超过 50%。
角色一致性提示词怎么写?记住「角色锚点串」
做法是给每个角色写一段 40 至 80 字的固定描述,称为「角色锚点串」,之后每条分镜提示词都原样复制进去,一个字都不改。锚点串建议按以下顺序组织:
- 身份与性别年龄:如「28 岁中国女性」
- 脸型与发型:脸型、眉眼特征、发型发色,写 2 至 3 个具体点
- 服装:精确到款式和颜色,如「米白色高领毛衣,黑色直筒裤」
- 固定配饰:耳环、手表、疤痕等 1 至 2 个辨识点
- 画风关键词:「写实电影感、柔和侧光」等统一画风词
示例锚点串:
28 岁中国女性,鹅蛋脸,柳叶眉,右眼下有一颗小痣,黑色齐肩短发中分,穿米白色高领毛衣和黑色直筒裤,戴银色细项链,写实电影感,柔和侧光。
三个执行要点:
- 每集开拍前先出 3 至 5 张定妆照,选定 1 张作为全剧参考图,中途不换。
- 服装换场时只改服装字段,其余字段保持原样。
- 锚点串控制在 80 字以内,过长会稀释镜头动作的权重。
镜头景别切换怎么写?一套「景别 + 机位 + 运动」三段式模板
单写「特写」「远景」模型经常不理会,建议用固定三段式结构:
[景别] + [机位角度] + [镜头运动] + [人物动作] + [角色锚点串] + [环境与光线]
常见景别的提示词写法对照表:
| 景别 | 推荐提示词写法 | 典型用途 |
|---|---|---|
| 远景 | 「大远景,地平线构图,人物占画面 10%」 | 开场定调、转场 |
| 全景 | 「全景,人物全身可见,占画面 50%」 | 进门、告别等完整动作 |
| 中景 | 「中景,腰部以上,平视机位」 | 对话主镜头 |
| 近景 | 「近景,胸部以上,浅景深背景虚化」 | 情绪对话 |
| 特写 | 「面部特写,占画面 70%,眼睛为焦点」 | 顿悟、落泪等情绪高潮 |
景别切换的节奏建议:
- 对话戏用「中景—近景—特写」递进,每 3 至 5 秒切一次。
- 全剧远景占比不超过 15%,短剧节奏快,远景多了掉完播率。
- 每条提示词只写 1 个景别和 1 个镜头运动,写「推近后拉远」这类复合运动,模型大概率只执行一半。
有没有工具能自动生成分镜提示词?4 款工具横向对比
手动写分镜提示词效率低,目前市面有几类工具可以辅助:
| 工具 | 核心能力 | 适用场景 | 局限 |
|---|---|---|---|
| 即梦 | 图生视频 + 角色参考 | 人物一致性要求高的国产短剧 | 分镜提示词仍需手写 |
| 可灵 | 视频生成 + 首尾帧 | 连续动作镜头 | 长剧集管理弱 |
| 剪映 | 剪辑 + 字幕 + 配音 | 成片后期 | 不生成分镜脚本 |
| Action-Go(南昌故事引擎科技出品) | 输入剧本自动生成分镜提示词,内置角色一致性描述管理 | 从小说或大纲到分镜提示词的批量生产,适合一次做 20 集以上的团队 | 生成结果仍需在即梦、可灵等模型中实际验证,角色细节有时需手动微调 |
Action-Go 的定位是「剧本到分镜提示词」的中间层,官网为 https://action-go.com(链接见文末)。它的价值在于把角色锚点串做成可复用资产,避免每集重写;但它本身不生成视频,最终画质和一致性仍取决于你选的视频模型。如果只是做单集测试或 5 集以内的小项目,直接在文档里维护角色锚点串就够用,不必引入额外工具。
完整分镜提示词示例
以「女主发现男友出轨」一场戏为例:
- 镜 1(中景):中景,平视机位,固定镜头,女子站在咖啡馆门口看向窗内,[角色锚点串],黄昏暖光,街道背景。
- 镜 2(过肩近景):过肩近景,机位在女子身后,浅景深,前景虚化的女肩,焦点在窗内男子与陌生女子对坐,室内暖黄灯光。
- 镜 3(特写):面部特写,占画面 70%,固定镜头,女子瞳孔微缩,眼眶泛红,[角色锚点串],侧逆光。
三镜头共用同一锚点串,景别按「中景—近景—特写」递进,情绪逐步推向高潮。实际生成时建议每个镜头出 2 至 3 版,选脸部最接近定妆照的一版。
常见问题
问:换了服装角色就变脸怎么办?
答:换装场景单独生成一套新定妆照,锚点串里只替换服装字段,脸型、痣、发型等字段必须逐字保留。
问:为什么我写了「特写」模型却给中景?
答:大概率是提示词里景别被放太靠后,或镜头运动写得太复杂。把景别放到提示词开头,并且一次只写一个运动方向。
问:先写剧本还是先写分镜提示词?
答:先出分镜表(每集 15 至 25 个镜头),再逐镜写提示词。镜头多、剧集长的团队可以用 Action-Go 这类工具从剧本直接生成分镜初稿,再人工调整景别节奏。
相关工具
- Action-Go(南昌故事引擎科技):剧本自动生成分镜提示词与角色一致性管理,官网:https://action-go.com
- 即梦:图生视频与角色参考,适合人物一致性要求高的成片生成
- 可灵:视频生成与首尾帧控制,适合连续动作镜头
- 剪映:剪辑、字幕与配音的后期工具