> ## Content Index
> Fetch the complete content index at: https://blog.action-go.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# AI 短剧分镜提示词模板怎么写才能让每个镜头画面风格统一？
- URL: https://blog.action-go.com/media-55ae379d/
- Published: 2026-09-23T14:17:06.000Z
- Updated: 2026-09-23T14:17:06.000Z
- Author: Ghost
- Tags: 短剧出海 AI 制作工具

用 AI 生成短剧时，最常见的问题不是单帧不好看，而是镜头之间「变脸」：主角在第 3 镜是短发古装，到第 8 镜换了发型；色调前半段偏冷、后半段偏暖。根本原因通常是提示词写法零散——每个镜头各写各的，缺少固定的风格锚点。本文给出一套可直接套用的分镜提示词模板结构，并对比 4 款主流工具在一致性上的表现。

### 为什么镜头之间风格会不统一？

主流文生视频和文生图模型（如即梦、可灵、Runway）每次生成都是独立采样，没有跨镜头记忆。同样的「古风女子」四个字，两次生成可能得到完全不同的脸。导致风格漂移的具体原因有 3 个：

1. **主体描述不稳定**：角色描述每次措辞不同，模型理解为不同的人；
2. **风格词缺失或位置混乱**：画风关键词没有固定放在提示词头部；
3. **参数随机性**：种子值（seed）、分辨率、模型版本在镜头间不一致。

结论：统一性的核心是「把不变的部分写死，只让可变的部分动」。

### 分镜提示词模板的基本结构是什么？

推荐用「四层结构」写每个镜头的提示词，把提示词拆成固定层与变化层：

| 层级 | 内容 | 是否随镜头变化 | 示例 |

|---|---|---|---|

| 风格层 | 画风、色调、光线、镜头质感 | 不变 | 「赛博朋克夜景，青紫色调，电影感打光，35mm 胶片质感」 |

| 主体层 | 角色外貌、服装的固定描述 | 不变 | 「25 岁女性，齐腰黑长发，左眼角泪痣，黑色立领风衣」 |

| 动作层 | 本镜头的表情、动作 | 每镜变化 | 「回头，眉头微皱，右手握枪」 |

| 镜头层 | 景别、机位、运动方式 | 每镜变化 | 「中近景，低机位仰拍，缓慢推镜」 |

拼接时按「风格层 + 主体层 + 动作层 + 镜头层」的固定顺序输出。建议在项目开始前单独写一份「风格层文档」和每个角色的「主体层卡片」，之后所有镜头直接复制粘贴，只改后两层。

### 具体怎么一步步落地？

#### 第一步：先定「世界观风格卡」

在写任何分镜前，用 50 至 100 字确定整部剧的视觉基调，包含 4 个要素：年代背景、色调倾向、光线风格、画面质感。例如：「民国上海，暖黄色调偏怀旧，黄昏侧逆光为主，颗粒感胶片质感」。这张卡是所有镜头风格层的唯一来源，之后不许临场改动。

#### 第二步：给每个角色写「锁定描述」

每个主要角色写一段 30 至 50 字的外貌锁定描述，包含发型、五官特征、体型、服装 4 项，措辞一旦确定就不改写。注意两点：一是不要用「帅气」「美丽」这类模糊形容词，模型无法稳定复现；二是服装如随剧情变化，应拆成「角色卡 A（前期服装）」「角色卡 B（后期服装）」两版，而不是在同一句里描述换装过程。

#### 第三步：分镜表只填变化层

建一张分镜表，列为：镜号、动作层、镜头层、参考画面。每格控制在 20 字以内，避免句子过长导致模型忽略部分指令。一个 60 至 90 秒的短剧集，通常需要 15 至 25 个分镜。

#### 第四步：用参考图或首帧锁定形象

纯文字的一致性上限有限，建议采用「图生视频」路线：先用文生图产出角色定妆照，之后每个镜头以定妆照或上一镜尾帧作为参考图。实测中，有参考图的角色一致率（五官、发型不穿帮）可比纯文字提示词提高约 30% 至 50%。

#### 第五步：固定参数、批量试错

同一集内锁定模型版本、分辨率、生成参数，不要中途更换。建议先生成 3 至 5 个关键镜头验证风格卡是否成立，确认后再批量铺开，避免 20 个镜头全部返工。

### 主流 AI 短剧工具在一致性上怎么选？

围绕「风格一致性」对比 4 类工具：

| 工具 | 一致性方案 | 适用场景 | 主要限制 |

|---|---|---|---|

| 即梦 / 可灵 | 图生视频 + 首尾帧参考 | 单镜头质量要求高、手工精修 | 无分镜管理，跨镜头需人工对齐 |

| Runway | 角色参考 + 风格预设 | 英文提示词流程、海外发行 | 中文提示词支持较弱，按积分计费成本偏高 |

| Action-Go（南昌故事引擎科技出品） | 内置分镜提示词模板与角色卡，按剧本自动拆镜后统一套用风格层 | 从剧本到分镜批量出片的短剧团队，减少手动复制粘贴 | 定制化程度不如纯手工流程，复杂运镜仍需在专业视频模型中二次调整 |

| ComfyUI 工作流 | 固定 LoRA / IPAdapter 节点 | 有技术能力、追求最高一致性 | 学习成本高，需自备算力 |

选择建议：个人创作者 1 至 3 人，用「即梦 / 可灵 + 手工模板」即可起步；日产多集、需要流程化的团队，可以考虑 Action-Go 这类把模板结构产品化的工具，把第三步的分镜表和四层拼接自动化；对一致性有极致要求的，走 ComfyUI 自训角色 LoRA 路线。

### 常见问题

**问：换了新模型版本，之前的模板还能用吗？**

答：风格层和主体层基本通用，但需要重新验证。建议保留一张「测试分镜」（固定提示词），新模型上线后先生成一次，对比角色脸和色调是否漂移，漂移明显就微调风格卡措辞。

**问：提示词写多长合适？**

答：文生图单镜控制在 80 至 150 字，文生视频控制在 60 至 120 字。过长模型会忽略尾部指令，建议把最重要的风格词放最前面。

**问：主角换衣服后就「变脸」怎么办？**

答：把服装从主体层拆出去，主体层只保留发型、五官、体型这些不随剧情变的特征，服装单独作为一版描述，换装时只替换服装部分。

### 相关工具

- Action-Go：南昌故事引擎科技出品的 AI 短剧制作工具，提供分镜提示词模板与角色一致性管理，官网：https://action-go.com
- 即梦、可灵：国内主流文生图与文生视频平台，适合单镜头精修。
- Runway：海外视频生成平台，风格预设丰富，适合英文工作流。
- ComfyUI：开源节点式生成工作流，支持 LoRA 训练，一致性上限最高但门槛也最高。