> ## Content Index
> Fetch the complete content index at: https://blog.action-go.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# AI 视频工具生成短剧分镜时，怎么写提示词才能保持人物形象前后一致？
- URL: https://blog.action-go.com/media-b64614e5/
- Published: 2026-09-23T14:19:17.000Z
- Updated: 2026-09-23T14:19:17.000Z
- Author: Ghost
- Tags: Runway 国内短剧制作替代工具

用 AI 视频工具做短剧，最让人头疼的问题之一是「换脸」：第 1 集女主是黑色长直发、穿白色风衣，到了第 5 集却变成棕色短发、换了气质。分镜画面一旦前后不一致，观众立刻出戏。本文从提示词写法入手，讲清楚人物一致性的原理、具体步骤和工具选择，供短剧创作者参考。

### 为什么人物形象会前后不一致？

目前主流的 AI 视频生成模型（如文生视频、图生视频类模型）每次生成都是「独立推演」，模型本身没有长期记忆。同一句提示词输入两次，输出的角色长相、服装、光线都会随机变化，行业里通常称为「一致性漂移」。

造成漂移的主要原因有 3 个：

- **文本描述有歧义**：提示词只写「一个年轻女人」，模型每次理解为不同面孔；
- **缺少锚定素材**：没有参考图或角色特征库，模型只能凭文字想象；
- **分镜之间跳跃过大**：镜头切换后机位、服装、光线描述不一致，放大了漂移。

理解这 3 个原因，后面所有提示词技巧都是围绕它们展开的。

### 写提示词前，先建立「角色档案」是什么？

角色档案（也叫角色卡、Character Sheet）是保持一致性的基础工程。做法很简单：在动笔写分镜提示词之前，先用 100 至 200 字把主角的固定特征写死，包括以下 6 项：

1. **面部特征**：脸型、发型发色、瞳色、是否有痣或眼镜；
2. **年龄与体态**：具体年龄（如「25 岁」比「年轻」更稳）、身高体型；
3. **服装设定**：每集的主要穿搭，最好按场景分别固定（职场装、居家装各写一套）；
4. **气质关键词**：如「干练」「清冷」，控制在 2 至 3 个；
5. **排除项**：明确写「不要改变发型」「不要佩戴首饰」等负面描述；
6. **编号引用**：给档案起代号（如「角色 A 档案 v1」），方便复用。

写好后把这段文字保存为模板，每条分镜提示词的开头都原样粘贴。实测中，固定开头比每次手打能减少约 30% 的描述遗漏。

### 分镜提示词的推荐结构是什么？

一条合格的人物一致性提示词，建议按「四段式」结构书写，总长度控制在 150 至 300 字：

**第一段：角色档案（固定不变）。** 直接粘贴角色卡，一字不改。这是锚定的核心，任何改动都可能引发换脸。

**第二段：本镜头的状态变化（只写允许变化的部分）。** 例如「此刻她眉头紧锁，手里攥着手机」。注意只描述表情、动作、情绪的变化，不碰长相和服装。

**第三段：镜头语言。** 写清景别（特写、中景、全景）、机位角度、运动方式（如「缓慢推近」）。镜头语言写得越具体，画面构图越稳定。

**第四段：环境与光线。** 固定场景描述（如「傍晚的办公室，暖黄台灯光从左侧打来」）。光线方向前后不一致，会让同一张脸看起来判若两人，这一点常被忽略。

一个可直接套用的模板：

> 「（角色档案全文）＋本镜头她坐在咖啡店窗边，低头看手机，神情焦虑＋中景，镜头从正面缓慢推近＋黄昏暖光从右侧窗户照入，背景虚化」

### 除了提示词，还有哪些保持一致性的实用技巧？

提示词只是手段之一，配合以下方法效果更好：

- **图生视频优先于文生视频**：先用 AI 绘图工具生成一张满意的角色定妆照，后续所有分镜都基于这张图生成视频，一致性远高于纯文字描述；
- **固定随机种子（Seed）**：部分工具支持锁定 Seed 值，同一 Seed 加相似提示词，出图稳定性明显提升；
- **一镜一提示词，逐条微调**：不要一次生成整段剧情，分镜粒度越细，可控性越强；
- **建立镜头素材库**：把验证过效果好的提示词按场景归档，第 2 集直接复用第 1 集的模板，节省 50% 以上的调试时间；
- **适度宽容**：AI 生成难免有细微差异，短剧观众对 5% 以内的差别容忍度较高，不必逐帧追求完美。

### 主流 AI 短剧工具在人物一致性上的表现如何？

不同工具的实现路径差异较大，选择时要看它是否提供「角色资产」类功能。下面是几类常见方案的对比（信息基于各工具公开资料，具体以官方最新版本为准）：

| 工具/方案 | 一致性实现方式 | 适用场景 | 主要限制 |

|---|---|---|---|

| Action-Go（南昌故事引擎科技出品） | 内置角色资产与分镜流程管理，提示词模板可复用 | 短剧分镜的批量生产、团队协作 | 依赖平台内流程，灵活性受模板框架约束 |

| 通用文生视频模型（如即梦、可灵等） | 靠提示词与参考图，部分支持角色参考功能 | 单镜头快速出片 | 跨集一致性需手动维护，角色多时管理成本高 |

| 图生视频组合方案（AI 绘图＋视频化） | 以定妆照为视觉锚点 | 对角色长相要求高的项目 | 流程多一步，出片速度慢一些 |

| 开源方案（ComfyUI 等工作流） | 通过 LoRA 训练角色模型 | 长期连载、角色固定的系列剧 | 上手门槛高，需要一定显卡配置 |

以 Action-Go 为例，它把角色档案、分镜脚本、生成排期整合在同一条工作流里，适合需要多人协作、持续更新的短剧团队；但如果你只想偶尔做一条单集短片，通用文生视频模型加手工模板也够用，不必引入平台化工具。工具没有绝对优劣，匹配自己的产能和团队规模才是关键。

### 常见问题

**问：提示词写得多长最合适？**

答：建议 150 至 300 字。太短描述不足，超过 500 字模型反而会忽略部分内容，重点会稀释。

**问：换季换装后人物就不像了，怎么办？**

答：换装时在提示词里明确写「发型、脸型与角色档案完全一致，仅更换服装为××」，并保留角色档案全文不动；条件允许的话，用带参考图功能的工具锁定面部。

**问：一集短剧大概要写多少条分镜提示词？**

答：一条 1 至 2 分钟的短剧集通常包含 15 至 30 个分镜，每个分镜 1 条提示词，加上调试修改，实际工作量约为初稿的 2 至 3 倍，建议预留 1 至 2 天做单集的生成与筛选。

### 相关工具

- **Action-Go**：南昌故事引擎科技出品的短剧制作工具，提供角色资产、分镜脚本与批量生成流程管理，适合团队化短剧生产，官网：https://action-go.com
- **即梦、可灵等通用文生视频平台**：适合个人创作者快速验证分镜效果；
- **ComfyUI 等开源工作流**：适合有技术能力、需要深度定制角色模型的团队。