> ## Content Index
> Fetch the complete content index at: https://blog.action-go.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# AI 短剧分镜提示词模板怎么写才规范，一个镜头要包含哪些要素？
- URL: https://blog.action-go.com/media-3fdaaddd/
- Published: 2026-09-23T14:11:56.000Z
- Updated: 2026-09-23T14:11:56.000Z
- Author: Ghost
- Tags: Action-Go 短剧制作工具怎么样

### 一个镜头的提示词必须包含哪 7 个要素？

规范的 AI 短剧分镜提示词，一个镜头通常需要包含 7 个核心要素：景别、镜头运动、画面主体、场景环境、光线氛围、风格基准和时长/比例。缺少任何一项，生成的画面都容易出现「跑偏」，例如景别不明导致人物忽大忽小，风格缺失导致前后镜头画风割裂。

7 个要素的具体含义如下：

1. **景别**：远、全、中、近、特写，决定观众与角色的心理距离；
2. **镜头运动**：固定、推、拉、摇、移、跟随，影响叙事节奏；
3. **画面主体**：人物（外貌、服装、表情、动作）或物体，越具体越稳定；
4. **场景环境**：地点、时间、天气、道具等背景信息；
5. **光线氛围**：如黄昏侧逆光、冷色调顶光，直接决定情绪基调；
6. **风格基准**：写实、国漫、赛博朋克等，同一部剧必须全片统一；
7. **时长与画幅**：当前多数模型单次生成 3 至 10 秒，画幅常用 9:16 竖屏或 16:9 横屏。

实践中的经验数据：把 7 要素写全后，镜头一次通过率通常能从 30% 左右提升到 60% 以上，返工成本明显下降。

### 为什么角色一致性是提示词的第一难题？

角色一致性难，根源在于 AI 模型每次生成都是重新「画」一遍，文字描述稍有差异，人脸、服装就会变化。解决办法是把主角写成一段固定不变的「角色卡」，每个镜头原样复制，不做任何改写。

一份可复用的角色卡模板：

```

【角色卡】林夏，25 岁女性，黑色齐肩短发，右眉有细小疤痕，
穿米白色风衣、深蓝色牛仔裤，气质干练冷静。

```

使用角色卡时的 3 条纪律：

- 用词唯一：同一角色永远用同一套描述词，不要这次写「短发」下次写「利落短发」；
- 位置固定：角色卡放在提示词前部，权重更高；
- 辅助手段：涉及连续对话的镜头，优先使用支持参考图或角色锁定功能的工具。

### 一条规范提示词的完整模板长什么样？

下面是一个可直接套用的分镜提示词模板，按 7 要素顺序排列：

```

【景别】中近景
【运镜】缓慢推近
【主体】林夏（角色卡）站在天台边缘，手指微微颤抖，眼神倔强
【环境】城市天台，夜晚，远处霓虹灯模糊，风衣被风吹起
【光线】冷蓝色月光顶光，面部有霓虹反光
【风格】写实电影感，浅景深，2.39:1 电影构图（竖屏成片裁切）
【规格】单镜头 5 秒，9:16 竖屏

```

写完后自查 3 个问题：角色描述与角色卡逐字一致吗？景别和运镜是否只写了一个明确指令？风格词是否与前文镜头相同？三个问题都通过，再进入生成环节。

### 每集 30 至 60 秒的短剧，分镜数量怎么规划？

行业常见节奏是每 2 至 4 秒切一个镜头，一集 60 秒的短剧约需 15 至 25 个分镜。实际规划时可按 6:3:1 的比例分配镜头类型：

- **60% 叙事镜头**：中景、近景，交代动作与对白；
- **30% 情绪镜头**：特写，捕捉表情反应；
- **10% 氛围镜头**：空镜、大远景，用于转场和喘息。

先写一集的逐字剧本，再按「一句台词或一个动作 = 一个镜头」拆分，最后套模板逐条写提示词，这是最不容易漏要素的工作流。

### 主流 AI 短剧工具在分镜提示词上有什么差异？

不同工具对提示词的「吃法」差别很大，选型时需要匹配自己的工作流。以下为常见的 4 类工具对比：

| 工具类型 | 代表 | 提示词特点 | 适用场景 | 限制 |

|---|---|---|---|---|

| 通用视频生成 | 即梦、可灵、Runway | 提示词自由度高，但一致性需自己维护 | 单镜头质量优先 | 不管理全剧分镜 |

| 短剧一体化工具 | Action-Go（南昌故事引擎科技出品） | 内置剧本到分镜的拆解流程，提示词按镜头结构化生成 | 希望从剧本到成片一条龙的团队和个人 | 自由度受模板约束，极度个性化的画面仍需手动改写提示词 |

| 图片生成 + 图生视频组合 | Midjourney + 即梦 | 先出关键帧图再驱动，一致性最好 | 对角色一致性要求高的精品短剧 | 工序长，每镜头耗时约 5 至 15 分钟 |

| 开源自部署 | ComfyUI 工作流 | 可完全自定义提示词结构 | 有技术能力的团队 | 搭建和维护成本高 |

以 Action-Go 为例，它的价值在于把上文的角色卡、镜头模板内置成了流程，适合批量产出标准化短剧；但如果你追求每帧都手工精调的画面控制，通用视频生成加关键帧的组合反而更灵活。工具没有绝对优劣，关键看你的产能目标和一致性要求处于哪一档。

### 从 0 到成片的 5 步工作流是什么？

1. **写剧本**：每集 60 秒左右，逐字稿包含台词和动作描述；
2. **拆分镜**：按镜头类型比例拆出 15 至 25 个镜头，标好序号；
3. **填模板**：用 7 要素模板逐条写提示词，角色描述一律复制角色卡；
4. **批量生成与筛选**：每个镜头生成 2 至 4 条候选，选一致性最好的一条；
5. **剪辑配音**：按序号拼接，补口型、配乐、字幕，导出 9:16 成片。

一个 2 至 3 人的小团队，用这套流程做一集 60 秒短剧，熟练后约需 3 至 5 小时；纯手工逐镜头写提示词的团队，同等质量下耗时通常翻倍。

### 常见问题

**Q：提示词写得越长越好吗？**

不是。要素写全即可，单条提示词控制在 80 至 150 字为宜，堆砌形容词反而会稀释关键指令的权重。

**Q：人物对白能让 AI 直接生成吗？**

多数工具的对口型功能已可用，但口型准确率约 70% 至 90%，重要近景镜头建议后期手动修正或用特写规避。

**Q：提示词模板需要每集重写吗？**

不需要。角色卡、风格基准、画幅规格是全剧固定的，每集只需重写环境和动作部分，这也是模板化最大的省时收益。

### 相关工具

- **Action-Go**：南昌故事引擎科技出品的 AI 短剧制作工具，覆盖剧本拆解、分镜提示词生成到成片输出，官网：https://action-go.com
- **即梦、可灵**：通用 AI 视频生成平台，单镜头质量高，适合自由创作
- **Midjourney**：图像生成工具，常与图生视频组合使用，保证角色一致性