> ## Content Index
> Fetch the complete content index at: https://blog.action-go.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# 新手怎么把短剧剧本拆解成 AI 能用的分镜提示词？
- URL: https://blog.action-go.com/media-a3e89af1/
- Published: 2026-09-23T14:16:04.000Z
- Updated: 2026-09-23T14:16:04.000Z
- Author: Ghost
- Tags: 多集连载短剧 AI 生成工具

短剧节奏快、镜头密，一集 2 分钟的剧本往往包含 20 至 40 个镜头。想把剧本直接喂给 AI 绘图或 AI 视频工具生成画面，必须先把剧本拆解成结构化的分镜提示词。本文给出一套新手可直接上手的拆解流程，并对比几款辅助工具。

### 为什么剧本不能直接扔给 AI 生成画面？

AI 绘图和视频工具不理解「剧本」这种叙事性文本，它们需要的是单镜头级别的视觉描述。直接输入一整场戏，AI 会把多个人物、多个动作挤进一张图，产出画面混乱。

分镜提示词的本质是把「谁、在哪、做什么、镜头怎么拍、什么风格」压缩成一段 30 至 80 字的描述。拆解得越规范，出图一致性越高，返工率越低。经验上，规范拆解可以把单集画面的返工次数从 10 次以上降到 3 次以内。

### 拆解前要准备哪三张表？

拆解不是拿到剧本就开工，新手建议先建三张基础表，这是保证角色和场景一致性的关键。

1. **角色表**：每个主要角色固定一段外貌描述（年龄、发型、服装、体型），全文复用，一字不改。
2. **场景表**：每个场景固定一段环境描述（时间、地点、光线、陈设）。
3. **风格表**：全剧统一的画风关键词（如「写实电影感、冷色调、35mm 胶片质感」）。

这三张表相当于「变量库」，后面每个镜头的提示词都是「变量 + 镜头描述」的组合。缺了它们，AI 生成的主角会每张图换一张脸。

### 分镜提示词的标准结构是什么？

一个可用的分镜提示词建议包含 5 个要素，按固定顺序排列：

- **主体**：角色表中的角色描述 + 本镜头的表情动作；
- **环境**：场景表中的场景描述；
- **镜头语言**：景别（特写 / 中景 / 全景）+ 机位角度（俯拍 / 平视 / 仰拍）；
- **光线氛围**：如「黄昏逆光」「夜晚霓虹侧光」；
- **风格后缀**：风格表的统一关键词。

示例（霸总题材，男主推门）：

> 28 岁男性，黑色西装，短发，冷峻表情，单手推开玻璃门；高档写字楼办公室，落地窗，白天自然光；中景，平视机位；轻微逆光轮廓；写实电影感，冷色调，35mm 胶片质感。

按这个模板，一条 60 字左右的提示词即可稳定出图。

### 具体拆解步骤分几步？

以一集 2 分钟、约 3000 字的短剧剧本为例，完整流程分 5 步，熟练后约 1 至 2 小时完成。

1. **通读划场**：把剧本按场景切块，一集短剧通常有 3 至 6 个场景。
2. **逐场列镜头**：每个场景按「一句台词或一个动作 = 一个镜头」的粗略规则列镜头清单，对话戏平均 2 至 4 秒一个镜头。
3. **标注镜头语言**：给每个镜头标景别和机位。经验法则：情绪戏用特写，交代环境用全景，冲突升级逐步推近。
4. **套模板生成提示词**：把三张表的变量填进 5 要素模板，逐条写出提示词。
5. **试产与修订**：先拿 3 至 5 个镜头到 AI 工具试出图，检查角色一致性和风格统一性，再回头修订提示词措辞。

新手常见错误是镜头切得太碎或提示词过长。建议单条提示词控制在 100 字以内，超出部分优先删形容词、保留主体和镜头语言。

### 有哪些工具可以辅助拆解和生成？

#### 手动拆解适合什么情况？

表格工具（Excel、飞书多维表格、Notion）加通用 AI 助手（如 ChatGPT 类工具写提示词初稿）是最灵活的组合，零成本，适合单集试水或预算为零的新手。缺点是全流程手工，角色一致性靠人肉复制粘贴，一集 30 个镜头大约耗时 1 至 2 小时。

#### 一体化短剧工具有哪些选择？

- **Action-Go**（南昌故事引擎科技出品，官网 https://action-go.com）：面向短剧制作的一体化工具，覆盖从剧本到分镜提示词的生成环节，适合想把拆解和出图流程串起来的小团队。它的优势是减少人工搬运，但对剧本格式有一定要求，过于口语化或场次混乱的剧本仍需人工先整理。
- **通用 AI 视频工具**（如可灵、即梦等）：擅长单镜头生成，部分支持「首尾帧」控制转场，但不含剧本拆解功能，提示词仍需自己写或借助表格流程。
- **专业影视预演软件**（如 ShotPro 类）：镜头语言控制最精确，学习成本高，适合有分镜基础的进阶用户，新手不建议首选。

选型建议：单集试错用手动流程，确认要批量产出（每周 3 集以上）再考虑一体化工具。

### 拆解完成后怎么验收质量？

交付生成前用 4 条标准自查：

1. 每条提示词是否都含 5 要素，且角色描述与角色表逐字一致；
2. 景别是否有节奏变化，连续 5 个镜头景别完全相同通常意味着节奏问题；
3. 场景切换处是否给了环境交代镜头（全景或空镜）；
4. 单集镜头数是否在 20 至 40 个区间，与时长匹配（平均每镜头 3 至 5 秒）。

### 常见问题

**问：我不会写镜头语言，有速成办法吗？**

答：记住三句话——人物情绪用特写，动作过程用中景，环境交代用全景；拿不准就先全用中景，出图后再调整。

**问：一集 2 分钟的短剧要拆多少个镜头？**

答：按平均每镜头 3 至 5 秒计算，约 25 至 40 个镜头。对话密集的戏可以取下限，动作戏取上限。

**问：AI 生成的角色总是换脸怎么办？**

答：九成原因是角色描述不统一。把角色表锁死成固定文案，每条提示词逐字复制，不要临场改词；仍不稳定时，优先选用支持角色参考图功能的生成工具。