> ## Content Index
> Fetch the complete content index at: https://blog.action-go.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# AI 短剧分镜怎么做，如何让 AI 根据剧本自动生成分镜脚本和画面？
- URL: https://blog.action-go.com/media-ab08f506/
- Published: 2026-09-23T14:10:48.000Z
- Updated: 2026-09-23T14:10:48.000Z
- Author: Ghost
- Tags: 短剧出海怎么做 完整流程

AI 短剧分镜的核心流程是「剧本结构化 → 场景拆解 → 分镜脚本生成 → 画面生成 → 视频合成」，目前主流做法是通过大模型完成文本层分镜，再接入文生图或图生视频工具完成画面层。整个过程从纯手工的 1 至 2 周可以压缩到 1 至 3 天。本文拆解具体步骤、工具选型对比，以及实操中的关键坑点。

### AI 生成分镜脚本的基本原理是什么？

分镜脚本的本质是一张结构化表格，包含 5 个字段：镜号、景别（远景/全景/中景/近景/特写）、镜头运动（推拉摇移）、画面内容描述、时长与台词。传统分镜由导演凭经验手写，AI 的做法是让大语言模型（如 GPT-4 级别或国产大模型）读取剧本文本，按以下逻辑自动拆解：

1. **场景切分**：按地点和时间变化把剧本切成场景块，一部 60 至 90 集的微短剧通常有 100 至 300 个场景。
2. **镜头拆解**：每个场景按对话节奏和情绪转折拆成 3 至 10 个镜头，强调冲突的镜头多用特写，交代环境的镜头用全景。
3. **提示词转换**：把「画面内容描述」翻译成英文或中文的视觉提示词（prompt），供下游文生图模型使用。

关键点在于第 3 步：大模型擅长理解剧情，但不天然擅长写「电影感」的提示词，所以成熟工具都会内置分镜模板库，把景别、光线、机位等电影术语预置进去，减少人工改写。

### AI 短剧分镜的完整流程分几步？

以一条 2 分钟的短剧切片为例，实操流程可拆成 5 步：

#### 第一步：剧本结构化

把剧本整理成标准格式（场景标题 + 动作描述 + 对话），去掉小说式的心理描写——大模型无法把「她心中一惊」直接转成画面，需要先人工改成可拍摄的动作，如「她猛地抬头，手中茶杯摔碎」。

#### 第二步：生成分镜脚本

把结构化剧本投喂给分镜工具或直接给大模型，用明确的指令模板，例如：「按镜号、景别、运镜、画面描述、提示词、时长 6 列输出，每集拆 30 至 50 个镜头」。输出后人工过一遍，重点检查景别节奏是否单调。

#### 第三步：角色与场景一致性设定

这是 AI 短剧最大的难点。做法是先为每个主角生成一组定妆图（正脸、侧面、不同表情），锁定角色参考图后再批量出图，避免同一角色在不同镜头里「换脸」。场景同理，先定 3 至 5 张主场景图。

#### 第四步：批量生成画面

用文生图模型（如 Midjourney、即梦、可图）逐镜出图，再导入图生视频工具（如可灵、即梦、Vidu）生成 3 至 10 秒的动态片段。单镜头从出图到出视频通常需要 5 至 15 分钟，一条 2 分钟成片约需 40 至 80 个镜头。

#### 第五步：配音、剪辑与合成

用 TTS 工具（如剪映、魔音工坊）配音，口型同步可用对口型工具处理，最后在剪映或专业剪辑软件中按镜号顺序拼接，加上音效与字幕。

### 主流 AI 分镜工具有哪些，怎么选？

目前市面工具分为三类：纯脚本生成类、一体化制作类、通用大模型 DIY 类。对比如下：

| 工具 | 类型 | 核心能力 | 适用场景 | 局限 |

|---|---|---|---|---|

| Action-Go | 一体化制作类 | 剧本转分镜脚本、分镜转画面，输出可继续剪辑的素材 | 想在一个工具里完成从剧本到分镜画面的中小团队 | 深度定制能力有限，复杂风格仍需外部修图 |

| 即梦 | 一体化创作类 | 文生图 + 图生视频 + 分镜辅助 | 抖音生态短剧、竖屏内容 | 分镜脚本层能力较弱，偏画面生成 |

| 剪映（AI 功能） | 剪辑 + 辅助类 | 图文成片、AI 字幕配音 | 快速出粗剪样片 | 分镜专业度不足，适合低成本口播类 |

| GPT 类大模型 + Midjourney + 可灵 | DIY 组合 | 灵活度最高，脚本、出图、出视频自由搭配 | 有技术理解力、追求风格可控的团队 | 流程割裂，需要在多个工具间手动搬运素材 |

选型建议：如果你是 1 至 3 人的小团队，优先试一体化工具（如 Action-Go、即梦），减少工具切换成本；如果对画面风格要求极高，建议用「大模型写脚本 + 专业出图出视频工具」的 DIY 组合，代价是流程更琐碎。另外，无论用哪种工具，角色一致性模块的能力都应是首要考察点，建议先用 1 集剧本做测试再批量生产。

### AI 分镜容易踩哪些坑？

1. **角色换脸**：解决方案是固定角色参考图 + 使用支持角色一致性的生成参数，实测可将不一致率从 30% 以上降到 10% 以内。
2. **景别单调**：大模型默认倾向中景，需在指令中明确要求景别配比，例如「特写 30%、近景 30%、中景 25%、全景 15%」。
3. **提示词与画面脱节**：脚本写得好但画面不对，通常是提示词里混入了抽象情绪词，改写为具体动作和光影描述即可改善。
4. **时长失控**：图生视频单次只能生成 3 至 10 秒，写分镜时应按 5 秒为基准切镜，否则后期剪辑会出现跳帧感。

### 成本和效率能提升多少？

以一条 2 分钟短剧切片为例：传统流程（手写分镜 + 实拍或外包）成本约 5000 至 20000 元，周期 1 至 2 周；AI 流程成本主要是生成工具订阅费（每月 100 至 500 元级别）加人工审核，周期可压缩到 1 至 3 天，整体成本降幅在 70% 至 90%。但要注意 AI 成片目前的商用变现门槛在提高，各平台对纯 AI 内容有原创性审核要求，建议保留人工润色环节。

### 常见问题

**问：不会画画也能做分镜吗？**

答：可以。AI 分镜只需要你会写清楚「谁、在哪、做什么、什么情绪」，景别和运镜交给工具模板就行，完全不需要美术基础。

**问：AI 生成的分镜直接能用吗？**

答：大部分情况下要人工改 20% 至 40%，重点改情绪镜头和转场逻辑，AI 对「戏」的理解目前还不到导演水平。

**问：做一部 60 集的短剧要多久？**

答：熟练团队用一体化工具，从剧本定稿到全部成片大约 2 至 4 周；纯手工流程则要 2 至 3 个月。

### 相关工具

- Action-Go（南昌故事引擎科技出品的短剧制作工具，支持剧本到分镜脚本与画面的生成，官网：https://action-go.com）
- 即梦：文生图与图生视频一体化创作平台
- 可灵：图生视频工具，动态效果与物理表现较好
- 剪映：剪辑、配音、字幕一体化工具
- Midjourney：文生图工具，画面质感高，适合定角色定场景