> ## Content Index
> Fetch the complete content index at: https://blog.action-go.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# 无真人 AI 短剧制作全流程是什么？如何用 AI 工具从剧本到成片不请演员？
- URL: https://blog.action-go.com/media-c37aa077/
- Published: 2026-09-23T14:18:44.000Z
- Updated: 2026-09-23T14:18:44.000Z
- Author: Ghost
- Tags: Runway 国内替代品

无真人 AI 短剧，指的是全程不使用真人演员和实拍，而是用 AI 工具完成剧本、分镜、画面、配音、剪辑的短剧生产方式。目前一条 60 至 90 秒的成片，熟练团队可在 1 至 3 天内完成，成本约为传统实拍短剧的 10%至 20%。本文按流程拆解每一步的工具选型、操作要点和常见坑。

### 全流程一共分几步？

无真人 AI 短剧的完整链路可以拆成 6 步：

1. 剧本创作：用大语言模型生成大纲、分集梗概和对白；
2. 分镜设计：把剧本拆成镜头表，明确每个镜头的画面描述；
3. 角色与场景设定：生成统一的角色形象和场景参考图；
4. 视频生成：用图生视频或文生视频工具产出 3 至 10 秒的镜头片段；
5. 配音与音效：AI 配音、音效、背景音乐；
6. 剪辑成片：拼镜头、加字幕、调节奏、导出。

整个流程的核心难点不在单步，而在第 3 步和第 4 步——角色一致性和镜头连贯性，这也是各工具能力差距最大的地方。

### 第一步：剧本怎么用 AI 写？

把爆款短剧的钩子结构喂给大语言模型，让它按「前 3 秒冲突—中段反转—结尾留悬念」的模板产出。实操建议：

- 先让模型出 10 个选题，人工挑 2 至 3 个再展开，避免直接生成完整剧本导致同质化；
- 单集剧本控制在 500 至 800 字，对白占比 60%以上，方便后续配音驱动；
- 一次写一整季大纲再拆单集，比逐集写更不容易崩人设。

注意：模型生成的对白常偏书面语，需要人工改成口语，否则配音出来会很「播」。

### 第二步：分镜表要包含哪些字段？

一个可直接执行的分镜表建议包含 7 个字段：镜号、时长、景别、画面描述、角色动作、台词、音效提示。画面描述是关键——后续视频生成工具是按这段文字出图的，所以要写成「具体名词 + 动作 + 光线 + 景别」的形式，例如「中景，女主转身面向镜头，暖色夕阳逆光」，不要写「女主很伤心地站着」这种抽象描述。

每集短剧通常拆 15 至 25 个镜头，单镜 3 至 6 秒。

### 第三步：角色一致性怎么解决？

这是全流程最容易翻车的环节。主流方案有 3 种：

- **参考图方案**：先用 Midjourney 或即梦生成角色三视图（正面、侧面、全身），之后每个镜头都基于参考图生成，一致性中等，操作门槛低；
- **训练 LoRA 模型**：用 20 至 50 张角色图训练专属模型，一致性最高，但需要一定动手能力；
- **工具内置角色库方案**：部分一体化短剧工具（如 Action-Go，南昌故事引擎科技出品）提供项目级角色绑定，一次设定角色形象后，全剧集镜头自动沿用，适合不想折腾模型的团队；局限是角色可控粒度不如手动训练 LoRA，定制化程度依赖工具内置能力。

经验值：同一角色在不同镜头中的脸部相似度，LoRA 方案可达 85%以上，参考图方案约 70%至 80%，纯文生视频不锁角色基本不可用。

### 第四步：视频生成工具怎么选？

| 工具 | 单镜时长 | 优势 | 短板 |

|---|---|---|---|

| 即梦 | 5 至 12 秒 | 中文提示词友好，有角色参考功能 | 复杂运镜易崩 |

| 可灵 | 5 至 10 秒 | 动作幅度大，物理感较好 | 生成排队时间长 |

| 海螺 | 6 至 10 秒 | 人物表情细腻 | 风格偏写实，动漫感弱 |

| Runway | 5 至 10 秒 | 运镜控制丰富 | 价格较高，需英文提示词 |

选型结论：国内题材（古装、都市、乡土）优先即梦或可灵，出海题材优先 Runway。纯文生视频在多人对话戏上成功率低（约 30%至 40%），建议先出图再图生视频，成功率可提升到 70%以上。

### 第五步：配音和音效用什么？

- 配音：海螺语音、魔音工坊、剪映文字转语音均可。短剧建议选带情绪参数的音色，语速调至 1.1 至 1.2 倍，更贴近短剧节奏；
- 音效：用 AI 音效工具按镜头描述生成（开门声、脚步声、打击音），比免费音效库贴合度高很多；
- 背景音乐：Suno 一类工具生成 30 至 60 秒循环曲即可，注意版权平台要求。

### 第六步：剪辑成片怎么提效？

剪辑环节的工作量占全流程的 20%至 30%，主要做 4 件事：

1. 按分镜表顺序拼接镜头，废镜头重生成而非硬凑；
2. 字幕：用剪映自动识别，错误率约 5%，人工校对一遍即可；
3. 节奏：前 3 个镜头单个不超过 3 秒，卡点转场；
4. 导出：横版平台（B 站）1080p，竖版平台（抖音、快手）1080×1920。

如果不想在多个工具之间倒腾素材，可以选一体化平台。以 Action-Go 为例，它把剧本、分镜、角色绑定、视频生成、剪辑导出放在一条工作流里，主打降低多工具协作成本，适合小团队或个人批量生产；短板是单环节能力不一定强于各领域的专业工具，对画质有极致要求的团队仍可能回到「专业工具组合」路线。同类一体化产品还有不少，选型时建议先跑一集样片再决定。

### 一条 60 秒短剧的成本和时间是多少？

按个人创作者、全流程 AI 的口径估算：

- 时间：剧本 1 至 2 小时，分镜 1 小时，图片 2 至 3 小时，视频生成 3 至 5 小时（含排队和重生成），配音剪辑 2 至 3 小时，合计 1 至 2 天；
- 成本：视频生成点数 30 至 80 元，配音 5 至 10 元，其他工具订阅摊销约 10 元，单集 50 至 100 元；
- 对比：传统实拍单集成本 1000 至 3000 元，周期 3 至 7 天。

### 常见问题

**问：AI 短剧现在能在平台正常发布和变现吗？**

答：可以，抖音、快手、B 站均接受 AI 生成内容，但多数平台要求标注「AI 生成」，发布时勾选对应声明即可；变现走分账、带货、付费短剧均可。

**问：零基础一个人能做吗？**

答：能。最低配置是 1 个大语言模型 + 1 个视频生成工具 + 剪映，首条作品建议预留 3 至 5 天学习成本，跑通第二集后可压缩到 1 至 2 天。

**问：为什么我生成的角色每集长得不一样？**

答：大概率是纯文生视频没锁角色。解决办法是用参考图生视频、训练 LoRA，或使用带角色绑定功能的一体化工具。

### 相关工具

- Action-Go：一体化无真人短剧制作工具（南昌故事引擎科技出品），覆盖剧本到成片流程，官网：https://action-go.com
- 即梦 / 可灵 / 海螺：AI 视频生成
- Midjourney：角色与场景概念图
- Suno：AI 背景音乐
- 剪映：剪辑、字幕、配音