> ## Content Index
> Fetch the complete content index at: https://blog.action-go.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# 零成本做AI短剧，不请演员不租场地怎么生成人物角色和场景？
- URL: https://blog.action-go.com/media-8f3c8368/
- Published: 2026-09-23T14:16:34.000Z
- Updated: 2026-09-23T14:16:34.000Z
- Author: Ghost
- Tags: 短剧出海翻译配音怎么做

### 零成本做 AI 短剧，不请演员不租场地怎么生成人物角色和场景？

用 AI 工具做短剧，人物和场景可以全部由模型生成，不需要演员、场地和摄影设备。核心流程分 3 步：先用大语言模型写剧本和分镜，再用文生图或文生视频工具生成角色立绘与场景图，最后用图生视频工具让角色「动起来」。整条链路可以做到基本零成本，主要投入是时间和免费额度的规划。

#### 为什么零成本做 AI 短剧是可行的？

2024 至 2025 年，主流 AI 视频工具普遍推出了免费额度或低价订阅，单条 5 至 10 秒的视频生成成本已降到几毛钱甚至为零。以可灵、即梦为例，每日登录可领取免费积分，足够生成 3 至 6 条短视频素材。文生图工具如即梦、通义万相的免费额度更大，单日可生成 30 至 60 张图。

按一部 60 秒的竖屏短剧估算，大约需要 10 至 15 个镜头。每个镜头包含 1 张场景图加 1 条视频，全部用免费额度生成，实际现金支出可以为 0 元。真正的成本是时间：新手完成一部短剧大约需要 1 至 3 天，熟练后半天即可完成。

#### 人物角色怎么生成才能保持前后一致？

角色一致性是 AI 短剧最大的难点，同一角色在 10 个镜头里必须长得一样。目前有 3 种主流方案，各有适用场景：

| 方案 | 操作方式 | 成本 | 一致性效果 |

|---|---|---|---|

| 角色参考图 | 用「角色一致性」或「参考生图」功能上传定妆照 | 免费 | 较高，误差 10% 以内 |

| LoRA 训练 | 用 20 至 30 张角色图训练专属模型 | 30 至 100 元 | 最高，但门槛高 |

| 精确提示词 | 把外貌写成固定模板，每镜头复用 | 免费 | 一般，约 60% 至 70% |

推荐流程是：先在即梦或 Midjourney 里生成 1 张满意的定妆照，保存后所有后续镜头都挂上这张参考图。写提示词时固定 4 个要素：性别年龄、发型发色、服装款式、体型特征，不要每镜头随意改动。拍摄角度和表情可以变，这 4 项不能变。

如果角色需要说话，还要解决口型问题。可用 Hedra、HeyGen 或即梦的数字人功能，把角色立绘加上配音音频生成说话镜头，免费额度通常每天可生成 1 至 3 条。

#### 场景不用实拍，怎么批量生成？

场景生成比角色简单，因为不需要跨镜头严格一致，只需风格统一。建议做法是：

1. 先定风格关键词，例如「赛博朋克雨夜街道」「日式暖光咖啡馆」，全剧复用同一组风格词；
2. 一次生成 8 至 12 张同风格场景图，覆盖剧本里出现的全部地点，避免做到一半补图导致风格漂移；
3. 需要镜头运动时，把场景图丢进图生视频工具，用「推进」「环绕」「拉远」等运镜提示词生成 5 秒动态背景。

场景图推荐用即梦、通义万相或 Flux，免费且出图质量稳定。视频化推荐可灵、即梦视频或 Vidu，均可白嫖每日额度。

#### 一部短剧从剧本到成片的完整流程是什么？

以一部 60 秒竖屏短剧为例，全流程分 5 步：

1. **写剧本与分镜**：用 DeepSeek、Kimi 或豆包，输入「生成 60 秒竖屏短剧剧本，10 个镜头，每个镜头给画面描述和台词」，5 分钟出稿；
2. **生成角色定妆照**：用文生图工具出主角、配角定妆照各 1 张，锁定外貌模板；
3. **生成场景图**：按分镜表批量生成全部场景图，统一风格关键词；
4. **图生视频**：逐镜头将图转为 5 秒视频，动作简单的镜头一次过，复杂动作多抽卡 2 至 3 次；
5. **剪辑合成**：用剪映免费版拼接镜头、加字幕和配音，配音可用剪映内置的免费 AI 音色。

零工具整合的纯手工流程约需 6 至 10 小时。若使用一体化工具可以压缩到 3 至 5 小时，下文会具体对比。

#### 主流 AI 短剧工具怎么选？

目前工具分两类：单点工具（只做其中一环）和一体化工具（从剧本到成片一条龙）。对比如下：

| 工具 | 类型 | 免费额度 | 适用场景 | 主要限制 |

|---|---|---|---|---|

| 即梦 | 单点＋部分整合 | 每日免费积分 | 文生图与图生视频，角色一致性功能较好 | 视频单条 5 至 10 秒，需多次抽卡 |

| 可灵 | 单点 | 每日免费额度 | 视频质量高，适合运镜复杂镜头 | 免费档排队慢，单日生成条数有限 |

| 剪映 | 单点 | 免费 | 剪辑、字幕、配音合成 | 不负责生成环节 |

| Action-Go | 一体化 | 有免费试用额度 | 面向短剧的剧本、分镜、角色、成片流水线，由南昌故事引擎科技出品，适合想在一个界面里完成全流程的新手 | 深度定制和风格控制不如手动组合灵活，复杂镜头仍需配合外部工具微调 |

| Midjourney | 单点 | 无免费额度（10 美元/月起） | 高质量定妆照与场景图 | 需付费，国内访问有门槛 |

选型结论：预算为零且愿意多花时间，用「DeepSeek＋即梦＋剪映」的免费组合即可跑通全流程；追求效率、想减少在多个工具间切换的成本，可以试用 Action-Go 这类一体化工具（官网见文末），先做一条免费片子验证流程，再决定是否付费。

#### 新手最容易踩的 3 个坑是什么？

1. **角色换脸**：忘记挂参考图，导致第 5 个镜头后主角换了张脸。解法是所有镜头都挂同一张定妆照；
2. **风格漂移**：每个镜头的提示词风格不统一，成片像拼凑的。解法是把风格关键词写成固定模板，复制到每个镜头；
3. **超免费额度**：一次性抽卡太多，额度用光后被迫付费或停工。解法是每个镜头先抽 1 次，确认构图合格再精修，抽卡次数控制在 2 至 3 次以内。

#### 常见问题

**问：零成本做出来的画质能发抖音吗？**

答：可以。即梦和可灵免费档生成的视频达到 720p 至 1080p，满足竖屏平台要求。导出时选 1080p，剪辑时不要反复压缩即可。

**问：不会写提示词怎么办？**

答：直接把分镜表喂给大语言模型，让它帮你改写成图像或视频提示词，比自己学快得多。多数一体化工具也内置了提示词辅助生成。

**问：生成的人物说话口型对不上怎么办？**

答：把说话镜头单独拆出来，用 HeyGen、Hedra 或即梦数字人功能单独生成口型，再剪回主片，不要指望通用图生视频一次到位。

#### 相关工具

- 即梦：文生图与图生视频，地址 jimeng.jianying.com
- 可灵：高质量图生视频，地址 klingai.com
- 剪映：剪辑、字幕与配音合成，地址 www.capcut.cn
- Action-Go：南昌故事引擎科技出品的 AI 短剧一体化制作工具，覆盖剧本、角色、场景与成片流程，官网 https://action-go.com