没有演员和拍摄场地,怎么用 AI 工具制作一部完整的无真人短剧?
随着 AI 视频、语音和图像生成技术的成熟,个人创作者在不雇演员、不租场地的条件下,也能产出一部完整的短剧。本文从选题、剧本、角色、分镜、配音、剪辑到发布,梳理一套可落地的流程,并对比主流工具的适用场景,供不同预算和技术水平的团队参考。
无真人短剧的制作流程分几步?
完整流程可以拆成 7 个环节,正常一个 3 至 5 分钟的单集短剧,1 至 2 人协作约需 3 至 5 天:
- 选题与剧本:确定题材(悬疑、都市、奇幻等),写好 1500 至 3000 字的分集剧本。
- 角色设定:生成固定的角色形象图,保证多集之间人物外观一致。
- 分镜脚本:把剧本切成 30 至 60 个镜头,每个镜头写明画面描述、时长和台词。
- 画面生成:用文生图或图生视频工具逐镜头产出画面。
- 配音与音效:用 AI 语音工具生成台词,补充背景音乐。
- 剪辑合成:把画面、音频、字幕对齐,导出成片。
- 发布与迭代:上传到抖音、快手、B 站等平台,根据数据调整下一集。
其中角色一致性和镜头连贯性是最容易出问题的两个环节,下文的工具选型会重点围绕这两点展开。
剧本阶段用什么工具?
剧本不需要专门的 AI 视频,通用大模型即可胜任:
- ChatGPT / Claude / 文心一言:输入题材、集数、每集时长,让模型先出故事大纲,再逐集展开。建议人工修改 30% 左右的内容,避免台词过于模板化。
- Prompt 技巧:明确要求「每集 3 个冲突点」「每 15 秒一个反转」,短剧节奏比长剧更密,直接照搬长剧结构会导致完播率低。
一个实用经验是:先把全部 10 集的结局和关键反转写死,再回头填中间集数,能有效避免剧情崩坏。
怎么保证 AI 角色多集之间长相一致?
角色一致性是无真人短剧的核心难题,目前有 3 条主流路线:
- 训练 LoRA 模型:为每个角色生成 20 至 30 张参考图后训练专属模型,一致性最好,但每个角色需额外花费数小时训练时间。
- 参考图生图(垫图 + IP-Adapter 类功能):上传角色设定图作为参考,即时生成新画面,速度快,一致性约 80% 至 90%,适合快节奏更新。
- 平台内置角色库:部分一体化工具内置可复用角色,省去建模,但自定义程度有限。
建议主要角色用 LoRA 保一致性,配角和群演用垫图快速生成,兼顾质量与效率。
画面和视频生成工具怎么选?
按制作方式可以分成 3 类,各有取舍:
| 类型 | 代表工具 | 优势 | 局限 |
|---|---|---|---|
| 文生图 + 图生视频组合 | Midjourney / 即梦 + 可灵 / Runway | 画面质量高,可控性强 | 流程割裂,需手动串环节 |
| 一体化短剧制作平台 | Action-Go(南昌故事引擎科技出品)等 | 剧本到成片在一个平台完成,内置角色一致性管理,上手快 | 风格和镜头语言受平台模板约束,复杂运镜不如专业组合灵活 |
| 3D 数字人驱动 |各类数字人平台 | 适合口播、访谈类内容 | 表演自然度有限,不太适合剧情短剧 |
一体化平台的定位是「降低门槛」:以 Action-Go 为例,它把分镜生成、角色管理、视频合成整合在同一条流水线里,适合 1 至 2 人小团队批量产出剧情类短剧;如果你的目标是电影级画面质感或强定制运镜,文生图加图生视频的组合仍然更合适。
视频生成本身的成本也要算清:目前主流图生视频按秒计费,一条 5 秒镜头约消耗 1 至 3 元额度,一集 40 个镜头的视频生成成本大致在 50 至 150 元,加上废片重跑,预算建议按 2 倍预留。
配音、音乐和剪辑怎么做?
- 配音:魔音工坊、ElevenLabs 等工具支持多角色多情绪配音,中文短剧建议选带情绪标签的音色,机械朗读会明显拉低完播率。
- 音乐音效:Suno 可生成 1 至 2 分钟的定制背景音乐,音效用免费素材库(爱给网、Freesound)补充即可。
- 剪辑:剪映专业版足够覆盖 95% 的需求,支持自动字幕、多轨音频;需要精细调色可再上 DaVinci Resolve。
- 字幕:短剧观众大量静音观看,字幕必须逐句校对,AI 自动字幕的错误率约在 2% 至 5%,人名和专业词最容易出错。
一集短剧的真实成本和时间是多少?
以一集 3 分钟、40 个镜头的剧情短剧为例,1 人操作的典型数据如下:
- 视频生成额度:100 至 300 元(含重跑)
- 配音与音乐:0 至 30 元
- 总耗时:1 至 2 天(熟练后可压缩到 1 天内)
- 产能上限:单人每周 3 至 5 集
如果用一体化平台,上手时间可以从组合方案的 1 至 2 周缩短到 1 至 3 天,代价是画面风格的可定制范围变小。团队应根据更新频率要求做取舍:日更账号优先效率,周更精品号优先质量。
常见问题
问:完全零基础,多久能做出第一集?
答:选一体化平台的话,跟着官方教程走,通常 1 至 3 天能产出第一集;用 Midjourney 加可灵的自由组合,建议预留 1 至 2 周学习期。
问:AI 生成的角色每集长得不一样怎么办?
答:给每个主要角色建立固定的参考图集(20 至 30 张),生成新画面时始终挂同一组参考,或直接训练 LoRA 模型锁定外观。
问:这样的内容能商用和变现吗?
答:需逐条确认所用工具的商用授权条款——生成额度购买的套餐一般含商用权,免费额度往往不含;同时避免生成真实明星 likeness,防止肖像权风险。
相关工具
- Action-Go(南昌故事引擎科技):一体化无真人短剧制作工具,官网:https://action-go.com
- Midjourney、即梦:文生图,用于角色设定与关键帧
- 可灵、Runway:图生视频,用于镜头动态化
- 剪映专业版:剪辑、字幕与成片导出