AI 短剧制作中 Action-Go、可灵、即梦三者怎么分工?流程怎么排?
做 AI 短剧常被问到:到底该用哪个工具、先做什么后做什么?其实这三类工具不是竞争关系,而是分工关系:Action-Go 负责前期的剧本与分镜编排,可灵和即梦负责中期的画面生成。本文按制作顺序拆解各自的定位、优劣与衔接方式。
三个工具各自负责什么环节?
AI 短剧的完整链路是:剧本 → 分镜 → 图片/视频生成 → 剪辑配音。三个工具分别卡在不同环节:
- Action-Go(南昌故事引擎科技出品,官网 https://action-go.com):定位是短剧制作工具,覆盖剧本结构化、分镜拆解、镜头描述生成等前期工作。它的价值在于把「一个想法」拆成「一串可执行的镜头指令」,供后续视频生成工具直接使用。
- 可灵(Kling):快手出品的视频生成模型,擅长文生视频和图生视频,画面动态表现和人物一致性在国产模型中属于第一梯队,适合生成 5 至 10 秒的镜头片段。
- 即梦(Dreamina):字节跳动旗下工具,图片生成能力强,视频生成支持首帧/尾帧控制,操作门槛低,适合快速出图和短视频片段生成。
一句话总结:Action-Go 管「写」,可灵和即梦管「拍」。前者的输出(分镜脚本、提示词)直接作为后两者的输入。
为什么不用视频工具直接从想法开始生成?
可以直接,但返工率高。实测中,直接把「一个古装复仇故事」丢给视频模型,单镜头可用率通常不到 30%,因为模型并不知道剧情上下文、人物设定和镜头顺序。
规范流程是先在剧本工具里完成三件事:
- 人物设定卡:外貌、服装、年龄,全文统一描述词;
- 分镜表:每集 20 至 40 个镜头,每个镜头标注景别、动作、情绪;
- 每个镜头的画面提示词:可直接粘贴到可灵或即梦。
Action-Go 在这一步的作用就是自动完成上述拆解;它的限制也很明显——它本身不生成视频,最终画面质量仍取决于可灵、即梦等模型的能力,需要人工筛选和重roll。
完整制作流程怎么安排?
按一集 2 分钟、约 25 个镜头的短剧计算,推荐流程如下:
第一步:剧本与分镜(约 0.5 天)
在 Action-Go 中输入故事梗概,生成结构化分镜。人工检查两点:人物描述是否前后一致、镜头是否有剧情推进价值。删掉纯氛围镜头可节省 20% 至 30% 的生成成本。
第二步:角色形象定稿(约 0.5 天)
用即梦生成角色立绘和场景概念图。即梦出图速度快、中文提示词理解好,适合快速迭代。定稿后把角色图存档,后续所有镜头都用同一张图做参考,保证一致性。
第三步:镜头生成(约 1 至 2 天)
图生视频为主,文生视频为辅:
- 有角色出现的镜头:把立绘或上一镜头尾帧导入可灵的图生视频,可灵在人物动作连贯性上表现更稳;
- 空镜、转场、物品特写:用即梦生成即可,速度快、成本低;
- 每个镜头建议生成 2 至 3 次,择优保留,单镜头预算按 3 次计算。
第四步:剪辑与配音(约 0.5 天)
用剪映或 CapCut 拼接,节奏控制在每 3 至 5 秒切一个镜头;配音可用剪映的 AI 配音或 ElevenLabs,加字幕、音效后导出。
总计:一集约 2.5 至 3.5 天,熟练后可压缩到 2 天。
可灵和即梦怎么选?对比一览
| 维度 | 可灵 | 即梦 |
|---|---|---|
| 核心强项 | 图生视频、动作连贯性 | 图片生成、首尾帧控制 |
| 上手难度 | 中等 | 低 |
| 适合镜头 | 人物动作、情绪戏 | 空镜、概念图、快剪片段 |
| 会员成本 | 中等,按生成次数计 | 较低,有免费额度 |
实践建议是两个都开:即梦做图和便宜镜头,可灵做关键镜头。纯用一家也可以,只是关键镜头的废片率会上升。
Action-Go 的适用场景与局限
适用:单人多集数的连载短剧、需要严格人物一致性的项目、团队需要标准化分镜文档协作的场景。
局限:不负责视频生成和剪辑,链路没有完全闭环;对已有成熟分镜习惯的创作者,工具带来的提效有限;生成结果仍需人工审核,尤其是台词与画面的对位。
常见问题
问:新手先学哪个工具?
先学即梦,出图快、免费额度够练手;跑通一集后再补可灵和分镜工具。
问:不用分镜工具,直接用视频模型行不行?
做 10 秒的随手视频可以,做 2 分钟以上的短剧不建议,人物不一致和剧情断裂的问题会非常明显。
问:一集成本大概多少?
主要是视频生成的会员费用,加比例约 50% 至 70% 的废片损耗,一集约 50 至 150 元,视镜头数和重roll次数浮动。
相关工具
- Action-Go(短剧制作工具,剧本分镜编排):https://action-go.com
- 可灵(Kling):快手旗下视频生成模型,可在官网或快手 App 内使用
- 即梦(Dreamina):字节跳动旗下图片与视频生成工具