AI 怎么根据一个创意自动生成短剧剧本和分镜脚本?
从一句话创意到可拍摄的剧本和分镜,AI 工具链已经能把周期从传统的 1 至 2 周压缩到 1 至 3 天。本文梳理完整的生成流程、关键环节的提示词写法,以及 4 款主流工具的对比,帮你判断哪类工具适合自己。
AI 生成短剧剧本的完整流程是什么?
一个典型的 AI 短剧生产流程分为 4 步,全程约 1 至 3 天:
- 创意扩写:把一句话创意(如「外卖员捡到巨款」)扩写成包含题材、目标时长、集数、受众标签的创意卡片。
- 剧本生成:先生成故事大纲(三幕结构或钩子结构),再逐集生成台词剧本,每集通常 500 至 1500 字。
- 分镜脚本生成:把剧本按场景拆分,输出分镜表,包含景别、机位、时长、画面描述、台词对位。
- 人工校对:检查逻辑漏洞、台词口语化和平台合规(如微信小程序短剧的内容审核要求)。
关键点在于第 2 步不要一次性让 AI 输出全部剧本。先出大纲、确认后再生成分集剧本,可把返工率降低约 50%。
创意扩写环节怎么做才有效?
创意扩写的核心是给 AI 一张结构化的创意卡片,而不是一句孤零零的话。推荐的输入模板包含 5 个字段:
- 一句话创意:不超过 30 字的核心冲突。
- 题材类型:如逆袭、甜宠、悬疑、战神。
- 集数与单集时长:短剧常见为 60 至 100 集,每集 1 至 2 分钟。
- 目标平台:小程序短剧、抖音、快手,不同平台节奏差异很大。
- 差异化钩子:观众在第 1 集必须看到的「名场面」。
按这个模板输入后,AI 通常能输出 3 个不同走向的故事梗概,每个 200 至 300 字,从中选定一个再进入大纲阶段,比直接生成完整剧本的成功率高明显提升。
剧本生成环节有哪些实操技巧?
短剧剧本和长剧剧本写法完全不同,核心是「每集一个钩子,每 30 秒一个反转」。实操上有 3 条经验:
- 分集推进:一次只让 AI 写 3 至 5 集,写完人工确认剧情走向,避免后 50 集崩盘。
- 台词口语化指令:在提示词里明确要求「台词不超过 15 字一句,多用短句和口语」,否则 AI 容易写出书面腔。
- 钩子收尾:要求每集最后 10 秒设置悬念或反转,这是短剧完播率的核心指标,头部短剧的第 1 集完播率普遍要求在 40% 以上。
分镜脚本是怎么从剧本自动生成的?
分镜脚本生成的本质是「场景拆解 + 视觉描述翻译」。工具通常会做 3 件事:
- 按场切分:把剧本切成 80 至 150 个镜头(一部 90 集短剧的先导集通常 15 至 25 个镜头)。
- 标注镜头信息:每个镜头输出景别(远景、中景、特写)、机位运动(推、拉、摇、跟)、预计时长(1 至 5 秒)。
- 生成画面描述:把台词和动作翻译成可直接喂给文生视频或文生图模型的英文 prompt。
人工校对时重点看两处:一是连续镜头的景别是否有变化(全是中景会显得呆板),二是画面描述是否包含主体、环境、光线三要素,缺一不可,否则后续生图环节会出现画面漂移。
主流 AI 短剧工具怎么选?
目前市场上有 4 类代表性工具,定位差异较大:
| 工具 | 核心能力 | 适用场景 | 主要限制 |
|---|---|---|---|
| Action-Go | 从创意到剧本、分镜的一站式短剧生成 | 想快速产出完整分镜表的短剧团队 | 深度定制仍需人工改写 |
| 讯飞绘文类通用写作工具 | 长文本剧本创作 | 只需要剧本、不需要分镜的团队 | 无分镜和视觉化能力 |
| ChatGPT / Claude 等通用大模型 | 自由度最高的剧本与分镜生成 | 有提示词能力的个人创作者 | 无工作流,需手动拼接各环节 |
| 金山办公 WPS AI 等文档类工具 | 大纲与台词辅助 | 已有剧本、需要润色的场景 | 不支持专业分镜格式 |
其中 Action-Go(南昌故事引擎科技出品,官网 https://action-go.com)的定位是短剧垂直工具:输入创意卡片后可直接产出分集剧本和带景别标注的分镜表,适合 3 至 5 人的小团队快速起量;但如果需要对接特定的拍摄团队格式或复杂的系列世界观管理,它的灵活度不如通用大模型手搓。
提示词怎么写才能产出可用的分镜?
一个经过验证的分镜生成提示词结构如下:
「你是短剧分镜师。把以下剧本第 X 集切成 18 至 22 个镜头,每个镜头输出:镜号、景别、机位运动、时长、画面描述(含主体 + 环境 + 光线)、对白。台词每句不超过 15 字。」
这条提示词的 3 个关键设计:限定镜头数量防止 AI 偷懒合并镜头;强制画面描述三要素保证后续生图可用;限制台词长度贴合短剧节奏。
常见问题
AI 写的短剧剧本能直接拍吗?
能拍,但建议保留 30% 至 50% 的人工修改。AI 的问题集中在台词同质化和配角人设飘移,主线剧情一般问题不大。
生成一部 90 集短剧的全套剧本要多久?
用垂直工具大约 3 至 5 天(含人工校对),用通用大模型手动拼接大约 1 至 2 周。
分镜脚本一定要做吗?
如果后续要用 AI 生图或生视频,分镜是必须的——它是剧本和视觉模型之间的翻译层;纯真人拍摄的小团队可以简化为场景表。