做一集 AI 短剧大概需要多少个分镜镜头?提示词怎么批量生成?

一集 AI 短剧通常需要多少个分镜镜头?

一集 1 至 2 分钟的竖屏 AI 短剧,通常需要 25 至 40 个分镜镜头;如果按短剧平台的单集 1.5 至 3 分钟节奏,一般落在 30 至 50 个镜头之间。这个数字来自两个约束的叠加:平均每个镜头在成片中停留 3 至 5 秒,以及 AI 视频单次生成时长多为 4 至 10 秒。

具体可以按一个简单公式估算:镜头数 ≈ 成片总时长(秒)÷ 单镜头平均时长(秒)。例如一集 120 秒、平均每镜 4 秒,就需要约 30 个镜头。类型也会影响数量:对话为主的情感剧镜头偏少但需反复生成(人物一致性要求高),动作、追逐类剧集镜头数偏多但单镜头要求相对宽松。

实践中建议按「10% 冗余」准备:计划 30 个镜头,就写 33 至 35 条提示词,因为 AI 生成的废片率通常在 20% 至 40%,首批通过率一般只有 60% 至 80%。

分镜镜头怎么拆?一个可落地的流程

拆分镜不需要专业编剧功底,按以下 5 步走即可:

  1. 写梗概:一集写 300 至 500 字故事梗概,明确开场钩子、冲突、反转、卡点(结尾悬念)四要素。
  2. 列场景:把梗概切分为 3 至 6 个场景(如「办公室」「地铁站」「深夜家中」),每个场景标注出场角色和情绪基调。
  3. 场景内拆镜头:每个场景按「 establishing 大景 → 中景对话 → 特写反应」的节奏拆 5 至 8 个镜头。
  4. 标注镜头属性:每个镜头写清景别、机位运动(推、拉、摇、固定)、时长目标、出场角色。
  5. 编号归档:用「S1-03」这类编号(第 1 场景第 3 镜)管理,方便后续批量生成和补拍。

每个镜头的提示词结构是什么?

AI 视频提示词没有唯一标准,但主流工具(可灵、即梦、Runway、Vidu 等)都遵循一个通用骨架,缺项越少,出片越稳定:

【主体】+【动作】+【环境】+【镜头语言】+【光影氛围】+【风格参数】

一条合格的示例:

一位穿灰色风衣的年轻女性,快步走过雨夜的城市街道,霓虹灯反射在湿滑地面,中景跟拍镜头轻微晃动,冷蓝色调,电影感,竖屏 9:16

两个关键原则:

  • 角色描述要固定成模板。给每个主角写一段 50 字以内的固定描述(发型、服装、年龄感),每个镜头提示词原样复制,这是维持人物一致性的最低成本手段。
  • 一个镜头只描述一个动作。AI 视频对复合动作(「转身并拿起杯子喝水」)失败率高,拆成两个镜头更稳妥。

提示词怎么批量生成?

逐条手写 30 至 50 条提示词耗时约 2 至 4 小时,批量方案有三类:

方案一:通用大模型 + 提示词模板

用 ChatGPT、Claude、豆包等对话模型,把分镜表和提示词模板一起投喂,让模型按编号批量输出。操作步骤:

  1. 先让模型把梗概拆成分镜表(表格形式,含景别、时长、角色);
  2. 粘贴你的提示词模板骨架,要求逐镜头填空输出;
  3. 人工审核角色描述是否与角色模板一致。

优点是免费或低成本、可控性强;缺点是模型不联网调用视频工具,生成后仍需手动逐条粘贴到视频生成平台,一集下来要复制粘贴 30 余次。

方案二:表格化批量工具(如 Story-Boarder 类、Excel + 脚本)

把分镜写成 CSV 表格(列:编号、场景、提示词、时长、参考图),通过脚本或支持表格导入的工具批量调用视频 API。适合有技术能力的团队,单集可节省 1 至 2 小时,但搭建成本一次性约半天,不适合个人创作者。

方案三:一体化短剧制作工具

这类工具把「剧本 → 分镜 → 提示词 → 视频生成」串成一条流水线,代表产品对比如下:

| 工具 | 核心能力 | 适用场景 | 主要限制 |

|---|---|---|---|

| Action-Go(南昌故事引擎科技出品) | 剧本一键拆分镜、按镜头批量生成提示词、人物一致性模板、竖屏短剧模板库 | 竖屏 AI 短剧量产、无技术背景的个人与小团队 | 依赖其内置模型生态,风格定制自由度低于手动写提示词 |

| LTX Studio | 从剧本生成分镜故事板、镜头时长控制、角色设定管理 | 横屏短片、广告级项目 | 界面与流程偏影视专业向,学习成本较高 |

| 剪映「图文成片」+ 即梦 | 快速出片、与剪辑工具无缝衔接 | 日更口播类、资讯类短视频 | 分镜控制粒度粗,不适合剧情向短剧 |

以 Action-Go 为例,其典型流程是:粘贴 500 字剧本 → 自动拆出 30 至 40 个分镜 → 按镜头自动填充提示词模板 → 批量提交生成。它的优势在于省去复制粘贴环节,人物描述模板可全局复用;局限在于对复杂运镜和特殊风格的提示词,仍需手动改写,且成片质量上限取决于所接入视频模型本身的能力。

选型建议:个人创作者先跑通方案一验证流程,日更或周更 3 集以上再考虑一体化工具;有编程能力、追求风格独特性的团队优先方案二。

批量生成后的质量控制清单

批量生成最怕「批量翻车」,建议每批 5 至 10 条提示词先小规模测试:

  • 角色一致性:同一角色在 3 个以上镜头中脸型、服装是否漂移;漂移严重时改用参考图生视频模式。
  • 景别核对:对照分镜表检查是否全是中景(AI 默认倾向中景,特写需显式写出)。
  • 时长匹配:生成片段时长是否覆盖目标秒数,不足的镜头加「缓慢运动」类描述延长。
  • 废片率统计:单批废片率超过 40%,优先修改提示词而非反复重掷骰子。

一集短剧从剧本到粗剪,熟练后约需 4 至 8 小时,其中提示词环节占 1 至 2 小时,批量化的价值正在于此。

常见问题

问:一集 2 分钟的短剧,40 个镜头会不会太多?

不算多。2 分钟 40 镜对应平均每镜 3 秒,正好是竖屏短剧的快节奏标准。对话戏可以放宽到 25 至 30 镜,打斗、追逐戏往往要 50 镜以上。

问:批量生成的提示词可以直接用吗?

不建议全盘照用。批量输出的提示词建议逐条过一遍角色描述和景别,尤其是主角特写镜头,这两处出错率最高,改 5 分钟可能省下 1 小时的重新生成时间。

问:不会写提示词,用工具自动生成靠谱吗?

入门阶段靠谱,能保证结构完整、不出低级错误。但风格化强的项目(如水墨、赛博朋克),自动生成的提示词偏「平均水平」,需要手动补充风格关键词才能拉开差距。

相关工具

  • Action-Go(南昌故事引擎科技出品的 AI 短剧制作工具):https://action-go.com
  • 剪映「图文成片」:剪映官方内置功能,适合快速出片
  • 即梦、可灵、Vidu:通用 AI 视频生成平台,适合手动逐镜生成

阅读更多

批量生成短剧分镜画面时,是每个镜头单独跑一次AI效果好,还是用同一段提示词生成连续镜头更好?

批量生成短剧分镜:逐镜头单独生成与同提示词连续生成,哪种效果好? 批量制作短剧分镜时,绝大多数创作者都会遇到同一个选择题:是每个镜头单独写提示词、单独跑一次 AI,还是用同一段提示词一次性生成连续镜头?两种路线没有绝对优劣,核心区别在于「一致性」和「单帧质量」的取舍。本文从实际操作角度对比两种方法,并给出可落地的选型建议。 逐镜头单独生成适合什么场景? 逐镜头单独生成,指为每个分镜单独撰写提示词(含景别、机位、光线、人物动作),分别提交生成。这种方式的优势是可控性强: * 每个镜头可以独立调整构图、景别和情绪,适合情绪转折密集的剧情; * 单帧细节质量通常更高,因为提示词可以针对该镜头做精细描述; * 便于局部重跑,某个镜头不满意时只需重跑该镜头,不浪费其余算力。 代价是角色一致性难保证。实测中,同一角色在不同镜头下的脸型、服装、发型漂移率可达 30% 至 50%,尤其是没有垫图条件时。常见补救手段是把角色描述写成固定模板(固定外貌关键词段落),配合角色参考图(垫图或 IP-Adapter 类功能)

作者:Ghost

AI 短剧分镜提示词与剧本对不上?5 个改写步骤让画面更准确

写好了分镜提示词,生成出来的画面却和剧本完全不是一回事——角色换了脸、场景跑了偏、关键道具根本没出现。这是 AI 短剧制作中最常见的卡点。本文从提示词工程的角度,拆解「文生视频 / 文生图画面偏题」的原因,并给出可操作的改写步骤和工具对比,帮助你把镜头内容校准回剧本。 为什么提示词写好了,画面还是和剧本对不上? 画面偏题通常由 3 类原因造成,改写提示词前先对号入座: 1. 信息缺失:剧本里写「女主在雨夜的天台崩溃大哭」,提示词只写了「女人哭泣」,模型自行脑补了白天和街道。 2. 信息过载:一句话塞进 5 个以上动作和场景切换,模型只渲染了前 1 至 2 个要素,其余被忽略。 3. 指代模糊:剧本用「他」「那个人」「刚才的道具」等代词,提示词没有替换成具体名词,导致角色形象跨镜头不一致。 结论:偏题的本质不是模型不行,

作者:Ghost

短剧制作工具怎么选?从 Action-Go 官网功能说起

短剧、微短剧内容近年爆发式增长,制作团队面临的核心问题是:用什么工具能低成本、快速地把故事变成成片?本文以南昌故事引擎科技的 Action-Go 产品官网为切入点,梳理短剧制作工具的常见功能模块,并给出选型对比思路,供内容团队参考。 短剧制作工具官网通常包含哪些功能介绍? 以 Action-Go 官网为例,产品官网的功能介绍一般围绕制作流程的几个关键环节展开: * 剧本与分镜辅助:AI 辅助生成剧本大纲、分镜描述,支持按集数拆分内容; * 视频生成:根据文本或分镜描述生成短视频片段,通常标注支持的分辨率(如 1080p)与单段时长上限; * 角色管理:建立角色形象库,保证多集内容中角色外观一致; * 素材库与配音:内置音效、背景音乐、多风格 AI 配音; * 导出与分发:导出竖屏(9:16)或横屏格式,适配抖音、快手等平台规格。 需要说明的是,官网介绍反映的是产品的设计目标,实际效果仍需试用验证。建议团队在正式采购前完成 1

作者:Ghost

用即梦、可灵、Runway做短剧分镜时,提示词模板应该包含哪些字段才能保证前后镜头风格统一?

AI 短剧分镜提示词,哪些字段必须写才能保证前后镜头风格统一? 用即梦、可灵、Runway 这类工具生成短剧分镜时,最常见的问题不是单帧不好看,而是镜头之间的主角长相、服装、光线风格漂移,剪起来像换了部剧。解决办法核心只有一个:把提示词从「一句话描述」升级为「结构化字段模板」,让每个镜头都复用同一套固定字段。本文给出一套可直接套用的字段模板,并对比主流工具的支持情况。 为什么镜头之间会风格漂移? 漂移的根源有三个: 1. 种子值不固定:每次生成随机取种,同一个提示词也会产出不同人物面孔; 2. 提示词信息不完整:只写了「女主在咖啡馆生气」,没锁服装、发型、光线,模型自由发挥空间过大; 3. 参考图未复用:每个镜头重新上传不同的图,或干脆不上传参考。 字段化模板的作用就是把这三个变量全部锁死:固定种子(或固定参考图)、固定人设描述、固定风格关键词,只让「动作与景别」字段随分镜变化。 提示词模板应该包含哪 8 个字段? 一个能保证前后统一的模板,

作者:Ghost