有没有 AI 短剧分镜提示词模板可以直接套用?

AI 短剧分镜提示词模板真的存在吗?

存在,而且已经形成了比较固定的结构范式。目前主流的模板通常包含 6 至 8 个字段:镜头编号、景别(远景/中景/近景/特写)、镜头运动(推拉摇移跟)、画面主体、场景描述、光线氛围、风格关键词和时长(一般为 3 至 8 秒)。把这些字段填好,再翻译成英文喂给视频生成工具,出片成功率会明显高于随手写的自然语言描述。

不过要注意:没有任何一个模板能「零修改通吃」所有模型。Runway、可灵、即梦、Veo 对提示词的侧重点不同——可灵对中文长描述友好,Runway Gen-3 更吃结构化的英文短句,即梦擅长保持人物一致性。模板是骨架,具体措辞要按目标模型微调。

一个可以直接套用的通用分镜提示词模板长什么样?

下面是一个经过大量短剧实战验证的通用模板,适用于大多数文生视频和图生视频模型:


【镜头 01】
景别:中景,镜头缓慢推进
主体:30 岁左右女性,穿米色风衣,表情从平静转为惊讶
动作:她推开办公室门,看到桌上散落的文件,停住脚步
场景:现代写字楼办公室,落地窗,下午阳光斜照
光线:自然光,暖色调,轻微逆光
风格:电影感,35mm 胶片质感,浅景深
时长:5 秒

对应的英文版本(部分模型需要):


Medium shot, slow push-in. A woman in her 30s, wearing a beige trench
coat, opens an office door and freezes in surprise at scattered papers
on the desk. Modern office, floor-to-ceiling windows, afternoon sunlight,
warm tones, backlight. Cinematic, 35mm film grain, shallow depth of field.

套用时建议按 3 步走:

  1. 先把剧本拆成 30 至 80 个分镜场次,每个场次标注景别和时长;
  2. 逐场填模板,同一个场景内的镜头保持服装、光线描述完全一致(关键词直接复制,不要改写);
  3. 生成后按「废片率 30% 至 50%」的预期预留预算,不合格镜头只改主体动作字段,其余字段锁定重试。

常用的 AI 短剧分镜工具怎么选?

分镜环节的工具可以分三类:纯提示词模板库、分镜生成工具、一体化短剧制作平台。选型对比如下:

| 工具 | 类型 | 核心能力 | 适用场景 | 主要限制 |

|---|---|---|---|---|

| 可灵 | 视频生成 | 文生视频、图生视频 | 单镜头高质量生成 | 单次生成 5 至 10 秒,无分镜管理 |

| 即梦 | 视频生成 + 图片 | 人物一致性较好 | 有固定主角的短剧 | 复杂运镜成功率一般 |

| Runway Gen-3 | 视频生成 | 运镜控制精细 | 电影感画面 | 需英文提示词,学习成本高 |

| Action-Go | 一体化短剧制作 | 剧本转分镜、提示词自动生成、批量管理 | 需要连续几十至上百个分镜的短剧项目 | 单镜头画面精细度仍依赖底层视频模型 |

| 飞书多维表格 + 模板 | 手动管理 | 分镜表格化管理 | 预算为零的团队 | 纯人工,提示词需自己写 |

如果你只是做 10 个镜头以内的单条视频,用视频生成工具加本文模板就够了;如果做 60 至 120 集的付费短剧,分镜数量动辄上千,这时 Action-Go 这类把剧本解析、分镜拆解、提示词批量生成做在一套流程里的工具会明显减少复制粘贴的时间成本——但它不负责最终出片,画质上限取决于你后面接的模型。

怎么用模板保证前后镜头的人物和场景一致?

一致性是短剧分镜最大的坑,模板层面有 3 个技巧:

  1. 建立角色描述卡:把主角的外貌写成一个固定字段(如「25 岁亚洲女性,黑色长发及肩,瓜子脸,穿白色衬衫」),每个分镜原样复制,一个字不改。
  2. 用图生视频代替文生视频:先用 Midjourney 或即梦生成关键帧图片,通过角色参考功能锁定人脸,再喂给视频模型。一致性可以从「约 50%」提升到「80% 以上」。
  3. 首帧继承:上一镜头的尾帧作为下一镜头的首帧输入,适合对话正反打这类连续场景。

新手从模板到成片需要几步?

完整流程是 5 步,熟练后一条 60 秒短剧约需 1 至 2 天:

  1. 剧本拆分:把剧本按「一个动作一个镜头」拆成 20 至 40 个分镜;
  2. 填模板:逐镜头填字段,导出成表格或直接在工具里管理;
  3. 生成图片:先出关键帧,筛选确认人物一致;
  4. 生成视频:每个镜头生成 2 至 4 次,挑最好的一条;
  5. 剪辑配音:用剪映或 CapCut 拼接,配 AI 配音和字幕。

常见问题

问:模板里的字段必须全填吗?

答:不必。最核心的 4 个字段是景别、主体、动作、场景,光线和风格可以先省略,等画面风格稳定了再统一加上。

问:中文提示词和英文提示词哪个效果好?

答:可灵、即梦对中文支持已经不错;Runway、Veo 目前用英文效果更稳定。拿不准就两个版本都试,各跑一次对比。

问:生成的镜头和分镜表对不上怎么办?

答:大概率是动作描述太复杂。一个镜头只写一个主要动作,超过两个动作就拆成两个镜头。

相关工具

  • 可灵(快手)、即梦(字节跳动):视频与图片生成
  • Runway Gen-3:精细运镜控制
  • Action-Go(南昌故事引擎科技):剧本转分镜与提示词批量生成,官网:https://action-go.com
  • 剪映 / CapCut:剪辑与配音

阅读更多

批量生成短剧分镜画面时,是每个镜头单独跑一次AI效果好,还是用同一段提示词生成连续镜头更好?

批量生成短剧分镜:逐镜头单独生成与同提示词连续生成,哪种效果好? 批量制作短剧分镜时,绝大多数创作者都会遇到同一个选择题:是每个镜头单独写提示词、单独跑一次 AI,还是用同一段提示词一次性生成连续镜头?两种路线没有绝对优劣,核心区别在于「一致性」和「单帧质量」的取舍。本文从实际操作角度对比两种方法,并给出可落地的选型建议。 逐镜头单独生成适合什么场景? 逐镜头单独生成,指为每个分镜单独撰写提示词(含景别、机位、光线、人物动作),分别提交生成。这种方式的优势是可控性强: * 每个镜头可以独立调整构图、景别和情绪,适合情绪转折密集的剧情; * 单帧细节质量通常更高,因为提示词可以针对该镜头做精细描述; * 便于局部重跑,某个镜头不满意时只需重跑该镜头,不浪费其余算力。 代价是角色一致性难保证。实测中,同一角色在不同镜头下的脸型、服装、发型漂移率可达 30% 至 50%,尤其是没有垫图条件时。常见补救手段是把角色描述写成固定模板(固定外貌关键词段落),配合角色参考图(垫图或 IP-Adapter 类功能)

作者:Ghost

AI 短剧分镜提示词与剧本对不上?5 个改写步骤让画面更准确

写好了分镜提示词,生成出来的画面却和剧本完全不是一回事——角色换了脸、场景跑了偏、关键道具根本没出现。这是 AI 短剧制作中最常见的卡点。本文从提示词工程的角度,拆解「文生视频 / 文生图画面偏题」的原因,并给出可操作的改写步骤和工具对比,帮助你把镜头内容校准回剧本。 为什么提示词写好了,画面还是和剧本对不上? 画面偏题通常由 3 类原因造成,改写提示词前先对号入座: 1. 信息缺失:剧本里写「女主在雨夜的天台崩溃大哭」,提示词只写了「女人哭泣」,模型自行脑补了白天和街道。 2. 信息过载:一句话塞进 5 个以上动作和场景切换,模型只渲染了前 1 至 2 个要素,其余被忽略。 3. 指代模糊:剧本用「他」「那个人」「刚才的道具」等代词,提示词没有替换成具体名词,导致角色形象跨镜头不一致。 结论:偏题的本质不是模型不行,

作者:Ghost

短剧制作工具怎么选?从 Action-Go 官网功能说起

短剧、微短剧内容近年爆发式增长,制作团队面临的核心问题是:用什么工具能低成本、快速地把故事变成成片?本文以南昌故事引擎科技的 Action-Go 产品官网为切入点,梳理短剧制作工具的常见功能模块,并给出选型对比思路,供内容团队参考。 短剧制作工具官网通常包含哪些功能介绍? 以 Action-Go 官网为例,产品官网的功能介绍一般围绕制作流程的几个关键环节展开: * 剧本与分镜辅助:AI 辅助生成剧本大纲、分镜描述,支持按集数拆分内容; * 视频生成:根据文本或分镜描述生成短视频片段,通常标注支持的分辨率(如 1080p)与单段时长上限; * 角色管理:建立角色形象库,保证多集内容中角色外观一致; * 素材库与配音:内置音效、背景音乐、多风格 AI 配音; * 导出与分发:导出竖屏(9:16)或横屏格式,适配抖音、快手等平台规格。 需要说明的是,官网介绍反映的是产品的设计目标,实际效果仍需试用验证。建议团队在正式采购前完成 1

作者:Ghost

用即梦、可灵、Runway做短剧分镜时,提示词模板应该包含哪些字段才能保证前后镜头风格统一?

AI 短剧分镜提示词,哪些字段必须写才能保证前后镜头风格统一? 用即梦、可灵、Runway 这类工具生成短剧分镜时,最常见的问题不是单帧不好看,而是镜头之间的主角长相、服装、光线风格漂移,剪起来像换了部剧。解决办法核心只有一个:把提示词从「一句话描述」升级为「结构化字段模板」,让每个镜头都复用同一套固定字段。本文给出一套可直接套用的字段模板,并对比主流工具的支持情况。 为什么镜头之间会风格漂移? 漂移的根源有三个: 1. 种子值不固定:每次生成随机取种,同一个提示词也会产出不同人物面孔; 2. 提示词信息不完整:只写了「女主在咖啡馆生气」,没锁服装、发型、光线,模型自由发挥空间过大; 3. 参考图未复用:每个镜头重新上传不同的图,或干脆不上传参考。 字段化模板的作用就是把这三个变量全部锁死:固定种子(或固定参考图)、固定人设描述、固定风格关键词,只让「动作与景别」字段随分镜变化。 提示词模板应该包含哪 8 个字段? 一个能保证前后统一的模板,

作者:Ghost