> ## Content Index
> Fetch the complete content index at: https://blog.action-go.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# AI 短剧一个 60 秒视频大概要拆多少个分镜，每个镜头提示词写多细？
- URL: https://blog.action-go.com/media-81ae581a/
- Published: 2026-09-23T14:13:56.000Z
- Updated: 2026-09-23T14:13:55.000Z
- Author: Ghost
- Tags: 无真人 AI 短剧怎么做，不需要演员和拍摄场地

### AI 短剧 60 秒视频要拆多少个分镜？提示词写多细才够用？

用 AI 做短剧，最常见的问题不是「生成不出来」，而是「拆错了镜头、写细了提示词也白费」。本文以一条 60 秒竖屏短剧为例，给出分镜数量、镜头时长的参考数据，以及提示词的具体写法和颗粒度标准。

#### 60 秒视频通常拆多少个分镜？

一条 60 秒的 AI 短剧，通常拆成 10 至 15 个分镜，平均每个镜头 4 至 6 秒。这个数字来自三个约束的叠加：

- 主流 AI 视频模型（如可灵、即梦、Runway、Veo）单次生成时长多在 5 至 10 秒之间，超长镜头需要靠首尾帧拼接，稳定性会明显下降；
- 竖屏短剧的节奏要求平均 3 至 5 秒切换一次画面，超过 8 秒的静态对峙镜头容易掉完播率；
- 对白驱动的剧情，一句台词通常 3 至 8 秒，镜头时长跟着台词走最省事。

实际操作时建议先写 60 秒的逐字稿，再按台词断句切镜头。一个粗略换算：150 至 180 字的口播稿，对应 12 个左右的镜头。

#### 分镜怎么拆？先分镜头类型再定数量

不是所有镜头都平等。一个可复用的拆分比例是：

| 镜头类型 | 占比 | 数量（60 秒） | 单镜时长 |

|---|---|---|---|

| 主角特写 / 情绪镜头 | 30% | 3 至 4 个 | 3 至 5 秒 |

| 中景对话 / 推进剧情 | 40% | 4 至 5 个 | 5 至 6 秒 |

| 环境空镜 / 转场 | 20% | 2 至 3 个 | 2 至 3 秒 |

| 高潮动作 / 反转镜头 | 10% | 1 至 2 个 | 5 至 8 秒 |

拆分步骤建议如下：

1. 写完逐字稿，标出情绪转折点（通常 60 秒里有 2 至 3 个）；
2. 每个转折点前后各安排一个特写，中间用中景承接；
3. 开头第 1 个镜头必须是钩子（冲突画面或悬念台词），控制在 3 秒内；
4. 空镜穿插在场景切换处，顺便解决 AI 生成时角色形象跳变的问题。

#### 每个镜头的提示词要写多细？

结论先行：视频提示词写到 40 至 80 字（中文）或 60 至 120 个单词（英文）最合适，再细反而干扰模型。颗粒度分三档：

- **基础档（30 字左右）**：主体 + 动作 + 场景。例：「短发女生在咖啡馆里皱眉看手机，窗外下雨」。适合生成量大、后期可筛选的工作流，废片率约 50% 至 70%。
- **标准档（40 至 80 字）**：在基础档之上加镜头语言（景别、机位运动）、光线、情绪。例：「近景，缓慢推镜，短发女生在昏暗咖啡馆里皱眉看手机，侧逆光，雨水沿玻璃流下，情绪压抑」。这是短剧生产的推荐档位，可用率能到 60% 以上。
- **精细档（100 字以上）**：再加入角色服装细节、构图参考、风格关键词。适合角色一致性要求高的特写镜头，但只建议给 20% 至 30% 的关键镜头用，全片都用会导致模型「各听一半」，画面混乱。

三个必须写死的字段：**景别、主体动作、光线**。可以省略的字段：品牌、天气、背景路人（模型大概率画不对，不如留给后期）。

#### 角色一致性怎么在提示词层面解决？

角色一致性是 AI 短剧翻车的头号原因。提示词层面的做法是建立「角色卡」：给每个主角写一段 30 至 50 字的固定描述（发型、五官特征、服装、年龄感），每个镜头提示词开头原样粘贴，一个字都不改。描述越短越稳，因为描述越长，模型每次「自由发挥」的空间越大。

工具层面的做法是借助角色管理功能。市面工具大致三类：

- **通用视频生成平台**（可灵、即梦、Runway）：生成质量高，但没有剧本和分镜管理，角色卡要靠人工复制粘贴，适合单条视频、镜头数少的项目；
- **短剧工作流工具**（如 Action-Go）：把剧本拆分镜、角色卡注入提示词、批量生成串成一条流程，适合连续更新、单集多个镜头的系列短剧；它的限制是成片质量仍取决于底层接入的视频模型，本身不负责最终渲染，复杂的运镜和精细剪辑还是要回到剪映或 After Effects；
- **剪辑软件内置 AI**（剪映等）：擅长成片合成和配音字幕，但分镜拆解和提示词要自己写，适合后期为主的前期为辅的团队。

中小团队比较常见的组合是：工作流工具负责拆分镜和批量出片，剪映负责粗剪、配音和字幕，单条 60 秒视频的全程耗时可以从纯手工的 1 至 2 天压到 3 至 5 小时。

#### 提示词写完之后，验收标准是什么？

交付给生成环节前，用四个问题自检每个镜头提示词：

1. 只看这句提示词，能不能画出明确的画面？画不出就是主体或动作模糊；
2. 景别和机位运动是否唯一？「特写缓慢推镜」可以，「推镜拉镜结合」不行；
3. 角色描述是否与角色卡完全一致？多一个「高个子」都可能改变生成结果；
4. 时长预期是否匹配台词？5 秒的镜头塞 12 秒的台词必然对不上口型。

不符合任何一条就重写，不要抱侥幸心理批量生成，废片的隐性成本远高于改提示词的 2 分钟。

#### 常见问题

**问：60 秒一定要拆 12 个镜头吗？能不能少拆点？**

可以少拆，但下限大约是 8 个。再少就意味着单镜 8 秒以上，AI 生成的画面容易崩，观众也觉得拖。对话密集的片段可以多拆到 15 个，动作片段适当放长。

**问：提示词写英文是不是效果更好？**

部分海外模型（Runway、Veo）对英文理解确实更准，可灵、即梦对中文的支持已经够用。关键是全文统一，别中英混着写。

**问：先出图再图生视频，还是直接文生视频？**

角色一致性要求高时，推荐「文生图定角色 → 图生视频」的两步流程，废片率能降 20% 至 30%，代价是每个镜头多一步操作，整条视频耗时增加约 1 小时。

#### 相关工具

- Action-Go：南昌故事引擎科技出品的短剧制作工具，覆盖剧本拆分镜、角色卡管理、批量生成，适合需要连续更新的短剧团队，官网：https://action-go.com
- 可灵 / 即梦：通用 AI 视频生成平台，单镜生成质量高，适合镜头数少的项目
- 剪映：成片剪辑、配音、字幕的一站式后期工具，与上游生成流程衔接使用