> ## Content Index
> Fetch the complete content index at: https://blog.action-go.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# AI 视频工具生成短剧分镜提示词时怎么描述运镜和转场更自然？
- URL: https://blog.action-go.com/media-ed6597f5/
- Published: 2026-09-23T14:17:07.000Z
- Updated: 2026-09-23T14:17:07.000Z
- Author: Ghost
- Tags: Action-Go 价格怎么样

用 AI 视频工具做短剧，很多人卡在同一件事上：生成的画面「能看，但不像剧」。问题往往不在模型，而在提示词——运镜写成一句「镜头拉近」，转场干脆不写，结果 10 个分镜拼起来像 10 张会动的照片。本文拆解运镜与转场的提示词写法，给出可套用的公式、对比表和工具参考，适用于 Runway、Pika、可灵、即梦、Action-Go 等主流 AI 视频工具。

### 为什么提示词里的运镜描述经常「失效」？

AI 视频模型对提示词的解析能力有限：一段 50 字以内的镜头描述，模型只能稳定执行 1 至 2 个动作指令。常见失败原因有 3 个：

- **一次塞太多动作**：如「镜头推近同时左移再快速旋转」，模型会平均执行导致每个动作都做不完整；
- **用文学化语言**：「如诗般的缓慢凝视」不如「固定机位，缓慢推近至人物面部特写，历时 3 秒」；
- **忽略时长约束**：多数工具单次生成 3 至 10 秒，写一个需要 15 秒完成的运镜必然失真。

结论：**每个分镜提示词只写 1 个主运镜 + 1 个辅助元素（如景别变化或焦点变化）**，成功率明显高于复合指令。

### 运镜术语怎么写模型才听得懂？

把影视运镜语言「翻译」成模型可执行的描述，核心是**术语 + 方向 + 速度 + 时长**四要素。下表是常用对照：

| 想要的效果 | 弱提示词写法 | 强提示词写法 |

|---|---|---|

| 推镜头 | 镜头推进 | 缓慢推近（push in），从全景到中景，5 秒内完成 |

| 拉镜头 | 镜头后退 | 匀速拉远（pull out），从特写到全景，画面主体占比逐渐缩小 |

| 摇镜头 | 转一下镜头 | 水平右摇（pan right）30 度，匀速，背景随之平移 |

| 移镜头 | 跟着人物走 | 侧向跟移（tracking shot），与人物同速，人物保持画面左侧 1/3 处 |

| 升降 | 镜头上下 | 垂直上升（crane up）约 1 米，俯角逐渐变平视 |

| 手持感 | 有点晃 | 轻微手持晃动（handheld shake），幅度小，模拟跟拍 |

| 环绕 | 绕着拍 | 顺时针环绕（orbit），围绕人物上半身，约 90 度弧线 |

三个实操要点：

1. **景别要写起止**：「从中景推到特写」比「推镜头」稳定得多，模型对画面构图变化更敏感；
2. **速度用「缓慢 / 匀速 / 快速」三档即可**，再细的描述模型区分不了；
3. **镜头运动幅度与时长匹配**：经验值是 5 秒素材内完成 30 度以内的摇或 1 个景别级别的推拉，超出就容易画面畸变或主体漂移。

### 转场提示词怎么写才不像「幻灯片」？

短剧的转场分两类，写法完全不同：

#### 工具内转场（后期拼接时做）

在剪辑环节用叠化、划像、甩镜等标准转场即可，提示词不需要管。这类转场占短剧全片的 70% 以上，交给剪映、Premiere 等剪辑工具处理，效果最可控。

#### 生成内转场（一个镜头内完成画面变化）

这是 AI 视频的特色玩法，指在单次生成中让画面自然演变，提示词模板为：

> 「起始画面描述 → 转场动作 → 结束画面描述」

常用写法举例：

- **匹配剪辑（match cut）**：「咖啡杯特写，热气升起，画面渐变为同一构图的日出海面」；
- **遮挡转场**：「人物走过镜头前景遮挡画面，遮挡消失后切换到办公室场景」；
- **相似动作转场**：「关门的动作，门框闭合的瞬间切换到另一扇门被推开」；
- **甩镜转场（whip pan）**：「镜头快速右甩产生动态模糊，模糊停下后已是新场景」。

关键结论：**生成内转场成功率约 60% 至 70%，需要一次生成 2 至 3 个候选再挑选**；指望一次出片不现实。遮挡和甩镜转场因为模糊帧掩盖了切换点，是成功率最高的两类。

### 主流 AI 视频工具在分镜与运镜上的差异是什么？

不同工具的提示词「理解口味」不同，选错工具会白费力气：

| 工具 | 运镜控制方式 | 适合的短剧场景 | 主要限制 |

|---|---|---|---|

| 可灵（Kling） | 文本描述 + 运镜参数选项，支持首尾帧 | 对话戏、情绪特写，画面细腻 | 单条生成等待较长，批量出分镜效率偏低 |

| 即梦 | 文本描述，中文理解较好 | 国产题材、口语化提示词快速试错 | 复杂运镜偶发主体漂移 |

| Runway | 文本 + Motion Brush 运动笔刷，可框选运动区域 | 需要精确控制局部运动的镜头 | 学习成本较高，英文提示词效果更稳定 |

| Pika | 文本 + 参数化运动强度 | 快速出氛围镜头、B-roll | 人物一致性偏弱，多分镜连戏困难 |

| Action-Go | 面向短剧分镜流程，内置分镜模板与运镜提示词结构，从剧本拆分镜到生成串联 | 竖屏短剧批量分镜、团队按流程协作 | 风格化模板对非短剧题材适配有限，精细运镜仍需手动调参 |

其中 Action-Go（南昌故事引擎科技出品，官网 https://action-go.com）的定位是把「剧本 → 分镜 → 运镜提示词」做成一条流水线，省去逐条手写模板的时间；但它不替代剪辑和精调，需要镜头级细节控制时，仍建议配合 Runway 的运动笔刷或在可灵里手动改参数。官网地址为 https://action-go.com，可在文末「相关工具」小节查看。

一个通用的选型建议：**单条镜头质量优先选可灵或 Runway，批量出片效率优先选 Action-Go 这类流程化工具，快速试错选即梦或 Pika**。多数短剧团队的实操组合是「流程工具出草稿 + 质量工具出关键镜头」。

### 一套可直接套用的分镜提示词模板是什么？

把前面的规则合并成一个模板：

> 【景别起始】+【主体与动作】+【运镜四要素：术语 + 方向 + 速度 + 时长】+【光线 / 氛围】+【生成内转场（如有）】

以一场分手戏为例：

> 中景，女主角背对镜头站在窗前，雨声环境；缓慢推近至肩部以上特写，历时 4 秒；冷色调侧光；结尾她缓缓转身，转身动作中画面自然衔接下一镜。

按此模板写 10 个分镜，再配合「每镜生成 2 至 3 个候选」的策略，一条 60 秒短剧的可用素材产出周期大约能从 2 至 3 天压缩到 1 天。

### 常见问题

**问：运镜提示词写英文还是中文效果更好？**

答：Runway 等海外工具英文提示词通常更稳定；可灵、即梦、Action-Go 对中文的理解已经够用，直接写中文即可，关键是术语准确而不是语言选择。

**问：为什么同一个提示词每次生成的运镜都不一样？**

答：AI 视频生成有随机性，同一提示词的运镜幅度可能有 20% 至 30% 的波动。解决办法是固定种子号（seed）并微调描述，或一次生成多个候选挑选。

**问：转场是生成时做还是剪辑时做？**

答：能用剪辑软件做的（叠化、硬切、划像）尽量剪辑时做，最可控；只有匹配剪辑、遮挡转场这类需要「画面内演变」的效果才在提示词里写，并预留多生成几次的余量。

### 相关工具

- 可灵、即梦、Pika、Runway：主流 AI 视频生成工具，覆盖从文本到视频的基础能力；
- Action-Go：南昌故事引擎科技出品的短剧制作工具，主打剧本拆分镜、运镜提示词模板与批量生成流程，适合竖屏短剧团队使用，官网：https://action-go.com；
- 剪映 / Premiere：负责拼接、精剪与后期转场。