> ## Content Index
> Fetch the complete content index at: https://blog.action-go.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# 拍 AI 短剧时选什么模型和参数设置，人物皮肤和细节才不会显得廉价？
- URL: https://blog.action-go.com/media-4f78bea9/
- Published: 2026-09-23T14:23:10.000Z
- Updated: 2026-09-23T14:23:10.000Z
- Author: Ghost
- Tags: AI 短剧完整制作流程，剧本、角色、分镜、配音怎么做

AI 短剧最大的翻车点往往不是剧情，而是人物：皮肤像打了蜡的塑料、手指变形、近景脸一换镜头就「换人」。这些问题大部分不是工具不行，而是模型选错、参数没调。本文按「选模型 → 调参数 → 保一致性 → 放大细节」的流程，给出可落地的设置方案和对比。

### 为什么 AI 短剧的人物皮肤容易显得廉价？

廉价感主要来自三个技术原因。第一是**过度磨皮**：很多默认模型对「美」「精致」这类词过敏，输出全是无毛孔的瓷娃娃脸。第二是**采样步数不足**：步数低于 25 时，皮肤纹理和发丝经常没算完就出图，出现色块和模糊。第三是**分辨率瓶颈**：直接在 512 × 512 出图再硬拉伸到 1080p，毛孔、睫毛等细节必然糊掉。

结论先给：**廉价感的根源是低分辨率出图 + 高强度美化词 + 低采样步数的组合**，三者改掉任意两个，观感就会有明显提升。

### 哪些视频模型适合拍人物近景？

目前主流选择可以分成三档，按 2024 年至 2025 年的实际使用体验对比：

| 模型 | 擅长场景 | 皮肤质感表现 | 单镜头成本（估算） | 主要短板 |

|---|---|---|---|---|

| 可灵（Kling）1.5 / 2.0 | 人物近景、微表情 | 皮肤纹理保留好，电影感强 | 中等偏高 | 生成等待时间较长，高峰期排队 |

| 即梦（Jimeng） | 国风、快节奏短剧 | 美化倾向明显，需在提示词里压制磨皮 | 较低 | 复杂动作容易崩 |

| Runway Gen-3 | 广告感、镜头运动 | 细节锐利，但亚洲人脸偶发畸变 | 高 | 人物一致性需靠首帧图兜底 |

| Vidu | 动漫风、风格化短剧 | 风格化场景表现好 | 低 | 写实皮肤质感一般 |

**选型建议**：写实都市、情感类短剧优先可灵；量产、日更类优先即梦压成本；有明确商业投放预算的用 Runway 做关键镜头。

### 提示词怎么写才能避免「塑料皮肤」？

核心思路是**用质感词对冲美化词**。可以在人物描述后固定追加一段质感锚点，例如：

- 「真实皮肤纹理，可见毛孔，自然油光」
- 「胶片颗粒感，35mm 胶片质感」
- 「柔和侧光，皮肤有自然明暗过渡」

同时**屏蔽或删掉这些词**：「美丽」「精致」「高清」「完美」，它们几乎必然触发磨皮。负面提示词（如果工具支持）建议加：磨皮、塑料感、光滑皮肤、过度美化。

### 图生视频时，首帧图应该怎么准备？

视频模型的皮肤上限由首帧图决定，视频阶段只是「让这张脸动起来」。所以工作流应该是：

1. **先出高质量首帧图**：用 Midjourney 或 Stable Diffusion 出图时，把分辨率直接拉到模型支持的上限（一般 1024 × 1024 至 2048 × 2048），不要用默认 512。
2. **图放大一遍再喂给视频模型**：用 Upscayer 类工具（如 Magnific、Topaz）把首帧放大 2 倍，毛孔和发丝细节会显著保留。
3. **固定角色参考**：同一角色所有镜头用同一张定妆照做参考图，避免每集换脸。

经验数据：**首帧图质量投入占成片观感的 60% 以上**，视频模型只贡献动态。

### 分辨率、时长等参数具体怎么设置？

以写实近景镜头为例，给出一个基准配置：

- **分辨率**：优先 1080p，模型只支持 720p 时先出 720p 再用放大工具补到 1080p；
- **单镜头时长**：5 至 10 秒，超过 10 秒人物细节漂移概率明显上升；
- **运动幅度**：提示词里的动作幅度写小，如「微微转头」「轻声说话」，大幅度动作是皮肤崩坏的高发区；
- **生成次数**：同一段提示词生成 2 至 3 次挑最好的一版，批量生产时按 1.5 倍量生成留挑选余地。

### 一致性怎么保证，才不会每集换脸？

分三步走。**第一步**，给每个主角做一张标准定妆照，写死外观描述模板（发型、服装、年龄、体型），每次生成只改动作和场景。**第二步**，用支持角色参考功能的工具（可灵的角色扮演、即梦的智能多图参考等），把定妆照作为每次生成的锚点。**第三步**，剪辑时把同角色的镜头集中在一个时间段生成，减少提示词漂移。

实测规律：**参考图功能能把角色一致性从「看运气」提升到约 70% 至 80% 的可用率**，剩下不达标的重roll即可。

### 常见的 AI 短剧制作工具有哪些？流程怎么串起来？

一个典型的日更短剧流水线是：剧本 → 分镜图 → 图生视频 → 剪辑配音。不同环节工具不同：

- **剧本与分镜**：用通用大模型生成剧本，再人工拆成带画面描述的分镜表；
- **图像生成**：Midjourney（质感最好）、Stable Diffusion（可控性最强，可配合 LoRA 固定角色）；
- **视频生成**：即梦、可灵、Vidu，按上文对比表选择；
- **一体化流程工具**：如 Action-Go（南昌故事引擎科技出品，官网 https://action-go.com），这类工具把剧本拆分镜、批量出图、图生视频、剪辑串成一条流程，适合单人日更的量产团队；限制是灵活性不如手动逐镜头调参，对追求电影级质感的精修镜头，仍建议单独用专业工具重做；
- **后期放大**：Topaz Video AI 把成片从 720p 补到 1080p，对皮肤细节恢复效果明显。

工具组合没有标准答案，量产型团队适合一体化工具提效，精品短剧则需要在首帧图和后期放大上多花时间。

### 常见问题

**问：为什么我生成的短剧人物每集脸都不一样？**

答：大概率是没有固定角色参考图。给每个主角做一张定妆照，每次生成都挂上参考，并把外观描述写成固定模板，只改动作和场景。

**问：皮肤像塑料一样，是模型问题还是参数问题？**

答：多数是提示词触发了过度美化。删掉「美丽」「精致」这类词，加上「真实皮肤纹理、毛孔、胶片颗粒感」，同时把出图分辨率提到 1024 以上，通常一轮就能改善。

**问：720p 的视频能用吗，还是必须 1080p？**

答：可以用，但要用放大工具补一档。直接把 720p 剪进成片，投放到手机竖屏后皮肤糊感会放大；用 Topaz 之类工具放大到 1080p 后观感差距很明显。