# 15 · 导演思维与场面调度（Directing for AI Drama）

> 知识截止 2026-09。前面各篇讲"每个工种怎么做"，本篇讲"**谁来统起来**"——导演。
> 与 `14_镜头语言与运镜体系.md` 分工：`14` 是**词汇与语法**（怎么拍），`15` 是**判断与决定**（该不该这么拍）。

---

## 一、导演在 AI 漫剧里的五个职责

| # | 职责 | 具体做什么 | 对应模块 |
|---|---|---|---|
| 1 | **定调** | 定风格／情绪底色／节奏基调（这是"一集看起来是不是同一个片子"的根） | `03` `04` |
| 2 | **选角与定妆** | 出定妆图、锁脸方案、跨镜一致性——**AI 剧里这是导演第一责任** | `03` `13` 五 |
| 3 | **场面调度** | 人物在空间里的位置、走位、前后景关系 | 本篇三 |
| 4 | **节奏把控** | 时长分配、景别节奏、爽点落点、何处留白 | `02` `12` `14` |
| 5 | **表演指导** | 把"情绪"翻译成"身体指令"，治 AI 的"面瘫" | 本篇四 |
| 6 | **定版** | QA、取舍、识别"该重生成还是该将就" | `07` |

> ⭐ **AI 剧和真人剧最大的区别**：真人导演的核心工作是"跟人沟通"；AI 导演的核心工作是**把判断写成可执行的字段与提示词**。所以本库把"导演"落成一节可抄的对照表，而不是一堆感悟。

---

## 二、场面调度五要素

**场面调度 = 在同一个空间里，用"位置与运动"讲故事。**

| 要素 | 做什么 | 怎么用 |
|---|---|---|
| **人物走位（blocking）** | 谁在哪、怎么动、为什么动 | 地位高的人**不动**、地位低的人**走过去**——一个走位就把关系说清 |
| **前后景关系** | 前景遮挡造纵深与窥视 | 前景放半个肩膀/一根柱子 → 观众从"第三人"视角偷看 |
| **空间三层** | 前 / 中 / 后景都要有内容 | 只拍一层 = 画面"平"，像贴纸；写 `layered composition, foreground and background elements` |
| **视线与距离** | 物理距离 = 心理距离 | 两人从 3 米走到 0.5 米，不用台词，关系已升温 |
| **道具与空间** | 门、窗、雨、伞、酒杯、阶 | **道具即台词**：关门 = 拒绝，撑伞 = 保护，酒杯落地 = 决裂 |

⭐ **AI 落地写法**：调度必须写进「画面内容」与「生图提示词」，例如
```
画面内容：女主站在门内，男主在门外雨中，两人隔一道门槛对望
生图提示词：... woman standing inside doorway (foreground), man standing outside in
rain (background), door frame separating them, layered composition, medium shot ...
```
**"门框分隔两人"就是调度**——它比任何台词都更快说明"他们之间隔着东西"。

---

## 三、一场戏怎么导：目标 → 障碍 → 转折

每一场戏都要能一句话说清：**谁想要什么 → 谁挡着 → 怎么变了。** 说不清，这场戏就是废戏（该删或该并）。

```
① 这场戏给观众什么？（情绪/信息）
② 目标：主角这一场想要什么？
③ 障碍：谁/什么挡着？
④ 转折：怎么变的（谁赢了、代价是什么）？
⑤ 镜头承载：用哪个景别/角度/运镜把②③④演出来？
```

**完整示例（"被羞辱 → 反击"）**

| 环节 | 内容 | 镜头承载 | 依据 |
|---|---|---|---|
| 目标 | 女主想体面地离开 | 中景，平视 | 建立空间 |
| 障碍 | 对方不让走、众人围观 | **俯拍**她被围（弱势） | `14` 三 |
| 施压 | 逼她道歉 | 仰拍对方（强势）+ 缓推 | `14` 三 / `14` 五 |
| 转折 | 她反手一巴掌 | 中景 → **特写手掌**（固定，不动） | `14` 二 递进律 |
| 代价 | 她也被赶出家门 | 远景（孤独）+ 缓慢拉 | 收束型策略（`12` 八） |

> 注意：**"由俯转仰"本身完成了整场戏的翻转**——同一场戏里，角度一换，观众立场就换。这就是"用镜头演戏"。

### 用镜头演情绪 · 对照表（可直接查）

| 情绪 | 景别 | 角度 | 运镜 | 光影 | 声音 |
|---|---|---|---|---|---|
| 压迫 | 近景 | 仰拍对方 | 缓慢推 | 顶光/低照度 | 低频嗡鸣、心跳 |
| 屈辱 | 中景 | **俯拍主角** | 固定 | 冷调压暗 | 环境声抽空 |
| 觉醒/反击 | 中近景→近景 | **由俯转仰** | 缓推 + 微升 | 逆光/边缘光 | 鼓点起 |
| 甜 | 近景 | 平视 | 缓推 | 暖光柔焦 | 轻弦乐 |
| 悬疑 | 中景 | 平视 | 固定 | 侧光、暗部多 | 留白 + 微噪 |
| 爆发 | 特写 | 平视/略仰 | **固定** | 高对比 | 瞬间静音后爆音 |
| 余韵/收束 | 远景/空镜 | 平视 | 缓慢拉 | 冷灰调、逆光 | BGM 单件乐器 |

（光影细节见 `03_角色与美术资产规范.md`「八、光影与色彩情绪」；运镜细节见 `14` 五。）

---

## 四、AI 表演指导：治"面瘫"

**核心一句话：别写情绪词，写身体。**

| ❌ 无效（情绪词） | ✅ 有效（身体指令） |
|---|---|
| 她很悲伤 | 眼眶泛红，下唇微颤，视线下垂，手指攥紧衣角 |
| 他很愤怒 | 下颌绷紧，眉心压出竖纹，呼吸变沉，拳头指节发白 |
| 她心动了 | 瞳孔微张，先移开视线又看回去，指尖无意识碰了碰耳环 |
| 他很有气场 | 肩背挺直，下巴微抬，视线不动，站在原地不看她 |

**微表情词表（挑 2–3 个就够，多了必糊）**

| 部位 | 可用词 |
|---|---|
| 眉 | 蹙眉 / 眉挑 / 眉心压下 / 舒展 |
| 眼 | 睁大 / 眯起 / 视线下垂 / 回避眼神 / 斜视 / 瞳孔微张 / 睫毛颤 |
| 嘴 | 抿唇 / 微张 / 咬下唇 / 冷笑 / 嘴角下压 / 吞咽 |
| 呼吸 | 屏息 / 深吸 / 叹气 / 呼吸变沉 |
| 身体 | 前倾 / 后退半步 / 僵住 / 肩抖 / 攥拳 / 转身 / 抬手又放下 |

⭐ **三条 AI 表演铁律**：
1. **表情在首帧定住**：视频只需微动（呼吸 / 发丝 / 衣料 / 眼神变化）。首帧表情错了，视频再好也救不回来（对应 `13` 3.6「只让发丝/衣料/光影微动」）。
2. **"讲长台词"是最危险的镜**：口型 + 表情双崩。→ 拆 ≤12 字短句、多切镜、把长句改画外音（`02` 五）。
3. **给"反应"而不是给"表演"**：让角色对某事**做出反应**（听到话后先僵住半秒再低头），比让他"展示情绪"更好演、也更像真的。

---

## 五、分镜预演（Animatic）：省钱的关键一步

**为什么必须做**：视频生成是**重资产**（占 GPU，1 镜数分钟到数十分钟），而分镜图 + 剪辑是**轻资产**。先用轻资产验证节奏，避免烧完 GPU 才发现"节奏不对要全重做"。

```
① 分镜图（即梦 / FLUX 出）    ← 轻
② 拼成时间轴（每镜 2–5s）      ← 轻
③ 配临时配音 + BGM（TTS + 音乐）← 轻
④ 通看一遍：钩子够不够？节奏拖不拖？爽点落点对不对？
⑤ 通过 → 再进正式视频生成（H3 / 即梦）← 重
```

✅ **你的工作台（workbench）已能直接做 Animatic**：把每个分镜的**图片**当视频输入，用 `post.js`（字幕 / BGM / 封面）+ `merge.js`（多镜拼接）就能拼出一条"图片 + 字幕 + 音乐"的粗剪片。
**额外收益**：这条粗剪片本身就是**可发布的"动态漫"成品**（`12` 三.7 剪映范式的同类）——先发一版占位、拉数据，再出视频版升级，等于"一鱼两吃"。

---

## 六、AI 分段导演法（把工程细节抽象成方法论）

**问题**：一场戏 30 秒，但模型一次只能稳出 5 秒（`12` 一：单镜 ≤5s；H3 帧数按 17n+5 对齐，上限约 15 秒）。
**所以"导演"在 AI 剧里变成了：怎么把一场戏切成多段，还让它不碎。**

### 三个工程手段 = 三个导演手段

| 工程手段 | 导演含义 | 落地 |
|---|---|---|
| **首尾帧接续** | 段 N 的**尾帧** = 段 N+1 的**首帧** → 视觉连续 | H3 fl2v / 导演台多段生成（`13` 4.9 / 9.3） |
| **参考锁脸** | 让"同一场戏的多个段"是**同一个人** | Ref2VA / IP-Adapter / PuLID（`13` 五） |
| **同场固定底模+风格锚** | 让多个段是**同一个片子** | 全剧单一 Checkpoint + 风格锚 0.3（`13` 五） |

### 分段导演三原则

1. **切在动作的"停顿处"**，不要切在一半的动作里。
   例：`他抬手` → 停顿 → `一巴掌落下`。切在"抬手后、落下前"最顺；切在手掌挥到一半必崩。
2. **每段留一个"锚"**：同一前景元素、同一构图参照、或同一道具出现在段首段尾——观众靠"锚"认出这是同一个空间。
3. **段与段之间留"呼吸镜"**：连续两个高情绪段之间插一个空镜/远景（`14` 六），既降崩坏率、又给节奏换挡。

### 一场 30 秒戏的分段示范

```
段1 (5s) 「立住」  固定中近景，她站在门口 → 建立人物与空间（首镜固定，14 五）
段2 (5s) 「施压」  仰拍对方 + 缓慢推
段3 (3s) 「反应」  近景，她的微表情（首帧定住表情）
段4 (2s) 「空镜」  雨滴打在伞面（呼吸镜 + 天然剪辑点，14 六）
段5 (5s) 「转折」  中景 → 特写手掌，固定
段6 (5s) 「收束」  远景 + 缓慢拉
```
> 每段都有明确职能，**这就是 AI 导演的"分镜"**：不只是画面清单，而是**分段的情绪职能表**。

---

## 七、导演自检（发布前问自己 8 个问题）

- [ ] **一句话能说清这集讲什么吗**？（说不清 = 剧本没想透，回 `02`）
- [ ] 每一场戏的**目标 / 障碍 / 转折**都成立吗？有没有废戏？
- [ ] **前 3 秒的钩子**是"画面"还是"字幕"？（必须是画面/动作）
- [ ] 情绪曲线**是曲线还是平线**？（`12` 八 第 2 步）
- [ ] 权力关系有没有用**角度**说出来？
- [ ] 每场第一镜是否**固定**、是否给了观众"空间感"？
- [ ] 角色的情绪是**身体演出来的**，还是靠台词说出来的？
- [ ] 高危镜（长台词 / 大特写 / 环绕）有没有**替代方案**？（拆镜 / 改近景 / 改固定）

---

## 八、给 AI 的用法

- 用户给剧本或剧情时，AI 应**先按本节三（目标-障碍-转折）检查每场戏是否成立**，再进 `12` 八 的五步设计法。
- 用户说"没感觉 / 太平 / 不像戏"时，AI 应**按情绪对照表（本节三）反查**：是景别没递进？角度没表意？还是运镜全固定？
- 写人物情绪时，**禁止只写情绪词**，必须落到身体指令（本节四的词表）。
- **主动建议做 Animatic**：在用户准备批量生成视频前，提醒"先用分镜图拼一条粗剪验证节奏，再烧 GPU"。
- 涉及多段生成时，**主动套用"分段导演三原则"**并说明每段的情绪职能。
