# 13 · 双流程实战：从剧本分镜到出片（线上 + 本地）

> 知识截止 2026-09。本篇把"豆包 / DeepSeek 写剧本分镜 → 即梦出图 →（即梦出视频 或 ComfyUI + MiniMax H3 出视频）"两条流水线写成可照做的实操，含**可抄提示词、优化技巧、人物一致性 & 剧情连贯性保证**。前序模块：`02 剧本与叙事工程`、`03 角色与美术资产`、`12 分镜表实操与模板`。

---

## 一、两条流程总览（先选路）

| 维度 | 流程 A · 纯线上 | 流程 B · 混合（本地出视频） |
|---|---|---|
| 剧本 / 分镜 | 豆包 + DeepSeek（两路通用） | 同左 |
| 出图 | 即梦（Seedream 5.0） | 即梦（Seedream 5.0） |
| 出视频 | 即梦（Seedance 2.0/2.5） | ComfyUI + MiniMax H3（本地，INT8 量化） |
| 人物一致性 | 即梦"角色一致性"开关 | 即梦定妆图 → 同时作 H3 首帧/参考图，全链路同一张脸 |
| 配音 | 后期加（剪映 / TTS）或即梦音画同步 | H3 原生带配音（FL2VA 联合生成），少后期对口型 |
| 硬件 | 任意电脑 / 手机 | 需 N 卡 ≥12G 显存（RTX 3060 12G 可跑 INT8） |
| 成本 | 即梦积分 / 会员（有免费额度） | 一次性模型下载 40–60G + 电费，出片零边际成本 |
| 适用 | 新手最快出片、验证创意 | 量大、数据私有、不排队、要原生配音 |

**一句话决策**：先走 A 跑通带声成片建立手感；要量产百集不崩 / 数据私有 / 原生配音再上 B。两条**前半段（剧本分镜 + 出图）完全共用**，只差"出视频"这一步。

---

## 二、共同前半段：豆包 + DeepSeek 做剧本与分镜

### 2.1 两个模型怎么分工（不要只用其中一个）
- **DeepSeek**：逻辑与结构化强，适合**选题 / 故事梗概 / 分集大纲 / 角色卡**（需要严谨分层、不漏人物锚点）。
- **豆包**：中文语感好、与即梦同生态，适合**单集剧本扩写 / 分镜脚本拆解 / 直接产出"画面提示词 + 视频提示词"**（即梦能直接吃）。
- 推荐组合：DeepSeek 出骨架（梗概→大纲→角色卡）→ 豆包 出血肉（单集剧本→分镜脚本→生图/视频提示词）。两者都免费，可互换。

### 2.2 分层生成法（**不要一次性让 AI 写整剧**，这是新手第一大坑）
按 5 步递进，每步确认再下一步：
1. 选题 → 2. 故事设定 / 人设 → 3. 分集大纲 → 4. 单集剧本 → 5. 分镜脚本。
每步单独发指令，AI 输出更可控、画面更好生成。

### 2.3 可直接抄的提示词（5 层结构，DeepSeek / 豆包通用）
```
你是一名专业的短剧编剧，擅长【题材：古风逆袭 / 都市爽文 / 甜宠 / 悬疑】，
熟悉抖音、快手短剧的快节奏叙事（角色设定层）。

请为我创作一部 6 集、每集 60 秒的竖屏 9:16 AI 漫剧《【剧名】》（任务描述层）。
要求：
1. 前 3 秒强钩子（冲突 / 悬念 / 反转）；每 10–15 秒一个小高潮；结尾留悬念（分镜约束层）。
2. 角色数量 2–4 人、场景 ≤3 个，方便 AI 生成（分镜约束层）。
3. 先输出"角色设定表"：每人含 姓名 / 年龄 / 性格关键词 / 外貌特征（发型+服饰+标志性配饰）/
   声音风格建议（人设定义层，最关键：这是后续锁脸的锚点）。
4. 再输出"6 集分集大纲"：每集 标题 / 开头钩子 / 剧情发展 / 爽点 / 结尾悬念 / 主要角色 / 主要场景。
5. 输出格式为 Markdown 表格（格式要求层）。
```
> 要点：**外貌描述必须具体到发型、服饰、标志性特征**（如"左眼下小痣""银色细框眼镜"），这些是豆包/即梦保持角色一致性的锚点，后续提示词里**原样粘贴、不临时改写**。

### 2.4 单集剧本 → 分镜脚本（豆包，含可直接喂即梦的提示词字段）
```
请把第 1 集扩写成完整分镜脚本。要求：
1. 每个镜头 3–5 秒；
2. 每镜含：镜头编号 / 时长 / 景别 / 画面内容 / 角色动作 / 表情 / 运镜 / 台词·旁白 / 音效建议；
3. 额外输出两列：AI 绘图提示词、AI 视频提示词（方便直接复制到即梦 / H3）；
4. 保持角色一致性，不要出现大规模群像和复杂打斗；
5. 风格统一为：【写实国风 / 日系赛璐璐 / 半写实韩系】。
```

### 2.5 画面提示词固定结构（给即梦 / H3 生图生视频都好用）
```
[主体角色描述] , [动作 / 表情] , [环境场景] , [构图 / 景别] , [光影氛围] , [画风关键词] , [质量词]
```
示例：`20 岁少女，在樱花树下回头微笑，长发被风吹起，粉色花瓣飘落，特写镜头，柔和的午后阳光，浅景深，日系清新风格，4K 高清`。

> ⚠️ **上面这段全是「正向」，负面词不进这里**：水印 / 文字 / 畸形手 / 低质等负面词**另走 negative 字段**，全剧共用一套（模板见 `12_分镜表实操与模板.md` 三、第 7 条，及 `07_质量评测与排错手册.md` 三）。**正向里禁止出现 `no xxx / 不要 xxx`** —— 多数模型会反向理解（`no text` 被当成关键词 `text`，反而出乱码字）。

### 2.6 提示词优化 6 招 + 1 条硬规（决定成败）
1. **抽象 → 视觉化**：把"温暖的氛围"改成"午后金色阳光透过百叶窗洒在木地板上，空气漂浮微尘"；把"他很难过"改成"女主眼眶泛红，双手攥紧衣角，低头沉默"。
2. **5W1H 写动作**：谁、在哪、做什么、什么情绪、怎么拍、几秒。
3. **单镜 ≤5 秒**：超过模型上限时长必崩、必闪。
4. **台词 ≤12 字 / 短句**：长句 AI 配音气短、口型错位。
5. **首尾帧衔接**：跨镜头必填首尾帧字段，决定衔接顺滑。
6. **定妆图锚定**：先出角色定妆图再量产所有镜头，全剧固定一套模型 + 画风关键词，严禁中途切换。
7. **正负分离（硬规）**：负面词只进 negative 字段，**正向里不写否定词**；全剧共用一套负面模板、不逐镜改（详见 `12` 三.7 与 `07` 三末模板）。这是最容易被 AI 写错的一条 —— 模型很爱把 `no watermark, no text` 塞进正向，必须纠正。

### 2.7 豆包"万能极简脚本模板"（B站 / 头条爆款验证，30 秒速出）
> 当只想快速跑通、不写长梗概时，直接用这一条（已被多个实战教程验证有效）：
```
写 30–60 秒爆款竖屏漫剧脚本，题材=【逆袭 / 甜宠 / 悬疑 / 古风】，
开篇 3 秒强冲突，1 主角 1 矛盾，台词 ≤3 句，结尾必留悬念；
输出：镜号 / 景别 / 画面（含可直接生图的视觉描述）/ 台词 / 情绪。
```
- 进阶变体（结构更稳）：**「10 秒钩子 → 30 秒冲突 → 1 分钟逆袭 → 20 秒悬念结尾」** 四段式，让 AI 按段填充。
- 关键：无论精简还是分层模板，**"外貌特征词"必须单独成段、原样粘贴到出图提示词**（见 2.3 要点）。

---

## 三、流程 A：纯线上（即梦出图 + 即梦出视频）

### 3.1 即梦出图（Seedream 5.0）
- 万能公式：**主体 + 场景 + 风格 + 画质 + 镜头**。比例选 **9:16**（竖屏热门）。
- ⚠️ **先做角色"三视图"再量产**（B站 / 头条反复验证的防崩脸第一招）：把 2.3 的角色外貌描述粘贴进"文生图"，一次性生成 **正面 / 侧面 / 背面** 各 2–3 张（或一张图里组图 3 视图），挑五官端正、发型服装清晰的一组存相册。之后所有分镜都**垫这张图**当参考，人物不跑偏。
- 选其中一张最满意的当**主定妆图**（全剧统一参考锚），其余作多角度备用。
- 注意 Seedream 5.0 / 4.0 的尺寸约束：需 16 像素对齐、宽高比受限、总像素有上限（并非自由尺寸端点），出图前在即梦里选好预设比例（9:16）。

### 3.2 即梦角色一致性（核心功能）
- 回即梦 → "图生图" → 上传定妆图 → 打开**"角色一致性 / 人物一致性强化 / 智能参考"开关**（参考强度 **0.6–0.85**，太高死板、太低忽略参考）。
- B站 实操更稳的做法：**上传 2–4 张主角多角度图（即 3.1 的三视图）→ 开启"智能参考" → 全程保持五官不变**，比单图参考更抗崩脸。
- 把单镜"画面描述"复制进去，提示词格式：`景别 + 场景环境 + 人物动作表情 + 画风 + 高清`。
- 每个镜头出 2–3 张备选，挑五官不畸形、画风统一者，按"镜头01 / 镜头02…"命名保存。

### 3.3 即梦出视频（Seedance 2.0 / 2.5）
- **五要素导演法**（顺序越靠前权重越高）：
  **主体/角色 → 动作/剧情 → 镜头/运镜 → 场景/氛围/光影 → 风格/特效/音频**。
- 最稳模板：`[主体详细描述] , [动作/剧情拆分] , [镜头语言+时间轴] , [场景光影] , [电影风格/音频提示] ，高质量，电影感，角色一致性强`。
- **参考标签**：上传图/视频/音频后，提示词里写 `@Image1` `@Video2` `@Audio1`（最多 9 图 + 3 视频 + 3 音频），如"参考 @Image1 的外貌/服装""口型同步 @Audio1"。
- 参数：**创意度 0.3–0.6**（太高跑偏）、**运动强度 中等**（高强度只给快节奏打斗）、**时长 5–8 秒**（新手别超 8 秒）、固定种子可复现。

### 3.4 图生视频提示词（最稳，直接抄）
```
动作 + 运镜 + 风格 + 流畅度
```
示例：`镜头缓慢推近，少女转头，眼神惊讶，治愈系，画面流畅无卡顿，5 秒`。

### 3.5 线上避坑
- 手部畸形 / 五官崩 → 直接舍弃重生成，不将就。
- 单镜超 8 秒 → 拆 2–5 秒快剪，卡 BGM 点。
- 画风漂移 → 全剧固定一套模型 + 风格词，定妆图锁死。

### 3.6 图生视频提示词库（B站实战验证，直接抄）
- 通用微动：`镜头缓慢推近，人物轻微呼吸/发丝衣料微动，画面流畅无卡顿，电影感，5 秒`
- 情绪特写：`微风拂动头发，眼神从疑惑转为坚定，柔光，8K 画质，柔和光影，5 秒`
- 场景推进：`镜头缓慢环绕，背景轻微流动，保持人物不变，治愈系色调，6 秒`
- 关键：**只让"发丝/衣料/光影"微动，主体大幅动作留给后期或拆短镜**，否则必崩手/必闪。

### 3.7 剪映后期节奏（让 PPT 式死图变"活漫剧"）
1. 每张分镜图时长设 **2–3 秒**，叠加 **"放大 / 推进"运镜**（关键帧缩放 105%→110%）让画面不呆板。
2. **AI 配音**选少年 / 御姐 / 温柔声线，**语速放慢**避免机械感；自动字幕。
3. **BGM 按题材**：悬疑用低沉纯音、甜宠用温柔钢琴、逆袭用渐强鼓点；配光斑 / 暗角滤镜提升氛围。
4. 导出 **9:16 竖屏 1080P**，卡 BGM 节拍剪点。

### 3.8 选题与新手避坑（B站 / 头条高赞共识）
- **新手三大爆款赛道**：甜宠 / 悬疑 / 古风（古风玄幻、都市爽文、甜宠逆袭、悬疑惊悚最稳）。
- **别碰**：玄幻大场景、战争群像（新手 hold 不住，必崩）。
- **先做 30 秒短片跑通流程**，再拉长到 1–3 分钟，避免中途放弃。
- **节奏铁律**：单集 1–3 分钟，开篇 **10 秒必抛冲突**，每 **30 秒一个反转 / 悬念**，末尾强悬念驱动追更。

---

## 四、流程 B：混合（即梦出图 + ComfyUI + MiniMax H3 出视频）· 针对 RTX 3060 12G

### 4.1 为什么这么搭
- **即梦出图**：角色一致性开关最稳，定妆图质量高，省去本地折腾生图。
- **H3 本地出视频**：原生画面 + 音频联合生成（FL2VA 任务），**自带配音轨、少后期对口型**；不排队、数据私有、量产后零边际成本。
- **3060 12G 能跑**：H3 用 INT8 量化 + 动态 VRAM 卸载，全流程内存从 123.6G 压到 42.5G，社区实测 12G 显存可跑通。
- 🆕 **更进一步：即梦也能进 ComfyUI 画布**（GitHub 真实节点 `ComfyUI-Jimeng-API`，fkxianzhou 维护）：它把火山方舟的 Seedream（出图）/ Seedance（出视频）封装成 ComfyUI 节点，**支持多 Key、配额控制、异步并发**，可一次性把"即梦出图 → H3 出视频"串在同一个 ComfyUI 工作流里，**不再网页端和本地两个界面来回切**。注意：Seedance 2.0/2.5 高级输入有上限（最多 9 参考图 / 3 参考视频 / 3 参考音频），Seedream 尺寸需 16 像素对齐，用节点时按上限填参考。

### 4.2 3060 12G 部署 H3 前置清单（节点 + 模型）
1. **ComfyUI ≥ 0.30.0**（桌面版或启动器，旧版缺 H3 节点）；模板库 `Template Library → Video → MiniMax H3` 内置三套工作流。
2. **安装 H3 节点（GitHub 真实可用，三选一或组合）**：
   - `comfyui-minimax-h3`（官方插件 v0.2.1）：基础 `H3Loader / H3TextEncode / H3VideoGenerate`，日志出现 `Minimax H3 Node Loaded` 即成功。
   - `ComfyUI_MiniMaxH3_Director`（AIMixer，导演台）：**多段生成核心**，任务类型 `fl2v`（首尾帧）/ `r2v`（参考主体锁脸，需 REF2VA 主模型）/ 文生视频，做长剧 / 短剧一致性最实用。
   - `ComfyUI-Easy-Media`（yolain）：`easy-minimaxH3ToVideo` 一站式节点，自动按 mode（reference / multi_frames / last_frame）路由到正确核心节点，参考图自动展开，省去手动接线。
   - 关键参数（社区实测）：采样器 **res_multistep + simple**，**steps=25，CFG=1.0**，Sigma shift **video=12 / audio=3**；CLIP Loader 的 type **必须选 `minimax`**（否则提示词编码报错）；帧数按 **17n+5** 对齐（如 124 帧 ≈ 5 秒），**训练上限 362 帧 ≈ 15 秒 @24fps，超出必漂移 / 崩坏，长内容用导演台分段**。
3. **下载 INT8 量化模型**（推荐多数人的版本），目录结构：
```
ComfyUI/models/
├─ diffusion_models/  minimax_h3_fl2va_pruned_int8_convrot.safetensors   （主干）
├─ text_encoders/     qwen3vl_32b_minimax_h3_int8_convrot.safetensors      （文本编码器，可能成对：主体+尾部，都要放）
└─ vae/               minimax_h3_video_vae_fp16.safetensors
                     minimax_h3_audio_vae_fp32.safetensors                （音频 VAE，原生配音的关键）
```
3. 国内用魔搭下载更快：`modelscope download --model Gluttony10/MiniMax-H3-INT8-CONVROT --local_dir ComfyUI/models/MiniMax-H3`。
4. 显存仍紧 → 切 **GGUF** 社区量化（更小但对画质略降）；放 `diffusion_models` 重启即识别。
5. 加速可选 **4-Step Turbo LoRA**（`models/loras`，提速明显）。

### 4.3 H3 三种工作流怎么选（关键：用即梦定妆图当输入）
- **图生视频（Image to Video）**：上传即梦定妆图 / 分镜首帧 → 出动态。最稳，推荐主线。
- **参考生视频（Reference to Video / Ref2VA）**：喂多图/视频/音频作参考，**锁角色脸 + 声线**，跨镜头一致性最强。
- **文生视频（Text to Video）**：纯文字出片，适合空镜 / 转场，不锁特定脸。

### 4.4 H3 出视频提示词公式（图生视频，直接抄）
```
主体 + 动作/状态 + 环境光感 + 镜头语言 + 时长
```
示例：
- 动物：`一只橘猫在洒满阳光的木地板上打滚，午后暖光，浅景深，手持微距质感，轻微胶片颗粒，5 秒`
- 人物：`少女在窗前缓缓回头，眼神从疑惑转为坚定，冷调室内光，慢速推近镜头，电影感，6 秒`

> ⚠️ **H3 同样要正负分离**：H3 是描述式接口，多数工作流**没有独立 negative 输入框** —— 因此**不要在这段正向里写 `no text / no watermark`**（会被反向理解）。优先用节点/平台的负面输入；没有就改用**正向描述替代否定**（例：要干净画面写 `plain clean background, simple composition`，而非 `no clutter`）。分镜表里负面词仍单列，见 `12` 三.7。

### 4.5 H3 原生配音注意
- FL2VA 任务画面 + 音频联合生成，导出 mp4 **自带音频轨**，省掉"TTS + 对口型"环节。
- 中文口型仍需校一遍（尤其长句）；要 2K 分辨率需用"再生成模块"（本地升档或云端），基础 768p。

### 4.5b ⚠️ H3 本地权重许可证合规（必读）
- **MiniMax H3 Community License 明确排除 US / EU / UK / South Korea 的适用地域**：在这些地区**不能运行本地权重**（云 API 版 Hailuo 不受此限）。
- 你在中国大陆本地部署 H3 权重**不受影响**；但若作品面向海外分发，注意各地 AIGC 标识 / 深度合成法规（见 `11_出海专项`）。

### 4.6 时序稳定（闪烁 / 手部 / 漂移）
- 单镜 ≤5 秒，拼接时用**首尾帧**控制衔接。
- 大动作拆 5 秒内、后期拼接；手部大特写用遮挡 / 后期修。
- 即梦定妆图同时作 H3 首帧/参考 → 全链路同一张脸，漂移最小化。

### 4.7 3060 速度预期 & 降本
- 3060 12G：**5 秒 480p 约 5–10 分钟**（取决于模型从盘载入速度，模型放 NVMe 固态更快）。
- 降本：降输出分辨率、装 Turbo LoRA、GGUF 兜底；多镜批量时用批量脚本统一管理提示词+参考图+参数，一次提交自动拼接。

### 4.8 🆕 备选：LTX2.3 + 20 宫格全本地方案（3060 12G 更省心）
- 若 H3 本地部署嫌重，可换 **Lightricks 开源的 LTX2.3**（ComfyUI 原生支持，GGUF 量化 **8G 显存即可跑**，24G 更丝滑）：原生音频输入、**唇同步自然**、长时序稳定（单张大图不易崩）。
- **"20 宫格工作流"**（UP 主「AI代码侠土豆」等有 JSON 分享）：把 20 个分镜拼成**一张大图**，一次性动画化，直接得接近 1 分钟的连贯漫剧素材，剪映简单拼接即成分镜连贯成片；相比四宫格（约 12 秒）覆盖剧情更多。
- 配套节点：`ComfyUI-KJNodes`、`ComfyUI-LTXVideo`、`Qwen3-TTS`（角色声音）。适合**日漫 / 韩漫 / 动态漫画 / 竖屏短剧**创作者，性价比高。
- 取舍：LTX2.3 胜在**低显存 + 长时序 + 音画同步**；H3 胜在**原生 2K + 更强 prompt 遵循 + 导演台分段**。两条都能用即梦定妆图当首帧锚定脸。

### 4.9 🆕 工程化落地：用「漫剧工作台」串起流程 B（你的真实工具链）

你机器上已有一套自研的 **AI 漫剧制作工作台**（`E:\ai漫剧工作台\workbench\`，Node.js 零依赖 Web 应用 `ai-manju-workbench`），它就是把本章流程 B 直接工程化的载体——不用在即梦网页、ComfyUI 界面、EchoMimic 之间手动切来切去。

**架构（三层数据模型 + 统一 Provider 层）**
- 三层模型：`项目 → 剧集 → 分镜(shot)`，每个 shot 挂载剧本 / 定妆图 / 视频 / 数字人 / 音频资产与流水线日志。
- Provider 层：`豆包 / DeepSeek`（剧本）、`即梦`（定妆图）、`ComfyUI`（出图 FLUX / SDXL+IPA + 出视频 H3）、`EchoMimic`（数字人）。

**与流程 B 各环节一一对应**
| 流程 B 环节 | 工作台落地 | 模式 |
|---|---|---|
| 豆包 / DeepSeek 写剧本分镜 | Provider 层已接；默认手动粘贴，可开 API 自动（见下方「API 自动模式」） | 手动 / API |
| 即梦出定妆图 | 手动导入路径；或经 ComfyUI-Jimeng-API 节点自动 | 手动 / API-节点 |
| ComfyUI + H3 出视频 | `workflows/i2v_minimax.json`（H3 图生视频），自动提交 / 轮询 / 下载 | 自动 |
| 角色一致性 | 风格锚 = 首帧图 + ipAdapterWeight 0.3 | 自动 |
| EchoMimic 数字人 | 已接 7860，有音频才跑、无则跳过不阻断 | 自动 |

**你的 aki-v7 本地侧已齐（无需新装）**：`D:\ComfyUI-aki-v7\ComfyUI\custom_nodes` 已含全套 H3 节点——`ComfyUI_MiniMaxH3_Director`（导演台）、`ComfyUI-MiniMax-H3-StoryBoard`、`ComfyUI-H3-Multishot`、`ComfyUI-MiniMaxH3-TeaCache`、`ComfyUI-H3-Conditioning-Cache-AI-Drama-Production-Suite`、`h3-studio`、`comfyui-speed-minimaxH3`、`comfyui_ipadapter_plus`、`ComfyUI-GGUF`、`comfyui-Impact-Pack` 等共 34 个。即梦出图还可走本地 `FLUX.1-dev GGUF` / `SDXL+IP-Adapter` 工作流（免即梦排队）。

**config.json 关键配置（已对齐流程 B）**
- `import.mode: manual`：云侧剧本 / 定妆图默认手动粘贴导入（稳定、免密钥）；改 `api` 则开启自动调用（需填 `config.api` 密钥）。
- `video.comfyui`：`baseUrl=http://127.0.0.1:8188`，`workflow=workflows/i2v_minimax.json`（MiniMax H3 **扁平 API 图**：首帧注入节点 `5` LoadImage、提示词注入节点 `6` `MiniMaxH3ImageToVideo.prompt`、画布注入节点 `6` width/height、种子节点 `7` RandomNoise、产物取节点 `15` SaveVideo），`canvas=768x1344`。
- `imageGen.comfyui`：`inputDir=D:/ComfyUI-aki-v7/ComfyUI/input`，`flux_t2i.json`（FLUX 定妆图）+ `sdxl_ipa.json`（SDXL+IPA 分镜一致性）。
- `digitalHuman.echomimic`：`baseUrl=http://127.0.0.1:7860`（EchoMimic v2 Gradio）。

**跑通步骤（本机，沙箱连不上 localhost）**：详见工作台目录 `流程B跑通Checklist.md`——① 起 aki-v7（8188）+ 可选 EchoMimic（7860）→ ② 起工作台 `node index.js`（8787）→ ③ 豆包 / DeepSeek 写剧本粘贴导入、即梦出定妆图导入路径 → ④ 点 run shot 自动出 H3 视频。

**API 自动模式（可选升级）**：剧本端接豆包 / DeepSeek API 后可自动生成（`src/providers/script.js` + `config.api`）；出图端装 `ComfyUI-Jimeng-API` 节点并配 jimeng 工作流即自动。密钥留空则回落 manual，不破坏现有流程。

#### 4.9.1 整集批量一键出图（已落地）
逐镜点「真实生成」适合精修；量产时用**整集批量**：工作台选中剧集即进入「批量创作」视图，点独立大按钮「🔥 一键出图（整集 N 镜）」，一次生成本集所有尚未出图的分镜。
- **后端** `POST /api/projects/:pid/episodes/:eid/genallimages?dryRun=1`：遍历本集 shots，对「已有图 / 无生图提示词 /（SDXL+IPA 缺角色锚）」的分镜自动跳过并附原因，其余按统一设置调 `genImage` 串行提交到 8188。
- **统一设置**（一次配好，整集复用）：模型（FLUX / SDXL+IPA / 即梦 Seedream）、尺寸、即梦锁脸强度、**共享角色定妆图**（整集锁同一张脸）、提示词模板。
- **优先级**：每镜自身 `imagePrompt` > 模板；共享定妆图 > 各镜自有 `keyframe`。即梦走图生图锁脸（定妆图注入 `jimeng_img` 的 `image`，强度注入 `strength`）。
- **边界**：真实批量占 GPU，耗时≈镜数×单镜出图，串行不并行（单卡保护）；沙箱连不上本机 8188，真跑需本机终端 `node server.js`。

### 4.10 即梦出图全自动：ComfyUI-Jimeng-API 节点（让流程 B 出图端也自动化）
> 现状：流程 B 出图端默认走"即梦网页出图 → 导入路径"或"本地 FLUX/SDXL+IPA"。装此节点后，即梦 Seedream 出图 + Seedance 出视频可直接进 ComfyUI 画布，与 H3 视频节点串同一条工作流，免网页/本地来回切——这是出图端全自动的关键一步。

- **仓库**：`fkxianzhou/ComfyUI-Jimeng-API`（Mu-L 维护同名分支）。支持 Seedream 5.0/4.0 出图、Seedance 2.0/2.5 出视频；多 Key 管理 + 配额限制 + 异步并发。
- **安装**：`cd D:/ComfyUI-aki-v7/ComfyUI/custom_nodes && git clone https://github.com/fkxianzhou/ComfyUI-Jimeng-API`，重启 ComfyUI；或 ComfyUI Manager 搜「ComfyUI Jimeng API」安装。要求 ComfyUI ≥0.25.1（aki-v7 满足）。无模型需下载，SDK 自装。
- **Key 申请**：火山方舟（Volcano Ark）控制台 → 开通即梦/豆包视觉模型 → 创建 API Key。
  - 配置法 A（节点内）：加 `Jimeng API Client` 节点 → `key_name` 选 `Custom` → 填 Key → 运行一次自动保存（刷新页面后在下拉出现）。
  - 配置法 B（文件）：插件根目录 `api_keys.json.example` 改名 `api_keys.json`，填 `customName` + `key`。
- **关键节点（菜单 JimengAI）**：
  - `火山方舟 API 客户端`（必须，工作流起点，加载 key）
  - `图像生成（Seedream 5）`：Pro/Lite；Pro 最多 10 张参考图、默认开提示词优化——**角色定妆图经此节点出**
  - `视频生成（Seedance 2 / 2.5）`：图生视频（首/尾帧）、多模态参考；2.5 最长 30 秒
  - `配额设置`：按 key 设 `video_limit` 防超额（按量付费，建议放视频工作流）
- **与 workbench 串联（已落地）**：`config.imageGen.comfyui` 已加 `"jimeng": "workflows/jimeng_seedream.json"` 与 `nodeMap.jimeng`（prompt/image/seed/output 字段已配）；前端生图步骤下拉已含「即梦 Seedream」选项，选即梦时显示「需先装 Jimeng-API 节点」提示。装上 `ComfyUI-Jimeng-API` 节点 + 配火山方舟 Key 后，出图端即全自动（与 H3 视频端共用 8188）。模板 `workflows/jimeng_seedream.json` 与《即梦Jimeng节点安装图文Checklist》已随 workbench 一并交付，照做即可。
- **注意事项**：Seedream 5 Pro 尺寸约束（16 像素对齐、比例 1:16–16:1、总像素 921600–4194304）；按量付费务必接 Quota 节点防超额；Seedream 3 / Seedance 1.0-lite 已进退役路径，勿用旧节点。
- **图生图锁脸（已落地）**：`jimeng_seedream.json` 的 `jimeng_img` 节点自带 `image`（参考图）+ `strength`（锁脸强度 0.3–0.9）。工作台生图时若第3步已导入定妆图，会把定妆图当参考图注入 `image`、并以「锁脸强度」输入框（默认 0.6）注入 `strength` → 系列分镜自动锁同一张脸，比单次文生图定妆图更抗跳脸。这是流程 B「人物一致性」在出图端的技术落点（对应第五章一致性表）。
- **即梦图 → H3 首帧联动（已落地）**：即梦图生图产出的图（资产 `image`）**可直接作 H3 首帧**——pipeline 视频阶段在无手动 `keyframe` 时自动回退用即梦 `image` 资产，注入 `i2v_minimax.json` 的首帧节点 `5`（LoadImage → 主节点 `6` `MiniMaxH3ImageToVideo.first_frame`），实现「即梦锁脸图 → H3 视频」的角色一致性联动（`video.js` 已支持按 `data/assets/images/` 解析出图资产路径）。前端「图生视频」步会显示当前 H3 首帧来源（定妆图 / 即梦图）。

### 4.11 剧集合成：多镜拼整集成片（已落地）
把本集各镜成片按顺序拼成**一条完整剧集视频**（`src/providers/merge.js`，`POST /api/projects/:pid/episodes/:eid/merge`）：
- **取片规则**：优先各镜后期成片 `post.finalPath`（含字幕/BGM），无则回退原始 `video.url`；缺失/未出片的镜自动跳过并计数。
- **归一化再拼**：各段画布/帧率可能不一致（即梦 Seedream 竖屏图 vs H3 输出），故先用 ffmpeg `scale + pad` 归一化到统一画布（`config.merge.canvas`，默认 `1080:1920@30`）、`setsar=1`、统一 fps；**无音轨的段落自动补静音**（`anullsrc`），保证每段都有音轨，再 `concat -c copy` 合成（失败回退重编码）。
- **输出**：`data/assets/merge/<pid>/<eid>/<eid>_full.mp4`，经 `/api/file/` 预览/下载；前端「🎬 整集成片（多镜合并）」步可一键触发并预览。
- **依赖**：本机 ffmpeg + ffprobe（ffprobe 用于探测音轨；默认与 ffmpeg 同目录，`config.post.ffprobeBin` 可覆盖）。
- **全链集成**：「⚡ 整集一键跑全链」在分发前自动调用合并；若整集成片已存在，落地页会把「整集成片（合并）」卡置顶。

### 4.12 分发：整集落地页 + 视频号 / 抖音（已落地）
流程 B 最后一环「分发」已在工作台做实（逐镜「分发」步骤）：
- **整集落地页**：`POST /api/projects/:pid/episodes/:eid/distribute`（`src/providers/distribute.js`）聚合本集所有分镜成片——优先后期成片 `post.finalPath`（含字幕/BGM），无则回退原始 `video.url`——连同封面帧，生成一个响应式 HTML 落地页，写入 `data/assets/dist/<pid>/<eid>/index.html`，经通用资产路由 `/api/file/<rel>` 流式访问，可直接外链预览 / 分享。
- **视频号 / 抖音 一键上传**：按钮打开对应创作者中心（视频号 `channels.weixin.qq.com`、抖音 `creator.douyin.com`）并**复制本机成片绝对路径**到剪贴板，登录后「发布视频 → 选择文件」即可。真实平台 API 自动上传需 OAuth 凭证（暂未接，`distribute.js` 已留可插拔扩展位）。
- **通用资产路由** `/api/file/<rel>`：统一暴露 `data/assets/` 下任意资产（成片 / 图 / 封面 / 落地页 HTML），带目录穿越防护（越界返回 403）。
- **与后期联动**：落地页封面取 `post.coverPath`（ffmpeg 抽帧），成片取 `post.finalPath`；若已合并整集成片则置顶。到此流程 B 全链闭环：**剧本 → 出图 → 视频 → 数字人 → 后期 → 合并 → 分发**。

---

## 五、人物一致性保证（两条流程对照）

| 手段 | 流程 A（线上·即梦） | 流程 B（混合·即梦+H3/ComfyUI） |
|---|---|---|
| 定妆图 | 先做角色定妆图，全剧复用 | 同左，且同图喂给 H3 当首帧/参考 |
| 一致性开关 | 即梦"角色一致性"开关（强度 0.6–0.85） | H3 Ref2VA 锁脸锁声；本地 **SDXL / FLUX** 用 IP-Adapter（**权重 0.6–0.8 最稳，需更强才上探 0.8–0.9**） / PuLID / FaceID / InstantID。⚠️ **H3 系工作流无独立 IP-Adapter 节点**，一致性靠**首帧风格锚**（见 4.9 / 9.3） |
| 画风 | 固定一套模型 + 风格词 | 同左，禁止中途切换 |
| Seed | 即梦固定种子可复现 | 本地固定 Seed + 角色卡（3–5 张多角度参考图）+ ControlNet 控姿势构图 |

**铁律五条**：① **先做角色三视图（正/侧/背）再量产**，全剧垫同一组参考图；② 先定妆再量产；③ 全剧固定一套模型 + 画风；④ 外貌特征词压 2–4 个、原样粘贴；⑤ 保存成功图的 Seed 值与提示词模板。

---

## 六、剧情连贯性保证

- **分镜脚本纪律**：跨镜头必填首尾帧；景别按"远→中→特写"循环制造节奏；每 **30 秒一个反转 / 悬念**（B站 实战节奏），开篇 10 秒必抛冲突。
- **连续镜 / 时间线管理**：建"跨镜状态表"（角色位置、服装、道具、光影），防穿帮（即 `03` 的场记）。
- **钩子-爽点-悬念结构不丢**：每集结尾强悬念驱动追更；单集只解决一个冲突，别塞太多信息。
- **视觉连贯**：风格锚（定妆图）+ 首尾帧，保证跨集画风/光影不漂移。
- **对白连贯**：短句、带冲突/情绪；能演出来的不写出来（用画面代替台词）。

---

## 七、给 AI 的用法

- 把本篇 + `02`（剧本）+ `03`（资产）+ `12`（分镜实操）一起交给 AI，AI 能照抄 2.3 / 2.4 / 3.4 / 4.4 的提示词，产出**可直接喂即梦 / H3 的分镜脚本**（含生图/视频提示词列）。
- **自检清单（出片前过一遍）**：
  - [ ] 角色有定妆图？全剧统一一张脸？
  - [ ] 每镜 ≤5 秒？首尾帧衔接填了？
  - [ ] 台词 ≤12 字短句？前 3 秒有冲突/悬念？
  - [ ] 每集结尾留悬念？画风/模型全剧一致？
  - [ ] 线上：即梦角色一致性开关开没开？本地：H3 三种工作流选对、音频 VAE 就位（否则没声音）？

---

## 八、GitHub / B站 实测可用资源索引（2026-09 补充）

> 下列节点 / 工作流 / UP 主均为本轮检索验证过、可实际取用的资源，作为落地参考（模型名与价格随官方更新，使用前回官网核对）。

### 8.1 ComfyUI 节点（GitHub，可直接 git clone 安装）
- **即梦 / 豆包 API 入画布**：`fkxianzhou/ComfyUI-Jimeng-API`（多 Key + 配额 + 异步并发，支持 Seedream 5.0/4.0 出图、Seedance 2.0/2.5 出视频，ComfyUI ≥0.25.1）；同类另有 `mbaisha/Comfyui-Jimeng-api`、`weisiren000/comfyui-jimeng-api`（均支持 Seedream 4.0 多图融合 / 组图）。
- **MiniMax H3 本地出视频**：`comfyui-minimax-h3`（官方插件）、`AIMixer/ComfyUI_MiniMaxH3_Director`（导演台，长剧分段一致性）、`yolain/ComfyUI-Easy-Media`（easy-minimaxH3ToVideo 一站式路由）。另 ComfyUI core ≥0.30 自带云端 Hailuo H3 节点（按秒计费，非本地权重）。
- **角色一致性 / 出图增强（本地）**：`ComfyUI-Impact-Pack`（人物一致性必备）、`ComfyUI-IPAdapter`、`ComfyUI-LTXVideo`（LTX2.3 视频）、`ComfyUI-KJNodes`（宫格/调度）、`if-ai/ComfyUI-IF_AI_tools`（Ollama 集成）、`city96/ComfyUI-GGUF`（量化加速）。
- **Dify + ComfyUI 全自动编排**：`langgenius/dify`（Docker 部署）做"大脑"（编剧 / 导演 / 提示词 Agent），ComfyUI 做"双手"（Flux 出图 / LTX 视频 / TTS 配音），适合量产。

### 8.2 工作流 / 整合包（社区分享）
- **LTX2.3 + 20 宫格自动化漫剧工作流**：B站搜索「ComfyUI LTX2.3 20宫格 自动化漫剧」，UP 主「AI代码侠土豆」等分享 JSON + 模型 + 样例提示词。
- **Qwen-AIO 大合集节点**：含 `QwenImageEdit`（角色一致性超强）、Qwen Image 2512、Qwen3-TTS，被多个保姆级教程列为"2026 最强漫剧节点"。
- **MiniMax H3 基础工作流**：`minimax_h3_basic_workflow.json`（文生视频最简验证），导入 Ctrl+O 即用。

### 8.3 B站 / 公开教程（实操向）
- 即梦 AI 官方新手教程（APP 内「新手学堂」+ B站「即梦 AI 漫剧教程」）：中文界面、每日免费额度、角色锁定功能。
- 系统实战：B站《AI 漫剧从 0 到 1 实战》（UP 主：AI漫剧教程君、漫剧制作工厂），避坑多、解决剧情断层 / 画面崩坏。
- 专项：B站「大叔的 AI 课」SD 漫剧系列（Lora / 角色一致性）；可灵图生视频教程（丝滑动态提示词）；剪映漫剧专属模板（自动字幕 / 转场 / AI 配音）。
- 节奏范式：头条 / 抖音高赞「30 分钟出片五步法」「0 成本 3 天出片」（选题→豆包脚本→即梦三视图→图生视频→剪映），新手可直接抄。

## 九、流程 B 跑通 Checklist（本地实操，回写自 workbench/流程B跑通Checklist.md）

> 用 `E:\ai漫剧工作台\workbench\` 跑流程 B 的本机实操清单。沙箱连不上本机 localhost，真跑需你本机终端。

### 9.1 启动顺序与端口
1. 先起本地引擎（单卡别并行新任务）：**ComfyUI（aki-v7）** 默认 `8188`（启动日志出现 `Minimax H3 Node Loaded` 即 H3 节点就位）；**EchoMimic v2** 可选 `7860`。
2. 再起工作台：`workbench` 目录 `node index.js`（或 `run_web.bat`）→ `8787`。
3. 浏览器开 `http://127.0.0.1:8787`。

### 9.2 手动导入步骤（默认 manual 模式）
1. 豆包 / DeepSeek 写剧本 → 工作台粘贴导入（`importScript`）。
2. 即梦出角色定妆图（先三视图正/侧/背）→ 导出本机 → `importKeyframe` 填路径。
3. 可选：口播音频导出 → `importAudio`（EchoMimic 必须音频才跑数字人）。
4. 点该分镜 `run` → 自动提交 ComfyUI 跑 H3 图生视频 → 下载到 `data/assets/videos/`。

### 9.3 i2v_minimax.json 校验
- 须是 **API 格式（Prompt 格式）的扁平图**（**勿用带"子图(subgraph)"的 UI 导出**）；`config.video.comfyui.nodeMap`：首帧 = 节点 `5`(LoadImage).`image`，提示词 = 节点 `6`(MiniMaxH3ImageToVideo).`prompt`，画布 = 节点 `6`.width/height，种子 = 节点 `7`(RandomNoise).`noise_seed`，产物 = 节点 `15`(SaveVideo)。核心 H3 节点定义见 `comfy_extras/nodes_minimax_h3.py`（`MiniMaxH3ImageToVideo` 输入含 clip/vae/prompt/width/height/length/first_frame/last_frame；`length` 须 17k+5，124≈5s@24fps）。
- **改动工作流后先跑 `node tools/check_workflow.mjs` 校验**（零依赖）：会揪出 nodeMap 指向不存在节点、inputs 为空、数字 id 引用、字段 `_1/_2` 错位、prompt 注入图像字段等问题——**旧版 `i2v_minimax.json` 就是这样被发现"看着像、跑不了"**（把带子图的示例错误拍平），现已按本机核心节点重建为扁平图。参考可打开 `custom_nodes/comfyui-speed-minimaxH3/example_workflows/图生视频-关图就是文生.json` 核对。
- minimax_h3 系无独立 IP-Adapter 节点（靠首帧风格锚）；帧数按 17n+5 对齐，上限 362 帧 ≈15 秒，超出必崩。
- **首帧来源**：优先用第3步导入的定妆图 `keyframe`；若该镜只有即梦图生图产出的 `image` 资产，pipeline 自动回退用它作首帧（无需再手动导入定妆图），实现「即梦锁脸图 → H3 视频」联动。

### 9.4 常见失败排查
- **连不上 8188**：aki-v7 没起 / 端口错 / 沙箱隔离（本机终端才通），`curl http://127.0.0.1:8188/system_stats` 自测。
- **正忙**：单卡不能并行，队列非空时拒绝提交；等当前视频跑完。
- **无视频产物**：工作流缺合成/保存节点，或 json 非 API 格式。
- **视频没声音**：H3 原生配音需 `minimax_h3_audio_vae_fp32.safetensors` 就位。
- **数字人跳过**：没 `importAudio`（非错误，单独重跑即可）。
- **定妆图不存在**：`importKeyframe` 路径错，或图没放 aki-v7 input 目录（config.inputDir 已配，复制即认）。
- **即梦出图慢/排队**：切本地 FLUX / SDXL+IPA（config.imageGen 的 flux/sdxl_ipa）免排队。

### 9.5 API 自动模式（可选升级）
- `config.import.mode` 改 `api`，并填 `config.api.doubao`（或 `deepseek`）的 `apiKey`，重启工作台 → 剧本步「✨ 一键生成（API）」即自动产出本镜剧本分镜；密钥留空自动回落 manual，不破坏现有流程。
- 出图端装 `ComfyUI-Jimeng-API` 节点 + 配火山方舟 Key（见 4.10）后即全自动。

### 9.6 分发（落地页 + 视频号 / 抖音）
- 后期成片后，逐镜「分发」步 → 「🌐 生成落地页」聚合整集成片为落地页（`data/assets/dist/<pid>/<eid>/index.html`，经 `/api/file/` 访问）。
- 「视频号上传 / 抖音上传」按钮打开对应创作者中心并复制本机成片路径，登录后「发布视频 → 选择文件」即可。真实 API 上传需 OAuth 凭证（暂未接，`distribute.js` 已留可插拔位）。

### 9.7 剧集合成（多镜拼整集）
- 各镜后期完成后，剧集批量视图「🎬 整集成片（多镜合并）」→「合并整集成片」：自动收集各镜成片、逐段归一化（scale+pad 到 `config.merge.canvas`、统一 fps、无音轨补静音）后拼成一条整集视频 → `data/assets/merge/<pid>/<eid>/<eid>_full.mp4`。
- 需本机 ffmpeg + ffprobe；「⚡ 整集一键跑全链」会在分发前自动执行此步。

## 十、后期自动化（ffmpeg：字幕 / BGM / 封面 · 已落地 workbench）

> 流程 B 前四环产出「视频 + 数字人」，但仍无字幕、无配乐、无封面——不能直接发。后期模块把这一步工程化。

### 10.1 三个能力（src/providers/post.js）
- **字幕 burn-in**：`srtFromScript(剧本)` 按句末标点切分 → 生成 SRT → ffmpeg `subtitles=...:force_style=...` 烧入。样式由 `config.post.subtitles`（字号 28 / 白字 / 黑描边 / 底对齐）控制。
- **BGM 混音**：`mixBGM` 抽原音 + BGM 音量（默认 0.3）→ `amix` 最短输出 aac。BGM 来自 `shot.assets.bgm`（前端填路径）或 `config.post.bgm`。
- **封面帧**：`coverFrame` 取第 1 秒一帧存 jpg，用作落地页 / 分发封面。

### 10.2 触发与落点
- 流水线 **P5** 在 P3 数字人后自动调 post（用绝对路径确定的 `video.url` 作源）；`/post` 路由可单独重跑；前端「后期」step 有「导出成片」按钮。
- 任一步失败**仅跳过不阻断**（如没 ffmpeg、没 BGM），日志进 `shot.assets.post.log`。
- 资产落点：`data/assets/post/<pid>/<eid>/`（成片 `*_sub.mp4`、字幕 `*_sub.srt`、封面 `*_cover.jpg`）。

### 10.3 依赖与注意事项
- **ffmpeg 本机自备**：`post.js` 用 `spawn('ffmpeg')` 调用；本机需装 ffmpeg 并在 PATH，或用 `config.post.ffmpegBin` 填绝对路径（如 `D:/ffmpeg/bin/ffmpeg.exe`）。沙箱有 8.1.1 但真跑在您机器。
- **字幕精度**：自动切句基于标点均分时间戳，长镜头不够准；精确字幕请在前端粘贴台词或导入 `.srt`。
- **剧集合成**同走 ffmpeg（`src/providers/merge.js`，详见 4.11）：多镜成片归一化后 concat 成整集视频，同样依赖本机 ffmpeg + ffprobe。
- 与**流程 A**（剪映加字幕配乐，B站范式）互补：workbench 走 ffmpeg 工程化、可批量、可复用；剪映适合精修。
