漫剧制作知识库母本全 14 篇 · 161 章节
🤖 AI 摄取版

漫剧制作知识库 · 母本(AI 摄取版)

用途:这是一份「AI 可整体读取、可推理」的漫剧制作全量知识库母本。你的 AI 工具(Agent / RAG 检索 / 工作流)读取本目录下全部 .md 后,应获得关于「漫剧(AIGC 微短剧)从剧本到分发」的完整认知,无需再查外部。 知识截止:2026-09-20。模型名称、价格、平台规则会过期,见下方「时效与更新」。 在线版本(给人看):https://manju.zbjh.top/ —— 可全文搜索、可切明暗主题;AI 摄取入口:https://manju.zbjh.top/ai/ (单文件全文 https://manju.zbjh.top/ai/kb_full.md 可一次投喂)。本母本为源文本,内容与线上一致。

一、模块地图(AI 阅读顺序建议)

文件主题深度何时读
00_总索引与说明.md本文件:地图、阅读指引、时效总是先读
01_基础认知与题材图谱.md什么是漫剧、赛道、题材分类基础入门/定位
02_剧本与叙事工程.md爽点/钩子、剧本结构、分镜标准、台词节奏写剧本前
03_角色与美术资产规范.md角色设定文档、三视图/表情表/色板、风格、资产管理建角色前
04_工具路线_线上与本地.mdH3/即梦/ComfyUI 速查 + 决策树浓缩选工具时
05_声音与音画节奏.mdTTS/口型/BGM/音效/混音浓缩做声音时
06_后期包装与平台适配.md剪辑/字幕/封面/画幅/倍速浓缩后期时
07_质量评测与排错手册.mdQA 清单、一致性评分、排错表质检/出问题
08_运营分发与变现.md平台/投流/数据/变现/IP浓缩上线前
09_术语表.md漫剧黑话字典(含英文/别名)遇到陌生词随时查
10_案例库.md爆款拆解(A–I 九例:甜宠/逆袭/悬疑/权谋/重生/出海/战神/甜宠2/知识口播)+ 反面案例 + 记录模板找参考/避坑
11_出海专项.md出海平台/本地化/题材选型/各地合规差异做出海前
12_分镜表实操与模板.md分镜表 14 字段定义、填写纪律、合格样例、字段→生产映射、分镜病写分镜/转生产前
13_双流程实战_剧本分镜到出片.md线上A/混合B 双流程、可抄提示词、一致性&连贯性保证、第八章 GitHub/B站 实测资源索引真正动手出片前

推荐摄取顺序00 → 09(先建词表)→ 01 → 02 → 03 → 12(分镜实操)→ 13(双流程实战)→ 04 → 07 → 05/06/08 → 10 → 11。 遇到具体症状先查 07 排错表;遇到陌生术语先查 09 术语表;做出海先查 11


二、知识范围声明

本母本覆盖漫剧制作的全链路知识域

边界:本母本不替代具体工具的实时 API 文档(如 MiniMax platform.minimaxi.com/docs、即梦官网),也不构成法律意见。涉及价格、许可、平台规则,以官方原文为准。


三、时效与更新机制

  1. 标注截止日:每个含时效信息(价格/模型名/平台规则)的文件顶部应注明知识截止日。
  2. 季度复核:漫剧工具迭代极快(例:MiniMax H3 于 2026-07 发布、即梦 Seedance 2.5 于 2026-08 更新),建议每 3 个月复核一次 04/05/08 三篇。
  3. 重大变更触发更新:某工具发布里程碑版本、平台规则重大调整、出现新的主流工作流时,立即补更对应模块并回写本索引。
  4. AI 使用约定:若 AI 在回答中引用了过期信息,应标注「该信息截至 2026-09,可能已变更」。

四、与其他资料的关系

本母本是「单一事实来源(single source of truth)」。以下旧文件仍为辅助资料,但以本母本为准


五、给 AI 的快速自检(读完本母本后应能回答)

01 · 基础认知与题材图谱

知识截止 2026-09。AI 入门漫剧的第一站:它是什么、在哪播、有哪些题材。

一、什么是漫剧(AIGC 微短剧)

二、赛道与平台

平台特点适配
抖音 / 快手流量大、投流成熟甜宠/逆袭/爽文
微信视频号私域+社交分发全类型
红果短剧免费短剧分发男频/长剧
番茄/小程序IP 源头+变现改编
ReelShort / TikTok出海译制/原创

三、题材图谱(常用)

题材一句话爽点类型画风建议
甜宠高糖恋爱撒糖/双向奔赴半写实韩系
逆袭/龙傲天废柴觉醒打脸打脸/身份曝光动态漫
重生带着记忆重来先知/复仇半写实
虐恋爱而不得虐心/追妻火葬场写实
悬疑真相层层揭开反转/信息释放暗调写实
玄幻/修仙修炼升级突破/越级二次元
都市职场/商战逆袭/打脸半写实
古装权谋/宫斗权谋/反转半写实
婆媳/家庭温情/冲突共情/解气写实

四、商业模式

五、AI 漫剧的独有优势与风险

02 · 剧本与叙事工程

知识截止 2026-09。本节讲「怎么写出观众愿意看完的漫剧」——这是 AI 漫剧最容易缺的一层。工具再强,剧本拉胯也救不回来。

一、核心概念:爽点 与 钩子

爽点(Payoff):观众看完产生「爽/爽到了/解气/上头」的情绪释放点。漫剧的本质是高频、密集、可预期的爽点投放

钩子(Hook):开篇 3 秒内抓住人的东西。常见钩子:

AI 创作铁律:前 3 秒必须有钩子,前 15 秒必须抛第一个爽点,每 20–30 秒至少一个小爽点,每集末尾留悬念(Cliffhanger)。


二、剧本结构

2.1 单集结构(以 60 秒竖屏为例)

[0–3s]  钩子:冲突/悬念/反转开场
[3–15s] 情境铺陈 + 第一个小爽点
[15–40s] 冲突升级,情绪推高
[40–55s] 爽点爆发(打脸/曝光/撒糖)
[55–60s] 新悬念收尾(Cliffhanger,逼看下一集)

2.2 多集连续结构

2.3 全剧弧线(百集级)

设定(身份/困境)→ 小冲突(验证爽点模型)→ 升级(敌人/难度变大)
→ 反转(身份/真相曝光)→ 高潮(终极打脸/团圆)→ 收束(留续作空间)

三、选题与定位

维度问自己
人群给谁看?(女频/男频/全龄)
情绪主打哪种情绪?(爽/甜/虐/恐/燃)
爽感公式主角用什么方式、对谁、完成什么爽点?
差异点同类题材里你的钩子新在哪?
可持续性这个设定能撑 80–100 集不注水吗?

常见题材(详见 01_基础认知与题材图谱.md):甜宠、逆袭、战神/龙傲天、重生、虐恋、悬疑、玄幻、都市、古装、婆媳。


四、分镜脚本标准写法

每集产出一份分镜表,字段如下(AI 出图/出视频时直接喂):

字段说明示例
镜号顺序SC01
景别远/全/中/近/特中近景
画面主体+动作+构图女主背影,转身,雨中
动作关键动作抬手甩耳光
台词角色+内容(≤12 字/句)女主:这一巴掌,迟到了三年。
时长4s
音效环境/打击雨声、巴掌声
BGM情绪压抑弦乐→爆发
备注一致性约束保持紫围巾、银徽章

AI 拆镜提示词模板(给 LLM 用):

你是漫剧分镜师。给定剧情梗概:{梗概}。
输出 8–12 个分镜,每个含:镜号/景别/画面/动作/台词(≤12字)/时长/音效/BGM/一致性备注。
要求:前3秒有钩子,每20-30秒一个小爽点,结尾留悬念。台词口语化、短句。

五、台词节奏


六、常见剧本病(AI 尤其易犯)

表现修复
铺垫癌前 10 秒还在介绍背景直接上钩子,背景靠动作带
爽点晚30 秒后才第一次爽前 15 秒必给小爽点
脸谱化反派纯坏无动机给反派一个「能共情」的理由
逻辑断上一镜恨人下一镜相爱补过渡情绪戏
注水同一爽点重复三遍一集一个主爽点 + 一个副爽点
无悬念结尾圆满无钩每集末尾加未解问题

七、AI 写剧本工作流建议

  1. 定位:先用 LLM 确定人群/情绪/爽感公式/差异点。
  2. 大纲:生成全剧弧线(80–100 集梗概)。
  3. 逐集:每集生成分镜表(用上方模板)。
  4. 校验:用「常见剧本病」表自检,重点查钩子与爽点密度。
  5. 转译:分镜表直接作为出图/出视频的提示词输入(见 03 角色资产 + 04 工具路线)。

03 · 角色与美术资产规范

知识截止 2026-09。本节是「让 AI 绘图/视频工具不跳脸、跨百集一致」的底层约束。角色资产做对了,后面所有工序都省心;做错了,全程救火。

一、角色设定文档(Character Sheet)模板

每个主要角色建一份,存为 角色库/男主.md 等。AI 出图/出视频时,把「固定特征词」段直接喂给提示词。

# 角色:陆昭(男主)
- 身份:被废世家的庶子 / 隐忍谋士
- 性格:冷静、记仇、外柔内刚
- 外貌固定特征(2–4 个,反复用):
  1. 左眉骨一道旧疤
  2. 玄色广袖长袍,袖口绣暗金云纹
  3. 瞳色墨黑,目光沉静
  4. 常执一柄未出鞘的乌木剑
- 声线:低沉青年男声,语速慢,带克制笑意
- 标志性动作:说话时以指节轻叩剑鞘
- 关系:与女主是「表面敌对→同盟→相爱」

固定特征词原则:压到 2–4 个最强辨识点,每次提示词都重复。特征越多越容易崩(社区实测跨 9 场景不崩的秘诀)。


二、三视图 与 表情表

资产用途建议
三视图(正面/侧面/背面)给 IP-Adapter / LoRA 训练 / 参考图锁脸每角色至少 3 张,同一光照同一服饰
表情表(喜/怒/哀/惊/默/冷笑)保证情绪一致性6 格一张图,固定构图
定妆图(全身带场景光)首帧/参考图用于 H3 Ref2VA、即梦参考

给 AI 绘图的关键:参考图尽量用干净立绘(纯色背景、无杂物),背景杂物多会带进生成画面(海螺 H3 实测坑)。


三、色板(Color Palette)

每个角色/场景定一组色,写进设定文档,出图提示词强制带:

风格锚(Style Anchor):用 1–2 张「定稿图」作为 IP-Adapter 权重 0.3 的锚,锁整剧画风(见 04 工具路线)。


四、美术风格定义

风格说明一致性难度适用
仿真人/写实真人质感,AI 视频最易「恐怖谷」高(脸崩风险大)都市/甜宠/悬疑
半写实拟真但略动漫,折中通用
二次元日系/国漫动画风低(模型成熟)玄幻/校园
3D 卡通三渲二质感儿童/合家欢
动态漫静态漫画 + 微动低(最易量产)男频/爽文改编

一致性难度规律:越写实越难保脸;二次元/动态漫最稳。新手建议从二次元或动态漫起步。


五、场景资产


六、资产命名与管理规范

目录结构示例:

角色库/
  男主_陆昭/
    ref_正面.png  ref_侧面.png  ref_背面.png
    exp_喜.png  exp_怒.png  exp_哀.png  exp_惊.png  exp_默.png  exp_冷笑.png
    lora_陆昭.safetensors
  女主_xxx/
场景库/
  陆府正厅_v1.png  雁回城街市_v1.png
分镜帧/
  EP01_SC01_中近景_v1.png  ...

命名规则{类别}_{角色/场景}_{角度/镜号}_{版本}.png,版本用 _v1/_v2 递增,不覆盖旧版。 版本控制:每轮生成保留原始帧,精修另存,便于回退(避免「改坏找不回」)。


七、给工具的角色描述写法(跨工具通用)

04 · 工具路线(线上与本地)速查

知识截止 2026-09。完整参数见在线版 https://manju.zbjh.top/ 。本篇给 AI 速查精华 + 决策树。

一、三路线总览

路线代表上手单镜成本一致性音画同步隐私
线上 · MiniMax H3海螺 AI按秒(¥0.5/0.8)参考图软约束原生一次出上传云端
线上 · 即梦字节积分/会员主体绑定锁原生一次出上传云端
本地 · ComfyUI你的 3060 12GB电费≈0LoRA 强约束需自拼本机私有

二、MiniMax H3 要点

三、即梦要点

四、ComfyUI 本地要点(RTX 3060 12GB)

五、决策树(给 AI 选路线)

要私有/跨百集一致? ─是→ 本地 ComfyUI(训 LoRA)
       │否
要快速出带声成片? ─是→ 线上 H3(Ref2VA 锁角色)
       │否
竖屏/中文口型/故事模式? → 即梦
量大要省钱? → 混合:线上打样 + 本地量产,或本地768P + 云端升2K

六、混合路线(常态解法)

05 · 声音与音画节奏

知识截止 2026-09。声音是漫剧「沉浸感」的一半。线上工具(H3/即梦)原生音画同步;本地需自拼配音+口型。

一、配音(TTS / 语音克隆)

工具特点本地显存
GPT-SoVITS5–20 条样本克隆声线,质量高CPU 可
F5-TTS跨语言、自然
Fish Speech / IndexTTS多语种、稳定
即梦/海螺原生直接出,免后配云端

二、口型(Lip-sync)

三、BGM 与音效

四、音画同步要点

五、自检(见 07 QA 清单声音层)

口型匹配?对白清晰?BGM 比例?环境音到位?授权合规?

06 · 后期包装与平台适配

知识截止 2026-09。后期决定「能不能让人看下去」。与 02 剧本节奏、05 声音共同构成成片质感。

一、剪辑节奏

二、转场

三、字幕

四、封面与标题

五、画幅与规格

平台画幅分辨率
抖音/视频号/红果(竖屏)9:161080×1920
横屏/B 站16:91920×1080
方屏1:11080×1080

六、倍速/变速

七、与前面环节的关系

07 · 质量评测与排错手册

知识截止 2026-09。本节是「发布前必过清单」+「症状→根因→修复」可机读排错表。AI 在质检环节应优先查此文件。

一、发布前 QA 清单(逐条过)

剧本层

画面层

声音层

一致性与合规


二、一致性评分(自用评估,0–10 分)

维度评分点参考
角色一致跨镜头脸/发型/服饰/配饰参考图 + 固定特征词
场景一致同一场景不串种子锁/参考图
光影一致光照方向/基调统一固定 LoRA/提示词
口型一致嘴型跟语音LivePortrait/Wav2Lip
画风一致整体质感统一风格锚 IP-Adapter 0.3

及格线:单集综合 ≥7 分可发;核心角色任何一镜 ≥8 分。低于线则回炉(见排错表)。


三、排错表(症状 → 根因 → 修复)

症状可能根因修复
跳脸(同角色每镜变样)无参考图/无 LoRA;特征词太多太杂上 Ref2VA 参考模式或训 LoRA;特征词压到 2–4 个;加 IP-Adapter 0.6–0.8
闪烁/抖动视频模型帧间不稳定;高动态拆 5 秒内短镜;降运动幅度;换更稳模型(LTX 微动)
多手/肢体畸形姿态控制缺失;强动作加 ControlNet OpenPose;强动作拆短镜;避免单段大动作
口型错位对白太长;TTS 与口型模型不匹配对白改 ≤12 字短句;用原生音画同步(H3/即梦)或 LivePortrait 重对
音画不同步后期混音偏移;帧率不一致统一 24/25/30fps;口型在合成阶段对齐
风格漂移未锁画风;混用底模固定单一 Checkpoint;IP-Adapter 风格锚 0.3;全程同 LoRA
场景串味同场景 Seed 未锁;参考图混杂固定场景 Seed;场景参考图单独管理
卡顿/不流畅帧率过低;插帧缺失升帧率;加帧插值(RIFE);避免突变运镜
模糊步数低/分辨率低/超分缺失升步数;出图后用 Real-ESRGAN 超分;避免直接拉伸
水印/乱码文字模型自带;提示词要了文字负面词加「水印、文字、logo」;避免让 AI 写实体文字
节奏拖单镜过长;无卡点每镜 2–5 秒快剪;对齐 BGM 鼓点
脸崩(特写)特写超出模型稳定区特写用 PuLID 精修关键帧;降 CFG 防爆
明暗跳变跨镜光照不统一提示词固定光照描述;后期统一调色 LUT

四、自检流程(从后往前逐级 preview)

  1. 成片整体看一遍:节奏/钩子/爽点是否到位。
  2. 声音轨单独听:口型、清晰度、BGM 比例。
  3. 画面逐镜看:跳脸/畸形/闪烁/水印。
  4. 一致性抽检:随机抽 3 镜比角色/场景/画风。
  5. 合规最后查:AI 标识、授权、内容安全。

原则:问题从「后工序」往前查——若口型错,先看声音对不对,再看视频,再看原始帧,逐级定位根因,不要一上来重生成整条。

08 · 运营分发与变现

知识截止 2026-09。片子做完只是开始。本节讲怎么发出去、怎么赚钱、怎么不踩合规雷。

一、平台规则与入驻

二、投流基础(IAP)

三、数据指标与优化

指标含义优化方向
完播率看完比例强钩子+快节奏(见 02/06)
互动率赞评转情绪强、留悬念引评论
涨粉关注转化人设/系列化
付费率解锁付费爽点密集、卡点收费

四、变现方式

  1. 平台分账:按播放/完播分润。
  2. 付费解锁:IAP 点播(主流)。
  3. 品牌定制:为客户做定制漫剧广告。
  4. IP 衍生:爆款改动漫/影视(如次元折叠计划,S+ 投院线)。
  5. 带货/引流:剧情植入商品或服务。

五、IP 授权合规

六、深度合成合规红线(务必)

七、与前面环节的衔接

09 · 术语表(漫剧黑话字典)

知识截止 2026-09。AI 读取漫剧相关资料时,遇到下列词应映射到本表定义。每条含「英文/别名」便于跨源对齐。按拼音/主题排序。

A–C

D–F

G–J

K–L

M–P

Q–S

T–Z


出海与本地化

工具与模型名词速查

10 · 案例库(爆款拆解 + 反面案例)

知识截止 2026-09。案例用于建立「好漫剧长什么样」的判断基准。以下为教学性典型示例(非特定真实作品),结构可复用。

一、爆款拆解模板(分析任何一条漫剧都用这 8 问)

  1. 题材与人群?
  2. 钩子是什么(前 3 秒)?
  3. 爽点类型与密度(每 X 秒一个)?
  4. 单集结构(起承转合 + 结尾悬念)?
  5. 视觉:画风/一致性/运镜?
  6. 声音:口型/声线/BGM/音效?
  7. 为什么火(情绪/缺口/时势)?
  8. 可复制点 vs 不可复制点?

二、爆款示例 A:甜宠《总裁的隐藏新娘》(虚构典型)


三、爆款示例 B:逆袭《废柴觉醒》(虚构典型,男频)


四、爆款示例 C:悬疑《沉默的房间》(虚构典型)


五、反面案例与修复

反面案例问题修复
开篇 10 秒介绍背景,无钩子完播率极低直接上冲突/悬念,背景靠动作带
女主第 3 镜变脸跳脸,出戏上参考图/LoRA,特征词压 2–4 个
对白长段独白,嘴型乱口型错位拆 ≤12 字短句,或改画外音
单镜 15 秒无变化节奏拖拆 2–5 秒快剪,卡 BGM 点
画风前 5 集动漫后转写实风格漂移固定单一底模 + 风格锚
大动作单段 15 秒武打肢体崩坏拆 5 秒内,后期拼接
无 AI 标识直接发合规风险加显著 AI 生成标识
BGM 压过对白听不清混音对白优先,响度统一

六、补充案例

示例 D:古装权谋《天下英雄》(严肃向典型,男频/全龄)

示例 E:重生复仇《她重生后》(女频典型)

示例 F:出海译制爆款拆解(ReelShort 型)

七、补充案例(续)

示例 G:男频战神《战神归来》(虚构典型,无敌/神豪流)

示例 H:女频甜宠《偏偏喜欢你》(虚构典型)

示例 I:知识科普口播《3 分钟看懂 X》(虚构典型,知识漫剧)


八、案例记录模板(你自己怎么记)

每做/每拆解一条漫剧,按下面 8 问记一笔,长期积累即成你专属的判断基准。可直接复制到笔记软件。
【案例名】______(虚构/真实·注明)
【题材人群】______
【钩子(前3s)】______
【爽点类型/密度】每___秒一个
【单集结构】起____ 承____ 转____ 合____ + 结尾悬念____
【视觉】画风____ / 一致性手段____ / 运镜____
【声音】声线____ / 口型____ / BGM____ / 音效____
【火因】情绪____ / 缺口____ / 时势____
【可复制点】______ 【不可复制点】______
【我的结论/可借鉴】______

九、给 AI 的用法

11 · 出海专项(Glocalization)

知识截止 2026-09。出海不是「把国内片加个字幕」,而是「题材/节奏/声音/合规」全链路的本地化。本节讲漫剧出海的关键差异与做法。先读 01 平台、08 变现合规,再读本篇。

一、为什么出海(与国内差异)

维度国内出海(欧美为主)
平台抖音/视频号/红果ReelShort、TikTok、YouTube Shorts、DramaBox
主流题材甜宠/逆袭/古装权谋豪门/狼人/霸总/狼人+言情(文化折扣低)
画风半写实/动态漫都行仿真人/半写实为主(欧美偏好真人质感)
配音中文原生母语配音优先(英语原生最稳)
节奏前 3 秒钩子、单句 ≤12 字钩子同样强,但单句可放宽到 ≤16 字(英文音节)
付费IAP 点播成熟同样 IAP,但单价/汇率差异大

核心结论:出海的关键不是技术,是 Glocalization(全球本地化)——保留「强钩子+爽点密度」的普适骨架,替换题材、语言、配音、文化梗。


二、平台与分发差异

平台定位适配做法
ReelShort中文短剧译制/原创出海头部英语原生配音、豪门/狼人题材
DramaBox多语种分发多语言字幕+配音并行
TikTok流量池大、算法分发竖屏、前 3 秒强钩子、话题标签
YouTube Shorts长尾流量+广告分账适合「免费前几集+引流付费」
本地短剧 App东南亚/拉美新兴市场译制为主,成本低

三、本地化三层次

  1. 译制(Subtitle):最浅。字幕翻译,保留原声。缺点:口型对不上、沉浸感弱。工具:manga-image-translator(图内文字)、常规字幕机翻+人工润色。
  2. 配音(Dubbing):中。母语配音,口型需重对(LivePortrait/Wav2Lip 对齐目标语言)。主流做法。
  3. 重制(Remake):深。用本地面孔/场景重拍(AI 换脸+换参考图),文化梗替换。成本最高但转化最好。

推荐起步:译制试水 → 数据好再上母语配音 → 爆款再重制。


四、题材选型(文化折扣低 = 易出海)

题材文化折扣说明
豪门/霸总全球通吃
狼人/吸血鬼( paranormal)欧美原生偏好
逆袭/打脸情绪普适
甜宠需本地化甜度
古装权谋需大量语境铺垫,慎选
婆媳/家庭本土文化强,难出海

五、合规差异(重点,各地不同)

本库不构成法律意见。出海前建议就目标市场合规做专项核查。

六、工具与模型差异


七、节奏与数据差异


八、出海工作流(建议)

1. 选题材:文化折扣低(豪门/狼人/逆袭)
2. 国内打样:先用 H3/即梦 出中文版验证钩子+爽点
3. 译制试水:加英文字幕投 TikTok/YouTube 测数据
4. 母语配音:数据好→英语原生配音(口型重对)
5. 重制升级:爆款→本地面孔重制
6. 分平台分发:ReelShort/DramaBox/本地 App
7. 合规核查:目标市场标识/授权/内容安全

九、给 AI 的用法

12 · 分镜表实操与模板(Storyboard Practice)

知识截止 2026-09。本模块是 03_新手30天上手路线与分镜表模板.md 里「分镜表模板」的实操版:模板告诉你"有哪些列",本模块告诉你"每一列怎么填才不会出事"。AI 在生成分镜或把剧本转成可生产清单时,应严格按本规范。

一、为什么分镜表是漫剧的"施工图纸"

漫剧是"先有图纸、再批量施工"的工业流程。没有分镜表,会出现三种典型事故:

分镜表 = 给"人"看的拍摄计划 + 给"AI"看的结构化指令。一个好分镜表,应能让另一位创作者或 AI 只看表就复刻出这条片子。


二、标准字段定义(14 列)

字段作用填写要点
镜头号 SC序号与剪辑顺序SC01、SC02…;重拍用 SC02b 不覆盖原行
景别远/全/中/近/特写决定显存与崩坏风险:特写易鬼手,远景易糊
时长(s)该镜头持续秒数单镜 ≤5s 是黄金线,动作戏 ≤3s,口播可 8–12s
画面内容这一镜发生什么动词开头:"主角推门""刀光闪过",忌形容词堆砌
运镜推/拉/摇/移/固定/环绕固定最稳;环绕最易闪;首次用固定建立一致性
台词/旁白该镜配音文本短句 ≤12 字(中文)利于口型;长句拆镜
情绪该镜情绪标签紧张/甜/燃/悬疑…用于情绪曲线自检
音效 SFX环境/动作音风声、开门、刀鸣…与 BGM 分层
BGM配乐段标注曲风与起止,避免全程同一首
生图提示词(核心)喂给绘图模型的词全剧统一前缀 + 仅改动作;特征词压 2–4 个
视频模型Wan2.2 / 即梦 / H3…标清用哪种,便于排查崩坏来源
一致性方案IP-Adapter/PuLID/LoRA跨镜头锁脸手段,关键帧标注更强方案
音频文件v01.wav 路径与台词字段对应,便于对口型
状态/备注进度 + 衔接说明待生成/已修脸/已配音;备注写"首尾帧接 SC01"

三、填写纪律(来自踩坑经验,必须遵守)

  1. 前缀统一:全剧提示词核心前缀写死(角色名 + 风格 + 画幅),只改动作部分。例:photorealistic, cinematic, 30s woman, jet-black bob, mole under left eye, 9:16, + 动作。
  2. 首尾帧必填:相邻镜头若需顺滑衔接,下游镜头必须标注"首尾帧接 SC0X",否则硬切跳戏。
  3. 单镜 ≤5s:超出的拆成 2–3 个短镜,后期拼接。这是防闪烁/鬼手的第一原则。
  4. 台词短句化:对白按 ≤12 字切分;长独白改画外音或拆镜,否则口型必乱。
  5. 景别分级规避:大特写手部、极限表情优先避开;必须时后期修复/遮挡。
  6. 状态可追溯:每行状态用 待生成 → 生成中 → 已修脸 → 已配音 → 已合成,便于追进度与复盘。

四、合格样例(60 秒成片 · 8 镜完整分镜)

题材:女频甜宠「走廊偶遇」钩子片段。统一前缀:photorealistic, cinematic, 28s woman, jet-black bob, mole under left eye, pearl earring, soft side-light, 9:16,

镜头号景别时长画面内容运镜台词/旁白情绪生图提示词(核心)视频模型一致性音频状态
SC01近景4女主在走廊尽头回头缓慢推镜"你终于来了"紧张…she turns head, corridor即梦IP-Adapterv01.wav已合成
SC02中景3两人对峙固定——压迫…two facing, tension即梦IP-Adaptersfx_door已合成
SC03特写3男主冷笑抿唇固定——玩味…man smirk close-upWan2.2IP-Adapter+PuLIDsfx_breath已合成
SC04近景5女主垂眸又抬眼微摇"我以为你不敢来"试探…she looks down then upWan2.2IP-Adapterv04.wav已合成
SC05中景4男主逼近一步推进——压迫…man steps closer即梦IP-Adaptersfx_step已合成
SC06全景3走廊灯光忽暗固定——悬疑…corridor light dims即梦风格锚sfx_light已合成
SC07近景5女主轻笑转身环绕"那就…陪你玩玩"反转…she smiles turnsWan2.2IP-Adapter+PuLIDv07.wav已合成
SC08特写3男主眼神骤变(钩子收)固定——悬念…man eyes sharpenWan2.2IP-Adapter+PuLIDsfx_sting已合成
衔接说明:SC01→SC02 用首尾帧接;SC04 微摇不宜超 5s;SC07 环绕仅 5s 控闪;情绪曲线:紧张→压迫→玩味→试探→压迫→悬疑→反转→悬念,全程不平。

五、从分镜表到生产的字段映射

分镜字段落实环节 / 工具
生图提示词 + 一致性绘图:即梦 / FLUX / SDXL + IP-Adapter / PuLID
视频模型 + 首尾帧生视频:Wan2.2 / 即梦 / H3(FL2VA/Ref2VA)
台词/旁白 + 音频文件声音:GPT-SoVITS / F5-TTS / 海螺原生音
运镜 + 时长剪辑:剪映 / 达芬奇,卡 BGM 点
音效 + BGM混音:对白优先,响度统一
情绪QA 自检:画情绪曲线,查是否"平"

六、常见分镜病(与 10_案例库 反面案例对照)

分镜病表现修复(改表即可)
开篇无钩子前 10s 介绍背景第一镜直接上冲突/悬念,背景靠动作带
单镜过长15s 武打一段拆成 ≤5s 短镜,后期拼
台词超长独白 30 字拆 ≤12 字短句或改画外音
跳脸第 3 镜特征变特征词压 2–4 个 + 参考图/LoRA
风格漂移前动漫后写实全剧单一底模 + 风格锚
接不上剪辑处硬跳下游镜标"首尾帧接 SC0X"

七、给 AI 的用法

13 · 双流程实战:从剧本分镜到出片(线上 + 本地)

知识截止 2026-09。本篇把"豆包 / DeepSeek 写剧本分镜 → 即梦出图 →(即梦出视频 或 ComfyUI + MiniMax H3 出视频)"两条流水线写成可照做的实操,含可抄提示词、优化技巧、人物一致性 & 剧情连贯性保证。前序模块:02 剧本与叙事工程03 角色与美术资产12 分镜表实操与模板

一、两条流程总览(先选路)

维度流程 A · 纯线上流程 B · 混合(本地出视频)
剧本 / 分镜豆包 + DeepSeek(两路通用)同左
出图即梦(Seedream 5.0)即梦(Seedream 5.0)
出视频即梦(Seedance 2.0/2.5)ComfyUI + MiniMax H3(本地,INT8 量化)
人物一致性即梦"角色一致性"开关即梦定妆图 → 同时作 H3 首帧/参考图,全链路同一张脸
配音后期加(剪映 / TTS)或即梦音画同步H3 原生带配音(FL2VA 联合生成),少后期对口型
硬件任意电脑 / 手机需 N 卡 ≥12G 显存(RTX 3060 12G 可跑 INT8)
成本即梦积分 / 会员(有免费额度)一次性模型下载 40–60G + 电费,出片零边际成本
适用新手最快出片、验证创意量大、数据私有、不排队、要原生配音

一句话决策:先走 A 跑通带声成片建立手感;要量产百集不崩 / 数据私有 / 原生配音再上 B。两条前半段(剧本分镜 + 出图)完全共用,只差"出视频"这一步。


二、共同前半段:豆包 + DeepSeek 做剧本与分镜

2.1 两个模型怎么分工(不要只用其中一个)

2.2 分层生成法(不要一次性让 AI 写整剧,这是新手第一大坑)

按 5 步递进,每步确认再下一步:

  1. 选题 → 2. 故事设定 / 人设 → 3. 分集大纲 → 4. 单集剧本 → 5. 分镜脚本。

每步单独发指令,AI 输出更可控、画面更好生成。

2.3 可直接抄的提示词(5 层结构,DeepSeek / 豆包通用)

你是一名专业的短剧编剧,擅长【题材:古风逆袭 / 都市爽文 / 甜宠 / 悬疑】,
熟悉抖音、快手短剧的快节奏叙事(角色设定层)。

请为我创作一部 6 集、每集 60 秒的竖屏 9:16 AI 漫剧《【剧名】》(任务描述层)。
要求:
1. 前 3 秒强钩子(冲突 / 悬念 / 反转);每 10–15 秒一个小高潮;结尾留悬念(分镜约束层)。
2. 角色数量 2–4 人、场景 ≤3 个,方便 AI 生成(分镜约束层)。
3. 先输出"角色设定表":每人含 姓名 / 年龄 / 性格关键词 / 外貌特征(发型+服饰+标志性配饰)/
   声音风格建议(人设定义层,最关键:这是后续锁脸的锚点)。
4. 再输出"6 集分集大纲":每集 标题 / 开头钩子 / 剧情发展 / 爽点 / 结尾悬念 / 主要角色 / 主要场景。
5. 输出格式为 Markdown 表格(格式要求层)。
要点:外貌描述必须具体到发型、服饰、标志性特征(如"左眼下小痣""银色细框眼镜"),这些是豆包/即梦保持角色一致性的锚点,后续提示词里原样粘贴、不临时改写

2.4 单集剧本 → 分镜脚本(豆包,含可直接喂即梦的提示词字段)

请把第 1 集扩写成完整分镜脚本。要求:
1. 每个镜头 3–5 秒;
2. 每镜含:镜头编号 / 时长 / 景别 / 画面内容 / 角色动作 / 表情 / 运镜 / 台词·旁白 / 音效建议;
3. 额外输出两列:AI 绘图提示词、AI 视频提示词(方便直接复制到即梦 / H3);
4. 保持角色一致性,不要出现大规模群像和复杂打斗;
5. 风格统一为:【写实国风 / 日系赛璐璐 / 半写实韩系】。

2.5 画面提示词固定结构(给即梦 / H3 生图生视频都好用)

[主体角色描述] , [动作 / 表情] , [环境场景] , [构图 / 景别] , [光影氛围] , [画风关键词] , [质量词]

示例:20 岁少女,在樱花树下回头微笑,长发被风吹起,粉色花瓣飘落,特写镜头,柔和的午后阳光,浅景深,日系清新风格,4K 高清

2.6 提示词优化 6 招(决定成败)

  1. 抽象 → 视觉化:把"温暖的氛围"改成"午后金色阳光透过百叶窗洒在木地板上,空气漂浮微尘";把"他很难过"改成"女主眼眶泛红,双手攥紧衣角,低头沉默"。
  2. 5W1H 写动作:谁、在哪、做什么、什么情绪、怎么拍、几秒。
  3. 单镜 ≤5 秒:超过模型上限时长必崩、必闪。
  4. 台词 ≤12 字 / 短句:长句 AI 配音气短、口型错位。
  5. 首尾帧衔接:跨镜头必填首尾帧字段,决定衔接顺滑。
  6. 定妆图锚定:先出角色定妆图再量产所有镜头,全剧固定一套模型 + 画风关键词,严禁中途切换。

2.7 豆包"万能极简脚本模板"(B站 / 头条爆款验证,30 秒速出)

当只想快速跑通、不写长梗概时,直接用这一条(已被多个实战教程验证有效):
写 30–60 秒爆款竖屏漫剧脚本,题材=【逆袭 / 甜宠 / 悬疑 / 古风】,
开篇 3 秒强冲突,1 主角 1 矛盾,台词 ≤3 句,结尾必留悬念;
输出:镜号 / 景别 / 画面(含可直接生图的视觉描述)/ 台词 / 情绪。

三、流程 A:纯线上(即梦出图 + 即梦出视频)

3.1 即梦出图(Seedream 5.0)

3.2 即梦角色一致性(核心功能)

3.3 即梦出视频(Seedance 2.0 / 2.5)

主体/角色 → 动作/剧情 → 镜头/运镜 → 场景/氛围/光影 → 风格/特效/音频

3.4 图生视频提示词(最稳,直接抄)

动作 + 运镜 + 风格 + 流畅度

示例:镜头缓慢推近,少女转头,眼神惊讶,治愈系,画面流畅无卡顿,5 秒

3.5 线上避坑

3.6 图生视频提示词库(B站实战验证,直接抄)

3.7 剪映后期节奏(让 PPT 式死图变"活漫剧")

  1. 每张分镜图时长设 2–3 秒,叠加 "放大 / 推进"运镜(关键帧缩放 105%→110%)让画面不呆板。
  2. AI 配音选少年 / 御姐 / 温柔声线,语速放慢避免机械感;自动字幕。
  3. BGM 按题材:悬疑用低沉纯音、甜宠用温柔钢琴、逆袭用渐强鼓点;配光斑 / 暗角滤镜提升氛围。
  4. 导出 9:16 竖屏 1080P,卡 BGM 节拍剪点。

3.8 选题与新手避坑(B站 / 头条高赞共识)


四、流程 B:混合(即梦出图 + ComfyUI + MiniMax H3 出视频)· 针对 RTX 3060 12G

4.1 为什么这么搭

4.2 3060 12G 部署 H3 前置清单(节点 + 模型)

  1. ComfyUI ≥ 0.30.0(桌面版或启动器,旧版缺 H3 节点);模板库 Template Library → Video → MiniMax H3 内置三套工作流。
  2. 安装 H3 节点(GitHub 真实可用,三选一或组合)
  3. comfyui-minimax-h3(官方插件 v0.2.1):基础 H3Loader / H3TextEncode / H3VideoGenerate,日志出现 Minimax H3 Node Loaded 即成功。
  4. ComfyUI_MiniMaxH3_Director(AIMixer,导演台):多段生成核心,任务类型 fl2v(首尾帧)/ r2v(参考主体锁脸,需 REF2VA 主模型)/ 文生视频,做长剧 / 短剧一致性最实用。
  5. ComfyUI-Easy-Media(yolain):easy-minimaxH3ToVideo 一站式节点,自动按 mode(reference / multi_frames / last_frame)路由到正确核心节点,参考图自动展开,省去手动接线。
  6. 关键参数(社区实测):采样器 res_multistep + simplesteps=25,CFG=1.0,Sigma shift video=12 / audio=3;CLIP Loader 的 type 必须选 minimax(否则提示词编码报错);帧数按 17n+5 对齐(如 124 帧 ≈ 5 秒),训练上限 362 帧 ≈ 15 秒 @24fps,超出必漂移 / 崩坏,长内容用导演台分段
  7. 下载 INT8 量化模型(推荐多数人的版本),目录结构:
ComfyUI/models/
├─ diffusion_models/  minimax_h3_fl2va_pruned_int8_convrot.safetensors   (主干)
├─ text_encoders/     qwen3vl_32b_minimax_h3_int8_convrot.safetensors      (文本编码器,可能成对:主体+尾部,都要放)
└─ vae/               minimax_h3_video_vae_fp16.safetensors
                     minimax_h3_audio_vae_fp32.safetensors                (音频 VAE,原生配音的关键)
  1. 国内用魔搭下载更快:modelscope download --model Gluttony10/MiniMax-H3-INT8-CONVROT --local_dir ComfyUI/models/MiniMax-H3
  2. 显存仍紧 → 切 GGUF 社区量化(更小但对画质略降);放 diffusion_models 重启即识别。
  3. 加速可选 4-Step Turbo LoRAmodels/loras,提速明显)。

4.3 H3 三种工作流怎么选(关键:用即梦定妆图当输入)

4.4 H3 出视频提示词公式(图生视频,直接抄)

主体 + 动作/状态 + 环境光感 + 镜头语言 + 时长

示例:

4.5 H3 原生配音注意

4.5b ⚠️ H3 本地权重许可证合规(必读)

4.6 时序稳定(闪烁 / 手部 / 漂移)

4.7 3060 速度预期 & 降本

4.8 🆕 备选:LTX2.3 + 20 宫格全本地方案(3060 12G 更省心)

4.9 🆕 工程化落地:用「漫剧工作台」串起流程 B(你的真实工具链)

你机器上已有一套自研的 AI 漫剧制作工作台E:\ai漫剧工作台\workbench\,Node.js 零依赖 Web 应用 ai-manju-workbench),它就是把本章流程 B 直接工程化的载体——不用在即梦网页、ComfyUI 界面、EchoMimic 之间手动切来切去。

架构(三层数据模型 + 统一 Provider 层)

与流程 B 各环节一一对应

流程 B 环节工作台落地模式
豆包 / DeepSeek 写剧本分镜Provider 层已接;默认手动粘贴,可开 API 自动(见下方「API 自动模式」)手动 / API
即梦出定妆图手动导入路径;或经 ComfyUI-Jimeng-API 节点自动手动 / API-节点
ComfyUI + H3 出视频workflows/i2v_minimax.json(H3 图生视频),自动提交 / 轮询 / 下载自动
角色一致性风格锚 = 首帧图 + ipAdapterWeight 0.3自动
EchoMimic 数字人已接 7860,有音频才跑、无则跳过不阻断自动

你的 aki-v7 本地侧已齐(无需新装)D:\ComfyUI-aki-v7\ComfyUI\custom_nodes 已含全套 H3 节点——ComfyUI_MiniMaxH3_Director(导演台)、ComfyUI-MiniMax-H3-StoryBoardComfyUI-H3-MultishotComfyUI-MiniMaxH3-TeaCacheComfyUI-H3-Conditioning-Cache-AI-Drama-Production-Suiteh3-studiocomfyui-speed-minimaxH3comfyui_ipadapter_plusComfyUI-GGUFcomfyui-Impact-Pack 等共 34 个。即梦出图还可走本地 FLUX.1-dev GGUF / SDXL+IP-Adapter 工作流(免即梦排队)。

config.json 关键配置(已对齐流程 B)

跑通步骤(本机,沙箱连不上 localhost):详见工作台目录 流程B跑通Checklist.md——① 起 aki-v7(8188)+ 可选 EchoMimic(7860)→ ② 起工作台 node index.js(8787)→ ③ 豆包 / DeepSeek 写剧本粘贴导入、即梦出定妆图导入路径 → ④ 点 run shot 自动出 H3 视频。

API 自动模式(可选升级):剧本端接豆包 / DeepSeek API 后可自动生成(src/providers/script.js + config.api);出图端装 ComfyUI-Jimeng-API 节点并配 jimeng 工作流即自动。密钥留空则回落 manual,不破坏现有流程。

4.9.1 整集批量一键出图(已落地)

逐镜点「真实生成」适合精修;量产时用整集批量:工作台选中剧集即进入「批量创作」视图,点独立大按钮「🔥 一键出图(整集 N 镜)」,一次生成本集所有尚未出图的分镜。

4.10 即梦出图全自动:ComfyUI-Jimeng-API 节点(让流程 B 出图端也自动化)

现状:流程 B 出图端默认走"即梦网页出图 → 导入路径"或"本地 FLUX/SDXL+IPA"。装此节点后,即梦 Seedream 出图 + Seedance 出视频可直接进 ComfyUI 画布,与 H3 视频节点串同一条工作流,免网页/本地来回切——这是出图端全自动的关键一步。

4.11 剧集合成:多镜拼整集成片(已落地)

把本集各镜成片按顺序拼成一条完整剧集视频src/providers/merge.jsPOST /api/projects/:pid/episodes/:eid/merge):

4.12 分发:整集落地页 + 视频号 / 抖音(已落地)

流程 B 最后一环「分发」已在工作台做实(逐镜「分发」步骤):


五、人物一致性保证(两条流程对照)

手段流程 A(线上·即梦)流程 B(混合·即梦+H3/ComfyUI)
定妆图先做角色定妆图,全剧复用同左,且同图喂给 H3 当首帧/参考
一致性开关即梦"角色一致性"开关(强度 0.6–0.85)H3 Ref2VA 锁脸锁声;本地 SDXL / FLUX 用 IP-Adapter(权重 0.6–0.8 最稳,需更强才上探 0.8–0.9) / PuLID / FaceID / InstantID。⚠️ H3 系工作流无独立 IP-Adapter 节点,一致性靠首帧风格锚(见 4.9 / 9.3)
画风固定一套模型 + 风格词同左,禁止中途切换
Seed即梦固定种子可复现本地固定 Seed + 角色卡(3–5 张多角度参考图)+ ControlNet 控姿势构图

铁律五条:① 先做角色三视图(正/侧/背)再量产,全剧垫同一组参考图;② 先定妆再量产;③ 全剧固定一套模型 + 画风;④ 外貌特征词压 2–4 个、原样粘贴;⑤ 保存成功图的 Seed 值与提示词模板。


六、剧情连贯性保证


七、给 AI 的用法


八、GitHub / B站 实测可用资源索引(2026-09 补充)

下列节点 / 工作流 / UP 主均为本轮检索验证过、可实际取用的资源,作为落地参考(模型名与价格随官方更新,使用前回官网核对)。

8.1 ComfyUI 节点(GitHub,可直接 git clone 安装)

8.2 工作流 / 整合包(社区分享)

8.3 B站 / 公开教程(实操向)

九、流程 B 跑通 Checklist(本地实操,回写自 workbench/流程B跑通Checklist.md)

E:\ai漫剧工作台\workbench\ 跑流程 B 的本机实操清单。沙箱连不上本机 localhost,真跑需你本机终端。

9.1 启动顺序与端口

  1. 先起本地引擎(单卡别并行新任务):ComfyUI(aki-v7) 默认 8188(启动日志出现 Minimax H3 Node Loaded 即 H3 节点就位);EchoMimic v2 可选 7860
  2. 再起工作台:workbench 目录 node index.js(或 run_web.bat)→ 8787
  3. 浏览器开 http://127.0.0.1:8787

9.2 手动导入步骤(默认 manual 模式)

  1. 豆包 / DeepSeek 写剧本 → 工作台粘贴导入(importScript)。
  2. 即梦出角色定妆图(先三视图正/侧/背)→ 导出本机 → importKeyframe 填路径。
  3. 可选:口播音频导出 → importAudio(EchoMimic 必须音频才跑数字人)。
  4. 点该分镜 run → 自动提交 ComfyUI 跑 H3 图生视频 → 下载到 data/assets/videos/

9.3 i2v_minimax.json 校验

9.4 常见失败排查

9.5 API 自动模式(可选升级)

9.6 分发(落地页 + 视频号 / 抖音)

9.7 剧集合成(多镜拼整集)

十、后期自动化(ffmpeg:字幕 / BGM / 封面 · 已落地 workbench)

流程 B 前四环产出「视频 + 数字人」,但仍无字幕、无配乐、无封面——不能直接发。后期模块把这一步工程化。

10.1 三个能力(src/providers/post.js)

10.2 触发与落点

10.3 依赖与注意事项