14 篇
没有匹配内容

本表收录全流程出现的所有专有名词,每个词给出:一句话定义 + 出现环节 + 详细解释在哪。 遇到不认识的词,先来这里查。


一、流程与环节

术语 定义 环节
故事骨架 长篇/系列化漫剧的结构地基:故事核、人物小传、三幕、分集、付费点、反转登记表 前置
台词分幕 把小说拆成「角色 + 台词/旁白 + 情绪强度」的结构化 JSON
选本改文 找小说改写成爆款文案,或用原创指令自己写爆款小说
小说转剧本 把小说改编成漫剧剧本(含 场景描述、OS/V.S.、转场标注)
导演规划 把剧本转成拍摄计划(分场汇总表 + 逐场注意事项 + 场间过渡),只拆分不创作 ② 之后
人物提示词 为每个角色生成四种风格版本的出图提示词
角色设定卡 角色的一致性锚点:固定不变区(五官/发型/标志物/禁止项)+ 固定描述 + 画风后缀
表情矩阵 5×2 十宫格表情板,同一张脸只变表情,用于配音口型参考 ③.5
三视图 角色设定板(正面/侧面/背面 + 头像 + 细节),保证跨镜人物一致
场景提示词 无人纯场景的电影级提示词(必含前中后景)
分镜头提示词 按时间轴(秒)拆分镜,含六维一致性 + 角色映射
分镜审核 对分镜表过红线(R1~R4)+ 审核维度,出问题清单 ⑥ 之后
视频生成 用即梦/可灵出视频片段(单帧 / 首尾帧两种方法)
剪映合成 剪辑视频片段成片
主体库 / 数字资产库 存放角色「标准像」(Master Reference)的可调用数字资产库;后续每个镜头强制参考以锁定一致性 ③.7
参考生视频 以主体库标准像为强制参考生成视频的模式(区别于单张图生视频),解决跨镜「角色变脸」 ③.7

二、故事与剧本术语

术语 定义 详见
爆点 / 虐点 / 爽点 三大情绪要点:震惊事件 / 心痛事件 / 高光时刻,每集至少含 1 个 R4
爽点公式 爽点 = 装 + 打脸 + 震惊 + 收获 R4
三大密度 情绪密度 / 信息密度 / 情节密度——单集三项都不能"低" R4 R5
黄金单集公式 本集 = 情节承接 + 冲突升级 + 价值转变 + 下集勾连 R4
3-15-45 节奏 3秒情绪冲击 / 15秒剧情变化 / 45秒强期待 / 结尾反转钩子 R4
开篇 8 大规则 冲突即时性、信息量密集、信息差、铺垫≤3集、关系拉扯、每集反转、压情绪、明确目标 R4
大三角 / 小三角 大三角=3个核心角色/势力构成全剧主矛盾(贯穿始终);小三角=围绕主角的次要矛盾 R5
矛盾四级阶梯 基本 → 强化(二选一困境)→ 高级(两个好人不同命运)→ 升级(不可回头后果);爆款须达 3-4 级 R5
心理级爽点 三种:优势(金手指)/ 归属(团结家国)/ 秩序(逻辑还原真相);骨架须锁定 1 种 R5
金手指 主角独有能力,必须新颖唯一、有约束、非洗稿(市面>10次弃用) R5
人物小传 大三角核心角色(≤4人)的档案:五要素 + 主角额外四项 + 出场七技 R5
付费点 / 卡点 按总集数 N 的 10%/30%/50%/70%/90% 位置设置的付费卡点 R5
假付费点 让观众误以为目标即将达成实则受阻,持续牵引情绪 R5
股价级反转 全剧级核心反转(约 3 个),从根上打破观众"猜到结尾"的预判 R5
反转三式 预期误导反转 / 人设颠覆反转(仅配角)/ 动机置换反转 R5
钩子级反转 单集级反转(≤1个):道具伏笔 / 情绪回弹 / 镜头错位 R4
信息差 观众/角色之间信息不对等,三种配置(先知型/焦急型/上帝型) R5
拉扯 段级预期管理:压弹簧到谷底 → 来回晃 ≥3 次 R5
开篇三坑 ①介绍人物铺背景 ②一群人开会 ③慢悠悠写景扯前情——必避 R4

三、分镜与镜头术语

术语 定义 详见
景别 远景/全景/中景/近景/特写/微距——画面取景范围 工具箱
视角 平拍/仰拍/俯拍/鸟瞰/虫眼/侧拍等——摄影机角度 工具箱
运镜 推/拉/摇/移/跟拍/固定 + 环绕/升降/甩镜等——镜头运动 工具箱
时间轴 分镜按秒切分:10秒版 [0-3][3-6][6-8][8-10],15秒版 [0-4][4-8][8-12][12-15]
六维一致性准则 人物一致 / 时空一致 / 物品一致 / 动作连贯 / 台词合规 / 敏感过滤
分镜生成四步法 场景锚定 → 连续性检查 → 台词植入 → 敏感扫描
3秒决策原则 执行前必检:人物是否齐全 / 场景是否连贯 / 有无违禁内容
帧描述五要素 ①景别视角+取景范围 ②角色位置姿态 ③主光完整叙述句 ④环境道具细节 ⑤情绪解剖词——背景锚定词 R2
motionScript 分镜的动作时间轴脚本:每段用 [] 包裹, 连接动作,必带 ` 朝向:…`
cameraDirection 运镜意图,格式:起幅[景别]→运动方式+速度→落幅[景别],目的:[…] R2
七律(视觉连续性) ①动作连续 ②景别递进 ③视轴守恒(180°铁律) ④朝向逻辑 ⑤信息控制 ⑥节拍密度 ⑦头尾安全区 R2
视轴守恒 / 180°铁律 同场景所有镜头须在假想轴线同侧拍摄,越轴会导致"人物瞬移" R2
节拍密度 2-3s≥1拍 / 4-6s≥2拍 / 7-9s≥3拍 / 10s+≥4拍 R2
呼吸镜头 情绪顶点后接的缓冲镜头(≥中景,允许超6s只有环境动态);同一顶点只触发 1 个 R2
承接上镜 用固定句式承接上镜末帧的定格终态(非动作起始),解决跨片段连贯 R6
时长预算 目标总时长×0.9 为硬下限;典型 ≥ 目标÷9(平均每镜9s) R2
首尾帧 先生成起始帧+结束帧,再插值生成视频(关键帧驱动) R1 R6
单帧 只生成一张图驱动视频(区别于首尾帧)
过渡效果 首尾帧之间必须写的转场描述(如"一道金光伴随烟雾过渡到尾帧")
口型 视频中人物说话嘴型与台词同步(即梦/可灵支持)
九宫格生成法 生成 3×3 网格故事板,每格一个分镜,用于快速预览 工具箱
@图N 标注 提示词正文中用 @图1 @图2 替代角色/场景名称,绑定参考图 R6
九宫格机位 虚拟空间预设的 9 个标准镜头角度库;按情绪/关系自动选机位组合(如愤怒=特写+仰视、对话=过肩) 6.10b
动态分镜 把 2-8 帧静态分镜转成动效预览(DomoAI Frames-to-Video),在进入昂贵视频生成前预判节奏/音画冲突 6.10b
Shot(动作分镜最小单位) 动作戏的最小电影单位:一个主要动作 + 一个主要结果 + 一个主要摄影任务;>3s 复杂动作必需先拆 Shot 6.11
动作因果引擎 动作分镜铁律:意图→动作→交互→结果→反馈→下一动作;后一动作必须由前一动作的结果推动 6.11
战术循环 动作戏默认:观察→试探→攻击→防守→反击→改变战术→优势→对手升级→高潮;至少一次战术变化 6.11
Combat DNA 角色的战斗档案(体型/重量/力量/速度/攻击距离/武器/优势弱点…);两名角色必须有可见差异 6.11
战斗距离 D0-D6 超远/远/中/近/贴身/抱抱/空中;距离变化必须由战术结果产生 6.11
CAM01-CAM20 运镜库 动作戏专用运镜编号库(缓慢推进/平行跟拍/低机位追拍/终结拉远…) 6.11
五变量运镜系统 光圈T值×焦距mm×物距m×对焦×摄影机运动,把自然语言转成可执行运镜参数 6.12
真 Dolly vs 假变焦 推进+焦距固定=真 Dolly(透视真实变化);不动+焦距增加=Zoom(数字放大,透视不变) 6.12
Dolly Zoom / 希区柯克变焦 推进+焦距同步增加,主体比例稳定、背景剧烈伸缩;用于恐惧/真相/心理崩塌 6.12
方言配音控制 按地区/城市控制 TTS 方言听感(核心发音/声调/节奏/语气/口语特征);以当地年轻人日常口语为基准 7.1
夸张表情 突破现实物理规则的漫画化表情单片(搞笑/名场面用),与 ③.5 一致性用的十宫格表情板互补 ③.5.1
情绪→视觉翻译 把抽象情绪词拆成「五官层 + 肢体毛发层 + 漫画符号特效层」的具体像素指令;模型不认情绪,只认像素 ③.5.1
漫画符号特效 漫画/动画通用情绪视觉语言(感叹号/震动线/螺旋眼/瀑布泪/青筋/炸毛/灵魂出窍…),写进提示词提升出图稳定性 ③.5.1
夸张度三档调节 轻度「略微」修饰 / 中度「夸张」加大幅度 / 重度「极度」突破人体结构 + 漫画符号 ③.5.1
角色基底描述 同角色多表情时逐字复制、一字不改的外貌锚点段(防崩脸核心) ③.5.1

四、资产与一致性术语

术语 定义 详见
资产 / 资产库 角色(role)/场景(scene)/道具(prop)的统一管理单位 R6
资产ID 资产库中每个资产的唯一编号,分镜引用时使用(禁虚构) R3 R6
主资产 角色/场景/道具的基础形态 R6
衍生资产 同一主体的状态变体(破损/染血/夜景/激活态/换装) R6 R7
父子资产 主资产(父)+ 衍生资产(子);衍生状态匹配时必须用衍生ID,同镜禁主/衍生同存 R3 R6
角色信息库 ③ 环节产出的角色档案集合(姓名 + 固定外貌描述),供 ⑥ 分镜做角色映射用 ③→⑥
角色档案 / Character Bible 集中管理所有角色的固定描述 + 标志物 + 禁止项 R1 R6
标准母图 角色定妆照,后续所有镜头以它作参考(MJ --cref / IP-Adapter) R1
L0-L6 分层 服化妆造分层:L0底模 L1妆容 L2发型 L3中衣 L4外衣 L5配饰 L6鞋履 R7
底模 L0 基础形象,叠加时面容/姿态不变 R7
四视图 人像特写 / 正视图 / 侧视图 / 后视图(比三视图多"人像特写"位) R7
固定不变区 角色设定卡中跨镜必须一字不差复制的部分
标志物 角色设定卡中必填的 1 个识别特征(如眼镜、疤痕)
禁止出现项 角色设定卡中明确不能出现的元素
视觉契约 把一致性从「抽卡」变「规则」的三段法:视觉身份证 → 权重控制 → 预览验收 ③.6.1
视觉身份证 每个核心角色一份固定核心描述(供 AI 每次「想起」都是同一个人) ③.6.1
提示词权重控制 不变项(发型/瞳色/服饰)权重调高、可变项(光影/动作)权重调低;配合局部重绘修正 ③.6.1
Omni Reference Midjourney V7 的全局参考(--cref),除面部外还捕捉气质/色彩比例/服饰纹理 ③.6.1
IP-Adapter FaceID / ADetailer 开源流面部锁定插件(FaceID 锁面部骨骼);ADetailer 自动检测并高分辨率重绘面部 ③.6.1

五、画风术语

术语 定义 详见
风格自适应 按题材自动选画风(修仙→国风、都市→现代、科幻→科幻…),禁默认国风
画风基因 / 风格基因 每种画风的"灵魂锚点":写实=面容、复古日系=线条、扁平=轮廓、黏土=肌理 R8
画风标签 一段固定英文/中文标签串,注入视频提示词锁定画风 R9
3D渲染风格 / 真人实拍风格 / GPT A版 / GPT B版 人物提示词的四种风格版本(详见 ③)
GPT A版 半身特写(截到腰部),国漫3D顶级渲染,可用增强描述
GPT B版 全景站立,短词骨架 80-120 字,纯唯美,瞳色自由
场景变体 同一场景的景别/时段/天候变化(建筑布局材质不变) R9
集级色温弧 全集整体色温走向:冷→暖 / 暖→冷 / 冷→暖→冷 / 中性→极端→收回 R2

六、审核术语

术语 定义 详见
红线 R1~R4 R1资产引用合法 / R2剧本忠实 / R3具象可感 / R4父子资产选择正确——违反任一=严重问题 R3
审核维度 20 项检查(台词完整性、剧本覆盖度、禁光影色调、音效禁配乐…) R3
评分 A/B/C/D A可直接用(0严重≤2中等) / B小修 / C较大修改 / D重做(≥3严重) R3
禁光影色调 分镜任何字段不得出现 光/影/逆光/侧光/色温/明暗/色调/暖冷 R3
音效禁配乐 音效列仅环境音+动作音,禁 BGM/配乐/音乐 R3
人物外观不进提示词 画面描述不写服装/发型/长相(交给图片资产) R3

七、工具术语

术语 定义
即梦 字节跳动 AI 出图/出视频工具(本项目主力)
可灵 快手 AI 视频工具(口型功能)
剪映 字节跳动视频剪辑工具
DeepSeek / 豆包 文本/提示词生成 LLM
Seedance 即梦底层的视频生成模型
Nanobanana / Seedream 出图模型(前者 Gemini 系,后者豆包系)
SkyReels-V4 昆仑万维音画同步模型(对称双流 MMDiT,毫秒级对口型)
Vidu Q3 生数科技「参考生视频」模型(多主体参考 + 音画同出 + 场景特效复刻)
Fish Audio 多语言出海配音(跨语言一致性 + 表情标签)
Suno v4 / Minimax Music-2.0 背景音乐生成(曲式结构定制 / 人声分离克隆)

八、表情 / 声音 / 质感术语(2026-09-21 第二批)

术语 定义 详见
微表情五层架构 身份锚定→情绪基调→肌肉运动→时序编排→环境联动的写实表情提示词结构 ③.5.2
AU 动作单元 FACS 系统的面部肌肉运动编码(AU12=嘴角上扬),AI 对解剖学术语响应更精确 ③.5.2
氛围细节锚点 场景中承载剧情线索的可见物(破碎玉佩/旧信),让氛围连接故事 5.4
声纹锚点 从满意片段提取的 3-5 秒干净人声样本,作角色后续所有片段的音色参考 7.2
声音资产卡 每角色的声音档案(音色/语速/音调/默认情感/版本),跨集统一管理 7.2
标点情绪遥控 TTS 中标点即停顿指令:……拖尾/——反转/()气声/[]不发音导演指令 7.3
质感词 把"电影感"拆成的可执行画面语言(胶片颗粒/湿润反光/空气体积光等 10 类) 6.16
短剧剧本黄金公式 开场 3 秒钩子→每集小冲突+钩子→高潮反转的短剧叙事结构;每集 45-90 秒、8-16 集 ① / 模板⑰
画面事件 短剧每集必含的可拍动作(摔杯子/推门/手机响),替代闲聊场景
视觉符号 贯穿剧情的标志性意象(戒指/伞/弹窗),强化记忆与情绪
AI 仿真人漫 用 AI 生成接近真人质感的漫剧形态(2026 百强榜占比近 60%) 附E
自部署开源模型 大厂转向私有算力池 + 开源视频大模型,降低对单一闭源大模型的依赖 附E
一站式 AI 引擎 内置剧本解析/角色资产库/分镜生成/配音音效的全链路平台 附E
成片导出规格 竖屏发布导出参数:MP4 / 1080×1920 / 30fps / 8000-10000kbps 8.1
音画同出 视频与音频同步生成的模式(取代「先视频后对口型」),Vidu Q3 / SkyReels-V4 7.2b
拟声字特效 剪辑中与音效/画面同步的文字特效(打斗「轰」、惊讶「啊?!」),漫剧区别于真人剧的重要特征 附E
抽卡师 工业化流水线催生的提示词工程师岗——把脚本翻译成 AI 能理解的指令 6.10b
极速流 / 精品流 两套工作流:极速流(约 1h、单人、<50 元/集)vs 精品连载流(资产库前置 + LoRA,5-10 人 15-30 天) 附E

九、合规与监管术语(2026 新规)

术语 定义 详见
分类分层审核 按投资额 + 题材将微短剧分三级审核(重点/普通/其他),AI 漫剧 2025-11 起纳入 2.3 / 附F
三级备案 ≥300万或敏感题材→总局发证;100-300万→省级备案;<100万→平台自审+省级报备 2.3 / 附F
持证上岗 2026-04-01 起 AI 漫剧制作方须持《广播电视节目制作经营许可证》方可上线 2.3 / 附F
《网络剧片发行许可证》 重点微短剧经总局审核后核发的上线凭证(片头标许可证号) 附F
广播电视节目制作经营许可证 制作/发行网络视听内容的硬性资质(个人常见解法:签约 MCN/挂靠持证公司) 2.3 / 附F
AI 强制标注 AI 生成内容须在片头/显著位置标注;纯 AI「AI生成」 vs AI 辅助「AI辅助生成」分开标 2.3 / 附F
AI 魔改经典 颠覆四大名著/历史题材/英模人物形象的违规行为(2026-01 起全国专项治理) 附F
版权存证 留存 AI 提示词 / 参数 / 生成日志 / 素材授权合同,作权属证明与自证清白依据 2.3 / 附F
六大零容忍 红果 2026-05-18 补充审片标准:不良价值观/低俗擦边/封建迷信/观感不适/侵权盗版/未成年人有害 附F
备案编号 普通/其他微短剧经省级广电备案后获得的编号(片头标注) 附F

十、自动化生产术语(2026-09-22 · 素材 19)

术语 定义 详见
标准化分镜脚本字段表 多集批量生产用的分镜固定字段(集数/镜头号/时长/场景/角色/景别/画面描述/动作/情绪/对白/出图提示词/图生视频提示词/质检标准 共 13 列) 6.17
分镜中间层 连接剧本与图像生成的关键数据层;字段固定后可被脚本逐行读取、批量出图 6.17
断点续传 批量生成中途失败时,已完成镜头自动跳过,不必从头重跑 7.4
失败重试 调用外部 API 失败时自动重试 N 次并记录原因(降低波动影响) 7.4
多集批处理 一次向同一工作流提交 EP01/EP02/EP03 多集分镜批量生成 7.4
资产库四类 角色/场景/风格/提示词 四类资产的统一记录(保人物一致/环境一致/视觉统一/生成稳定) 6.17
角色锁定 / 角色种子 固定角色面部特征与服饰的一致性手段;同一角色尽量用同一套提示词,避免频繁换模型 7.4

十一、发行与变现术语(2026-09-22 · 素材 20)

术语 定义 详见
分账系数 平台按漫剧形态给的收益倍数(抖音口径:仿真人 60× / 3D 50× / 2D 40× / 沙雕 10× / 静态 1×)——决定同播放量下的收入差 ⑨ 9.1
IAA / IAP / IAAP IAA=广告变现(免费看+广告分账);IAP=用户付费(按集解锁);IAAP=两者混合(先 IAP 试水、后转 IAA 拉长生命周期) ⑨ 9.3 / 附E
投流(买量) 花钱购平台流量获得初始曝光;是短剧/漫剧变现的核心成本,与制作降本形成「剪刀差」 ⑨ 9.4
ROI 剪刀差 制作端因 AI 降本,但买量成本刚性甚至上涨、收益端下滑 → 投流 ROI 走低(大量项目 <0.8) ⑨ 9.4
爆款率 破亿播放作品 / 上线作品总数(2026 上半年 0.47%;另有 0.16%/0.117% 等口径,须标注来源) ⑨ 9.4
平台保底 平台对 S+ 级内容预付的最低收益(抖音/快手 S+ 单部 75 万等),降低创作者赔率风险 ⑨ 9.1
免费 IP 库 平台开放的免费/低价网文 IP(番茄 6 万+/阅文/七猫),免费改编+补贴,降低选题版权风险 ⑨ 9.3
出海译配 将漫剧配音/字幕本地化为目标语种(AI 译配将 7-14 天压至 2-4 小时),一次生产、全球分发 ⑨ 9.3 / 9.6
镜头语言思维 写提示词时用「拆解镜头」而非「记叙文」:中景交代人物+动作,切镜到关键细节特写(一线经验,防荒诞机位) ⑨ 9.6

十二、诊断与返工术语(2026-09-22 · 素材 21)

6.18 卡点排查方法论。卡住时按「层」定位问题,再单变量返工。

术语 定义 详见
信息增量 每镜必须回答「观众看完这一镜,信息增加了什么」;删掉无信息损失的镜头 = 装饰镜头 6.18
卡点四类 剧本不可生成 / 角色不固定 / 分镜没任务 / 提示词过散——四类问题的优先修正方向 6.18
可生成剧本四字段 场景目标 / 可视动作 / 情绪变化 / 镜头钩子(把文学剧本改成模型能执行的结构) 6.18
角色卡固定项 / 禁止变化 固定项=要保留什么(发型/瞳色/痣/标志服饰);禁止变化=不许自由发挥到哪里;后续镜头只引用 6.18 / ③.6
提示词母版 画风母版 + 角色固定 + 镜头变量 + 负面提示词 分开写;结构 > 长度 6.18
单变量返工 每轮只改一个变量,才能定位问题来源(先固定角色卡,只改某镜变量) 6.18
诊断口诀 连续 3 次方向不对→剧本/分镜(结构层);方向对但细节不稳→改提示词(执行层) 6.18

十三、转场与后期打磨术语(2026-09-22 · 素材 22)

8.2 / 8.3 合成阶段术语(源自北航手册)。默认硬切;跨镜不顺畅时才用过渡三法。

术语 定义 详见
首尾帧补间 上传前后场景图(首/尾帧),让 AI 生成自然过渡的画面 8.2
运镜驱动转场 用「推进 + 环绕」等连续运镜隐藏剪辑点,实现同场景时空推进 8.2
元素关联转场 借共同视觉元素(道具/动作)把两镜缝起来(文件 A 镜→B 镜新场景) 8.2
高光定格 反转/爆点时刻加 0.5 秒定格 + 文字特效,放大情绪 8.3
快剪处理(长短镜头) 冲突场景短镜头 2-3 秒/个;抒情场景长镜头 4-6 秒/个 8.3
字幕三原则 字体统一(黑体/思源黑体)+ 颜色对比(白字幕黑描边)+ 关键台词放大 8.3

十四、声音与画幅术语(2026-09-22 · 素材 23/24)

8.4 / 8.5 声音设计与画幅适配术语。配音与配乐分工:7.3 管「配音像不像人」,8.4 管「成片听感有没有劲」。

术语 定义 详见
音乐骤停 爆点处把 BGM 硬切(非淡出)并叠低频「咚」,瞬间锁住注意力;三大时机=高潮/反转/重点 8.4
主题动机(Motif) 贯穿全片的 3-5 音符旋律内核,反复变奏出现(观众音乐记忆约 3-5 音符) 8.4
情绪曲线(Emotional Arc) 画面从头到尾每 30 秒标一个情绪值(-5~+5),即「音乐分镜」 8.4
动态布局 音乐力度分布:ppp 30% / mp-mf 50% / ff 仅 5-10% / 过渡 10-15%(ff 只给高潮) 8.4
配器留白 「音与音之间的空间比音符更重要」;prompt 标 include rests,单乐器/4拍空气/silence 8.4
LUFS / dBTP 响度单位;人声 -16 / 配乐有人声段 -28 / 无人声段 -18 LUFS;真峰 -1 dBTP 8.4
成片对位三法 A 节拍对位(cut on beat)/ B 情绪对位 / C 动作对位(Mickey-mousing) 8.4
音效后期四步 音轨分离整理 → 音效重建 → 音效检查 → 音效层次优化 8.4
安全区间构图 主体锚定中央安全区、四周留余量 → 同一构图可裁 9:16 竖屏与 16:9 横屏 8.5
一套素材多用 一次生成 + 安全区构图,导出竖屏/横屏多版适配跨平台分发 8.5

十五、本地部署与开源术语(2026-09-22 · 素材 25)

附G / 附H 本地/离线全流程与开源生态术语。相对「云端即梦/可灵」:本地路线免 API、无水印、不限次,代价是需自备显卡。

术语 定义 详见
Ollama 本地大模型运行器;一条 ollama pull 即可跑 Qwen2.5 写分镜 附G
ComfyUI 节点式(Node-based)本地生成工作流界面,漫剧图/图生视频核心 附G / ③.6.1
IP-Adapter Plus FaceID 人脸锁定插件,锁定人物五官、跨镜头不变脸(本地防变脸核心) 附G
DWpose ControlNet 人体骨骼姿态控制模型,防止肢体畸形 附G
LTX2.3 / LTXVideo 轻量化本地图生视频模型,8G 显存可跑,做漫剧微动 附G
KJNodes ComfyUI 插件:批量循环渲染 + 本地文件读写(批量跑分镜必备) 附G
Qwen3-TTS / Qwen-TTS-ComfyUI 本地配音节点 附G
FaceID 权重 0.65 低配显卡最优的人脸锁定权重值(配正面人设图 + DWpose) 附G
waoowaoo 开源 AI 漫剧生成项目:剧本→角色→分镜→视频全流程自动生成 附H
固定特征库 + 控制网 工业级一致性双重保险:特征库(三视图参考底图/LoRA)+ 控制网(ControlNet) 附G / ③.6.1
AI 指挥 AI 用 LLM 把剧本自然语言拆为含光影/构图/动作的标准化 Prompt 并强制保留角色特征标签 附G / ③.6.1

十六、出海与译配术语(2026-09-22 · 素材 26)

术语 一句话定义 详见
译配 短剧出海的「翻译 + 配音」全流程,含字幕本地化、多语种配音、口型适配 附I
文化折扣 观众能读懂台词字面,却无法共情人物取舍/隐忍/情绪逻辑(「看得懂却看不进」)→ 出海真正的障碍 附I
本土化再生产 出海 2.0:不是翻译搬运,而是剧本语境重构+画面重制+情绪配音的全链再造 附I
MAIS(腾讯云媒体 AI) 擦除-翻译-配音-审核全栈媒体 AI 接口,用于高密度多语种工业化译制 附I
去字幕无痕(智能擦除) 从带硬字幕/水印的源片抹掉字幕区、输出干净母版的工序(1080P 3 元/分钟) 附I
母版工厂 把「去字幕+OCR+翻译」做成独立流水线,先产干净母版再按平台二次烧字幕 附I
音色 ID 配音 锁定音色后批量铺配音的模式(0.5 元/分钟),长尾集省成本、保 100 集同一声音 附I
音色克隆 一次性克隆主演音色(25 元/音色),沉淀为可复用的公司音色库资产 附I
全自动高情感克隆 带情绪起伏的影视级配音模式(9 元/分钟),用于钩子集/付费档 附I
OCR 提取并翻译 识别画面内文字(招牌/聊天截图/备忘录/合同)并本地化的工序 附I
分区合规审核 按目标地区红线(中东亲密/欧美暴力/东南亚宗教)自动标注疑似违规帧 附I / 2.3
时长偏差 / 语速自适应 翻译后译文时长与原口型不匹配的问题;三层策略:语速参数/约束改写/混合 附I
口型适配 让新语种配音与原画口型对上的技术(比翻译更难,需口型驱动/重绘) 附I
ToonScroll 阅文海外漫剧平台(年内计划上线超千部漫剧) 附I
FlareFlow 中文在线海外 AI 短剧平台(注册用户 3300 万+) 附I
StardustTV / NOVA AI 山海星辰海外短剧平台与自研一站式创作平台(「一人剧组」) 附I
投流剪刀差 制作端 AI 降本但买量成本刚性→收益被渠道吃掉的结构性矛盾 9.4 / 附I

十七、钩子与首屏运营术语(2026-09-23 · 素材 27)

术语 一句话定义 详见
视觉补偿 观众看 AI 剧是为看现实拍不出的东西(奇观/废墟/极致美学)→ 用视觉冲击降低心理防线 ①.2
预期管理 画面再美没冲突也是死的 → 钩子须 3 秒内抛出待解决的矛盾,给出「想看下去」预期 ①.2
黄金 3 秒钩子 开场 0-3 秒内完成“视觉补偿 + 预期管理”的开局设计,决定划走/留存 ①.2 / 工具箱模板㉘
钩子公式 按「题材 × 冲突」组合的十大开局配方(视觉奇观+身仉反差 / 仙宫审判+极致欺压 …) ①.2
想象力密度 AI 短剧竞争的本质:单位时长内能交付的奇观 + 悬念密度 ①.2
封面(首屏) 推荐流第一印象与点击率入口,建议直接复用开场 3 秒最强一帧 9.7
追更钩子 单集结尾留悬念吸引观众追下一集(拉到追更率) 9.7 / ①.2
溶图规避机制 角色设计阶段主动调整五官/骨相/发色/配饰,避免与艺人/知名 IP 撞脸的合规手法 ③.7 / 2.3
总局令第 16 号 《微短剧发展管理办法》(2026-09-01 施行),国内首部微短剧专门规章 2.3 / 附F
微短剧分类分层标准 2026-07-01《管理提示》,按投资额/题材分层审核的具体口径 2.3 / 附F

十八、智能体编排与 Pipeline 术语(2026-09-23 · 素材 28)

术语 一句话定义 详见
编排层(大脑) 负责剧本/分镜/多 Agent/JSON 结构化/循环批量的可视化工作流平台(Dify / n8n) 6.19 / 附J
执行层(双手) 负责实际出图/图生视频/配音的生成引擎(ComfyUI) 6.19 / 附J
Dify 可视化 Workflow/Agent 平台,擅长多 Agent 协作、JSON 结构化输出、工具调用 6.19 / 附J
n8n 开源自动化工作流编排工具(自托管的 Zapier),拖拽节点搭视频管道 7.5 / 附J
多 Agent 分工 编剧 Agent(②)/ 导演 Agent(⑥)/ 提示词优化 Agent(③④)各专一职、串联流水线 6.19
MCP Model Context Protocol,统一 AI 服务调用协议(零代码接工具的粘合层) 7.5 / 附J
API Format 导出 ComfyUI 把工作流导为 JSON,供编排层以「传 JSON + 变量」方式调用 6.19 / 附J
ComfyUI Plugin Dify Marketplace 官方插件,用 Dify 节点调用 ComfyUI 工作流 6.19 / 附J
知识库 编排层中沉淀角色参考图/世界观供每次生成引用的资料库(角色一致性) 6.19 / ③.7
Loop 节点 编排层的循环批处理节点(一键出多格分镜 / 一晚多集) 6.19 / 7.4
量化(FP8 / GGUF) 压缩模型降低显存占用的格式,12G 显存可跑 1080P(低配关键) 附J / 附G
视频生成 Pipeline 从「主题/剧本输入」到「自动出片」的无人值守自动化流水线 7.5 / 附J

十九、开源工程管线术语(2026-09-23 · 素材 30)

术语 一句话定义 详见
开源工程管线 以 Stable Diffusion 生态(diffusers)自建的整条可复现生产管线,非一站式平台 ③.6.2 / 附G
双 LLM 分工 LLM-1 出结构化分镜 JSON,LLM-2 把视觉描述转 SD 正/负提示词 ③.6.2
Kohya_ss 常用的 LoRA/Dreambooth 训练 GUI,含 network_dim/alpha、lr、epoch 等参数 ③.6.2 / ③.6.1
network_dim / alpha LoRA 网络维度/缩放系数(dim32/alpha16 为常见档) ③.6.2
过拟合(LoRA) 训练集背景/服饰单一时模型把无关特征也记住 → 背景变单一(对策:混背景+降 lr) ③.6.2
一致性三板斧 固定 seed + 首帧参考(上一场景末帧)+ IP-Adapter 权重动态调整 ③.6.2
动态 IP-Adapter 权重 表情变化大时把 IP-Adapter 权重从 0.8 降至 0.5,让 prompt 主导防五官扭曲 ③.6.2
AnimateDiff 把静态关键帧转 16 帧短视频片段的运动模块(motion_scale / context_overlap 调参) ③.6.2
motion_scale AnimateDiff 运动幅度:特写 0.6~0.8、全景 1.2~1.5 ③.6.2
context_overlap AnimateDiff 帧重叠数,不足会闪烁(闪烁时增至 6) ③.6.2
Wav2Lip 开源口型同步模型,对光照/侧脸敏感(仅正面特写做口型) ③.6.2
GFPGAN 人脸增强模型,仅对 mask 人脸区域增强(否则背景过锐) ③.6.2
Edge TTS 微软免费 TTS,中文情感参数为 style,可多情感/固定音色 ③.6.2 / ⑦.1
MoviePy Python 视频剪辑库(分段合成 + FFmpeg concat,中文字体必装) ③.6.2 / ⑧
五层架构 AI 漫剧量产模型:剧本结构化→分镜拆解→角色/场景资产→视频生成配音→剪辑导出 附E / ③.6.2
阿里 LumenX 阿里 AI 原生一站式短漫剧平台(API Key 启动,集成 10+ 模型 + CosyVoice/Qwen3-TTS) 附E

使用建议

看到不认识的词 → 先在本表搜 → 想看详细解释 → 按"详见"列去对应文档(03_GitHub研究/R*.md)。

来源:知乎专栏「小说→AI漫剧分镜」系列 01–18(原始 18 篇见 01_原始素材/2026-09-22分镜技巧/) 核心:分镜不是信息堆积,而是重点提炼。成熟分镜不是拍得满,而是拍得准。


一、分镜为何会「没戏」或「显平」(09/13)

  • 完整 ≠ 有戏:字段齐、镜头都写了 ≠ 抓人。有戏靠重点、变化、重音、张弛。
  • 六个典型问题:
    1. 把分镜写成信息清单(填表式,无镜头逻辑);
    2. 所有镜头一样重(全重 = 不重);
    3. 只拍「发生了什么」,没拍「为什么这一刻重要」;
    4. 只有情绪结论,没有情绪过程;
    5. 有镜头但没节奏设计(没有收紧/停顿/爆点/落点);
    6. 环境、空间、物件只当背景,不参与叙事。
  • 一个实用判断:删掉这个镜头,戏会不会垮? 只少表面信息=补充镜头;删掉重音/变化/情绪落点没了=真正有戏的镜头。

二、核心心法:不拍台词,拍变化(11)

  • 别「谁说话就给谁」,那只是台词的字幕。
  • 对白多不怕,怕的是把对白场景只当台词展示。真正有戏的是「说完之后发生了什么」。
  • 镜头跟着关注点转移走:正常交流 → 试探 → 施压 → 情绪失控 → 沉默 → 一方退开。
  • 多拍听者的反应、停顿,不只拍发言者;
  • 让动作、空间、停顿参与进来(拿杯子的手停一下、原本靠椅背后来坐直、说话前犹豫、说完后沉默)。

三、先抓重音(09/12/13)

  • 整场戏先定 1–2 个最该放大的点(关键台词/态度转折/情绪裂口/线索出现)。
  • 不是平均用力:有轻有重,分镜才立得住。找重音比补信息重要。
  • 一个场景拆几个镜头,不按字数/句子拆,按「变化点」拆——关注点转移的次数,不是原文句数。

四、拍情绪过程,不拍情绪结论(15)

  • ❌ 原文「她心里一紧」→ 分镜「女主内心紧张」:还是抽象,不是画面。
  • ✅ 流程:心理状态 → 外在表现 → 镜头表达
  • 四类可转译画面:
    1. 表情细节:眼神短暂停住、嘴角想维持却慢慢压下、没敢直视、想笑却是僵的;
    2. 身体动作:手指收紧、背部微僵、身体前倾又停住、后退半步、想拿东西停在半空、转身太快像在逃避;
    3. 空间/环境反应:安静得只剩时钟、空房间、逆光看不清表情、桌上的水杯一直没人碰、门开着没人过去;
    4. 镜头节奏:镜头停久一点、对方说完不立刻接、留一拍沉默、先给手再给脸。
  • 原则:不拍「情绪结论」,拍「情绪正在发生的过程」。

五、善用留白(04)

  • 留白 = 故意不拍满、不说满、不解释满,把解释权交给观众。
  • 最常用:情绪转折点、关系微妙变化、重大事件前后(打斗前对视、离别前停顿、真相揭示后沉默、告白后没人回应那几秒)。
  • 判断:删掉后观众还能理解且情绪更强 → 有效留白;看不懂动机/逻辑 → 不是留白是断裂。
  • 三大误区:把空镜头当留白(空镜也要有叙事作用);该交代的不交代;什么都拍一点最后没有真正留白。
  • 任务决定留白:剧情镜头要清、信息镜头要准、情绪镜头可以留。

六、环境参与叙事(14)

  • 环境不是背景板,是叙事工具。先判断它在服务什么:交代空间/建立氛围/承接情绪/埋线索/调节奏。
  • 环境可拆四类镜头:
    1. 场景建立(人/物/空间定位);
    2. 氛围承接(先让观众感到什么:安静、压迫、悬疑);
    3. 环境细节(第二只杯子、半开抽屉、泥脚印、没人碰的台灯)——看似写景,关键在细节
    4. 过渡收束(空房、没喝完的水杯让情绪落地)。
  • 示例:原文「房间安静得可怕,窗帘被风轻吹,水早凉了,门开着没人过去」→ 拆成:空房关系镜头 → 窗边 → 桌面特写 → 门 → 回人物,有顺序有重心。
  • 环境要和人物状态互文:人物压抑,环境承接;人物怀疑,环境细节配合埋点。

七、信息量大时分层(08)

  • 乱不是因为信息多,而是信息没层级。文字可同时说很多事,镜头只能让观众先看一个重点。
  • 先分三类:主信息(核心推进点)/ 辅信息(背景暗示/伏笔物件)/ 氛围信息(希望观众感到什么)。
  • 方法:先「主镜头 + 补充镜头」——主镜头承载核心戏,补充镜头少量增层次。一镜一主一辅
  • 镜头顺序按观众理解顺序排,不一定按原文顺序。高信息场景:先明说主线 → 再带状态和细节异常 → 最后放伏笔情绪。
  • 信息量越大越要克制炫镜头:不必要的频繁特写、每句对白换机位、为不平强行运镜,都是负担。

八、细节取舍(05)

  • 值得拍:①帮观众理解剧情(门把手转动、桌上多钥匙);②承接人物情绪(嘴上说没事手却攥衣角);③形成画面记忆点(雨滴沿伞骨落)。
  • 不单拍:①只在文字里成立的美(夜色像潮水)——融入整体氛围;②重复表达同一信息(眼眶红+手指抖+低头+茶杯响都在说难过,选最有效的那个);③太抽象无法拍摄(不安→回头看走廊、脚步停一下、握紧手机)。
  • 实用三问:能不能让观众多知道一点?能不能让情绪更成立?放进来会不会拖节奏?前两问肯定→保留,第三问肯定→该省。

九、场景切换太多(02)

  • 问题:丢空间感、切情绪、节奏碎(≠真快)、成本高。
  • 处理:①先场景归并(卧室+楼梯+院子若只是「争执后离开」→压成「室内对峙」+「离开结果」两个单元);②把换场景改成镜头内调度(全景/中景/特写/视线镜替代硬切);③给切换设「桥」——动作桥/声音桥/视线桥/物件桥;④区分功能性切换(干脆)和情绪性切换(不能太快);⑤长篇要敢省。
  • 判断:切换有没有带来新的叙事价值?不切能不能用动作/台词/调度说完?切完观众得到的是不是更有效?

十、快还是慢(03)

  • 偏「知道」→ 快;偏「感到」→ 慢。
  • 外部冲突(追逐/争执/危机/反转)→ 快;内部冲突(迟疑/压抑/强忍/想说没说)→ 慢。
  • 信息密度高的戏不一定快,要有选择地快:主信息快、辅助让;核心动作清、次要省;重点情绪留、重复砍。
  • 进入太早慢,结束太晚拖。问:这场戏从哪开始最有戏?停在哪最有劲?

十一、人物第一次出场(07)

  • 三个任务:让人记住 + 感受到气质 + 和剧情建立关系。别只完成「人物出现了」。
  • 先定一句话:这个人第一次出场,最想让观众先感受什么(强势/脆弱/危险/神秘/反差)。
  • 四种方法:①先局部再完整(手/眼神/鞋跟/佩饰建立气质);②先环境反应再出人(嘈杂突然安静、视线转向、门开风灌进来);③先关系再给人物(先拍主角反应);④带动作出场(边走边摘手套、推门拎着滴水的伞)。
  • 常见错误:一上来信息说满、只顾外形不顾状态、登场和剧情无关、所有人物出场同一方式。

十二、旁白处理(10)

  • 先分旁白功能:补信息 / 写心理 / 写氛围 / 做总结判断。不同功能处理不同。
  • 该删:重复画面信息的、解释太直的、只增强文气的。
  • 该转镜头:心理型→动作反应;氛围型→环境镜头;判断型→拆成铺垫和结果。
  • 该保留:大时间跨度/背景跳转(三年后)、章节感/开场收束、画面难独立完成的世界观信息。
  • 三问:这段补什么?画面能不能自己完成?(能→转镜头);留着是增强还是替镜头偷懒?

十三、一致性:角色表→场景表→分镜(16)

  • 别一上来就让 AI 写整个分镜——那会把角色/场景/剧情混在一起,导致跨镜头漂移。
  • 正确顺序:先角色表(每个角色稳定可复用的文字设定:外貌/服装/气质/标志特征)→ 再场景表(场景名+描述+关键道具)→ 最后才写分镜(每镜明确引用哪个角色+哪个场景)。
  • 核心:先有「库」(角色、场景),再写「用」(分镜)。

十四、分镜脚本 5 关键元素(18)

  1. 视觉草图/缩略图(越简单越好,鸟瞰整个故事);
  2. 场景描述/镜头细节(谁、做什么、哪、何时,人物状态到场景情绪,可含摄影机移动);
  3. 对话/脚本摘录(台词进故事板,指示谁说、说什么);
  4. 注释(相机角度、角色移动、特效、慢动作等让画面「活起来」);
  5. 镜头序列(按时间顺序排,注意节奏张弛与视觉连续性)。

十五、快速把剧本拆分成镜(17)

  • 路径:选分镜拆解助手 → 粘贴剧本 → 选字段(景别/运镜/人物状态/对白/布光)→ 生成 → 整理成表 → 导出 Excel。
  • 关键:字段提前定;拆解后核对原文内容是否 100% 还原;导出为结构化分镜表直接供画画面/制作。
  • 好的拆解不是「切镜头」,而是提取场景/角色/对白/动作后按故事结构重组,再补执行信息。

附:一条自检清单(每批分镜做完过一遍)

  • [ ] 能一句话说清本段重点?(说不清=焦点散,06)
  • [ ] 删掉 1/3 镜头内容会不会反而更清楚?(有冗余,06/13)
  • [ ] 有没有「谁说话就拍谁」的机械切换?(11)
  • [ ] 是否拍到了情绪过程(停顿/动作/反应)而非结论?(09/15)
  • [ ] 环境是否只在当背景、没参与叙事?(14)
  • [ ] 该留白的地方是否还在拼命解释?(04)
  • [ ] 同一信息是否被多镜重复表达?(05)
  • [ ] 场景切换是否带「桥」、是否偏多?(02)
  • [ ] 人物首出场是否有记忆抓手、是否一眼立住?(07)

整合了用户提供的全部指令词与实战经验文档 + GitHub 主流项目调研。 目的:把「找小说 → 出成品」整条链路标准化,明确每一步:输入 / 用什么指令 / 输出 / 交付物 / 质检点。 参考素材原文见 02_素材整理/


🚀 快速上手(SOP 简版)

第一次做漫剧,按这个顺序走即可。详细规则见后续章节。

[0] 准备:建项目文件夹(见「推荐目录结构」)
 ↓
[前置] 故事骨架(长篇/多集时):大三角 + 矛盾 + 付费点 + 反转登记
 ↓
[1] 选本:找小说 or 原创 → 套「爆款改文指令」→ 得到 1000 字文案
 (可选前置:提前定整部集数/时长 → ①.1 漫剧长度设定,留空则不限)
 ↓
[2] 转剧本:套「小说转剧本指令」→ 含钩子/爽点标注的剧本
 ↓
[3] 分幕(可选):套「台词分幕指令」→ JSON(角色+台词+情绪)
 ↓
[4] 提角:套「S级人物指令词」→ 四风格提示词 + 角色设定卡 + 资产体系
 ↓
[5] 出图:即梦出 面部 → 全身像 → 三视图/四视图 → 表情矩阵(16:9)
 (搞笑/名场面套「夸张表情」→ ③.5.1;写实情感戏套「60表情+微表情FACS」→ ③.5.2)
 ↓
[6] 场景:套「S级场景指令词」+「氛围7要素」(→5.4) → 双格式输出 → 即梦出场景图
 ↓
[7] 分镜:导演规划 → 套「S级镜头提示词」(10s/2-15s)+ 动作库6.14 + 运镜库6.15 + 质感词6.16 → 时间轴分镜
 ↓
[8] 审核:过「分镜审核」(红线 R1~R4 + 维度表)
 ↓
[9] 出片:即梦/可灵 → 加入人物+场景+道具+声纹锚点(→7.2) → 视频片段
 ↓
[10] 合成:剪映 → 衔接尾帧单帧视频 → 配音(情绪标点→7.3)/字幕/BGM(声音设计→8.4 配乐·音效·混音) → 成片
 (导出规格:MP4 / 1080×1920 竖屏 / 30fps / 码率 8000-10000 kbps → 见 ⑧;横屏与一套素材多用→8.5)
 ↓
[11] 自检:过一遍「附D:制作自检清单」
 (可选)↓
[12] 发行:选平台(⑨ 9.2)→ 上线合规(2.3/附F)→ 分账/变现(⑨ 9.1/9.3)

工具链:DeepSeek/豆包(文本)→ 即梦(出图/出视频)→ 可灵(口型)→ 剪映(合成)

⚠️ 合规提示:2026-04-01 起 AI 漫剧「持证上岗」,未备案存量已被全网下架。开工前请先过 ② 2.3 合规前置(备案分级 / 资质 / AI 标注 / 内容红线),避免「做完即下架」。


总览:主链路

【前置】故事骨架(长篇/系列化时)
   ↓
① 选本改文  →  ② 转剧本  →  ②.5 台词分幕  →  ③ 人物&道具  →  ③.5 表情矩阵  →  ④ 三视图
                                                                  ↓
⑧ 剪映合成  ←  ⑦ 视频生成  ←  ⑥ 分镜提示词  ←  ⑤ 场景图  ←──────┘
步骤 环节 输入 工具/指令 输出
前置 故事骨架 原著/创意 骨架指令(参考 Toonflow) 故事骨架(故事核/人物小传/三幕/分集/付费卡点/反转登记)
1 选本 / 改文 小说原文 爆款改文指令 / 原创剧本指令 改编文案(1000字/篇)
2 小说转剧本 改编后的小说 剧本生成指令 / 小说转剧本指令 漫剧剧本
2.5 台词分幕(可选辅助) 剧本/文案 台词分幕指令 分幕台词表(JSON)
3 人物 & 道具 剧本 S级漫剧人物和道具指令 人物/道具提示词
3.5 表情矩阵 一张人物参考图 人物表情矩阵指令 10 宫格表情板
3.5.1 夸张表情(搞笑/名场面) 角色基底描述 夸张表情提示词公式 + 27 组表情库 夸张表情单片(情绪外化 + 漫画符号)
4 人物三视图 人物提示词 / 面部参考 S级三视图指令 人物三视图
5 场景 剧本 S级场景指令 / 场景设定公式 场景提示词 → 场景图
6 分镜头 剧本 S级镜头提示词 + 九宫格 + 景别 + 视角 + 运镜 分镜头提示词
6.16 质感词(题材定调) 分镜 + 题材类型 10 类质感词库 高级质感画面语言
7 视频生成 镜头提示词 + 人物 + 场景 + 道具 + 声音参考 即梦 / 可灵 视频片段
7.2 声音一致性 角色设定 声纹锚点 + 声音资产卡 跨集不变声的角色配音
7.3 配音情绪 台词 标点情绪遥控 + 状态公式 有演技的配音
8 合成 视频片段 剪映 成片

【前置】故事骨架(可选 · 长篇/系列化建议做)

起点二选一

  • A. 改现成小说 → 先搭骨架(从原著提炼结构)→ 再改文
  • B. 做原创 → 先改文/创写(写出小说)→ 再搭骨架 顺序不固定,取决于你手上有没有现成原著。短篇/单集可跳过骨架。

当你做的是长篇/多集/系列化漫剧时,在选本改文之前先搭骨架。 完整规范见 03_GitHub研究/R5_Toonflow_故事骨架与付费点.md

底层原则:短剧 = 投放变现的即时情绪产品,情绪先行;三大密度(情绪/信息/情节)是骨架级总标尺;预期管理(建立→打破→埋新)是留人核心。

核心结构

  • 大三角嵌套小三角,主流为单线型(多线并行易被退稿)
  • 矛盾 ≠ 冲突:矛盾=内在"想要但得不到",冲突=外在对抗行为;只堆吵架不打磨矛盾 = 戏是空的
  • 矛盾四级阶梯(爆款须达 3-4 级):最好的是两个好人因不同选择走向不同命运

必做产出:故事核 / 隐线(人物弧)/ 人物小传(大三角 ≤4 人)/ 三幕结构 / 分集决策 / 付费卡点设计 / 股价级反转登记表

关键规范

  • 前 10 集黄金结构:三集定生死 + 十集定全篇 + 卡点要卡住;开篇即绝境(极端困境/身份反差/情感暴击)
  • 付费点:按 ≈10%/30%/50%/70%/90% 分布;卡点三步(先爽透→拉高预期→卡主线钩子)
  • 股价级反转三式(全剧 ≈3 个):预期误导 / 人设颠覆(只用于配角)/ 动机置换
  • 金手指必须新颖独一无二、有约束、非洗稿

完整规范见 03_GitHub研究/R5_Toonflow_故事骨架与付费点.md


②.5 台词分幕(可选辅助)

  • 指令:《台词分幕》(原文见 01_原始素材/用户提供的指令词/17_台词分幕.txt
  • 定位辅助环节(可选),非必经步骤。作用是把已有文案结构化,便于程序化处理。
  • 输入:剧本 / 文案(在「② 转剧本」之后使用
  • 输出:结构化 JSON 数组(把台词按幕/场拆分,供后续分镜引用)

任务:将小说内容划分为「角色 + 内容」,输出结构化 JSON。

台词识别规则:

  • 完整保留原文,不得遗漏/删改/省略任何字句
  • 提取带引号("")、破折号、感叹号、冒号等台词标记的文本;其余为旁白
  • 双引号内容提取后双引号改成单引号(‘’)
  • 角色在已知列表则直接用;不在则根据上下文合理判断
  • 相邻同角色台词可合并,但单条 ≤ 50 字(标点也算)
  • 超 50 字按语义完整性拆分,每条 ≤ 50 字,保证原文不缺失
  • 35-50 字为一个提取限制
  • 拆分须保证是同一角色所说

旁白识别规则:

  • 所有非台词的叙述内容(心理活动/环境/动作/场景过渡)均标为「旁白」
  • 同样保留全部原文、单条 ≤ 50 字、可按语义拆分

情绪与强度:

  • 为每条台词标情绪 + 强度,必须从给定列表中选择
  • 旁白统一:情绪「平静」,强度「中等」
  • 情绪识别不得改写原文,仅用于标注

特殊情况:

  • 多角色连续对话须对应正确角色,避免错配
  • 混合段落须拆为独立记录(旁白一条、台词一条)
  • 输出不得遗漏/重复/合并错误,原文 100% 完整保留

输出格式:严格 JSON 数组,每条含 role_name / text_content / emotion_name / strength_name

输入约束:会提供 possible_characters(角色列表)、possible_emotions(情绪列表)、possible_strengths(强度列表),情绪与强度必须从中选择。


① 选本 / 改文

两条路线(二选一):

  • A. 改编现成小说:找小说 → 用「小说爆款改文指令」改编文案。
  • B. 原创:用「原创剧本指令」自己生成爆款小说。

内置拆解逻辑指令(《一、剧本生成》):

帮我拆解这本小说的内容逻辑,包含四个维度,分别是:爆款开头、高潮、反转、爽点,并帮我总结这三本小说逻辑的共同点。 根据以上爆款逻辑,帮我生成一篇同类型小说 1000 字。

短剧剧本「黄金公式」(2026 行业通用写法 · 源自 CSDN 仿真人短剧教程):

开场 3 秒钩子(冲突/反转/悬念)
→ 第1集:建立人物 + 抛出问题
→ 第2-N集:每集一个小冲突 + 一个钩子(结尾留悬念)
→ 最后集:高潮 + 反转 + 留余味(为续集埋伏笔)
每集 45-90 秒;总集数 8-16 集

硬规则(避坑)

  • ❌ 不写「咖啡店里两人闲聊」——闲聊场景画面要求低,但观众留存率最低。
  • ✅ 每集必须有「画面事件」:摔杯子、推开门、手机响了、表情变化。
  • ❌ 对话不超过 3 轮/集——短剧靠画面和表情讲故事,不靠台词。
  • ✅ 每个转折点加一个「视觉符号」:戒指特写、雨中的伞、微信消息弹窗。

交付物:改编文案 / 原创小说(约 1000 字) 质检点:具备爆款四要素(开头钩子 / 高潮 / 反转 / 爽点);剧本符合「黄金公式」结构(3 秒钩子 / 每集画面事件 / 每集 ≤3 轮对话)。

①.1 【可选前置】漫剧长度设定(控制整部集数/时长)

对应操作台s0-p0 故事骨架 / s1-p0 爆款改文 / s1-p1 拆解爆款三个盒子里的「漫剧长度设定」折叠栏(默认收起,点「+」展开;留空则不限制)。起点A 搭骨架时即可定总集数/时长,起点B 写文时沿用。

作用:在写小说这一步前置设定整部目标长度,让 AI 从源头按目标体量规划——分几集、每集字数/时长、卡点位置,避免后面分镜出片体量失控。

两栏(任填或都填)

  • 集数(如 6)
  • 每集时长(如 60秒 / 1分钟)

填入提示词后自动生成【漫剧长度设定】整部共 X 集、每集 Y。请按此目标长度规划分集体量与节奏(集数、每集字数/时长、卡点位置),确保体量受控。

何时用

  • 明确目标集数/总长的项目(如要做 6 集短剧)→ 填
  • 刚开始/不确定体量 → 留空,让 AI 自由发挥

注意:仅适合起点B 原创/写新小说时控制体量;改编现成小说时长度受原文约束,设定可作为「压缩到 N 集/每集 Y」的提炼目标。

①.2 【爆款钩子】黄金 3 秒「视觉补偿 + 预期管理」+ 十大公式 ⭐

源自塔猴《10 个爆款钩子公式》(素材 27)。开写第 1 集前先定钩子;与上文「黄金公式·3 秒钩子」互补——黄金公式给结构,本节给内容配方

底层逻辑(两个机制)

  • 视觉补偿:观众看 AI 剧是为看现实拍不出的东西(宏大废墟 / 瑰异生物 / 极致美学)→ 用视觉冲击瞬间降低心理防线
  • 预期管理:画面再美、没冲突也是死的 → 钩子须在 3 秒内抛出待解决的矛盾(死里逃生?认知颠覆?)→ 给出「想看下去」的心理预期。

十大钩子公式(题材 × 冲突组合,每式含画面示例 / 例句 / AI 生成提示词,见素材 27):

# 公式 一句话
1 视觉奇观 + 身份反差 宏大背景里,主角却是最卑微/特殊身份
2 仙宫审判 + 极致欺压 神圣庄严 × 惨绝暴行,落差拉情绪
3 规则怪谈 + 生存惊悚 抛违背常理的生存规则,强制思考
4 降维打击 + 爽点先行 展示绝对压制力,勾「虐菜」预期
5 时空错位 + 文明碰撞 古文明 × 超时代科技,认知鸿沟
6 悬念留白 + 颠覆认知 展现逻辑上「不可能」的画面
7 末日绝境 + 终极抉择 极端环境下的道德/生命单选题
8 宿命之问 + 跨越轮回 跨时间的等待/因果,营造史诗感
9 血染红妆 + 浴火重生 极致的美 × 极致的惨,视觉割裂
10 刑场归来 + 身份置换 前世惨死 → 转场到尊贵重生

避坑 3 条:① 拒绝视觉廉价感(钩子为「视觉奇观」时务必用高精度生图;古装女频的丝绸/珠宝质感 = 女性观众代入关键);② 音效先行(重音弹起 / 心跳突停 / 古风杀伐声要比画面先一步撞进大脑,呼应 8.4 声音设计);③ 切忌文不对题(钩子 ≠ 后续内容 → 观众感到被欺骗,跳出率极高)。

质检点:单集钩子过三问(3 秒内有矛盾?画面有视觉补偿?音效是否先行?)+ 钩子与后续内容一致。


② 小说转剧本

  • 指令:《二、小说转剧本指令词》(原文见 01_原始素材/用户提供的指令词/02_小说转剧本指令词.txt
  • 输入:① 产出的文案 / 原文小说
  • 输出:漫剧剧本 / 合规改编全文

核心要求(四大部分):

1. 爆款开篇核心(必执行)

  • 开篇 3 秒爆点:第一句就抛极致冲突/绝境/反转/悬念,无铺垫、无旁白,直接切高潮名场面(绝境受辱、生死危机、惊天揭秘、逆袭打脸、天降机缘)
  • 爽点密度强制:每 80 字 1 个小爽点,每 200 字 1 个大爽点;主角全程不憋屈、不拖沓
  • 段段留钩:每段结尾必留悬念/伏笔/反转预告,杜绝平淡收尾
  • 合规零风险:无血腥/暴力/色情/恐怖/惊悚/低俗;打脸惩戒用温和合规方式

2. 剧情改编硬性要求

  • 砍冗余铺垫、无关支线、冗长对话,开篇即切核心冲突,保留主线快速推进
  • 放大情绪反差:绝境/屈辱 vs 逆袭/碾压,冲突尖锐、情绪极致
  • 反转密集不套路,每次冲突都有意外反转
  • 章节结尾必留终极钩子(惊天秘密/强敌来袭/逆天机缘/身世谜团)

3. 人物细节优化

  • 主角气场拉满、智商在线,摒弃懦弱犹豫,行动果决
  • 对立角色标签化,反衬主角逆袭爽感
  • 补充关键场景/道具/伏笔,原创设定无版权风险

4. 格式阅读适配

  • 短句为主、画面感强、适配手机快速阅读
  • 单章 800-1000 字,适配短视频分段传播
  • 段落简短、重点剧情突出

质检点:开篇是否 3 秒炸场;爽点密度是否达标;段尾是否留钩;是否合规;单章是否 800-1000 字;剧本是否拆到「场次→镜头」粒度。

2.1 【补强】剧本创作硬标准(参考 Toonflow 剧本 Agent)⭐

三大情绪要点(每集至少 1 个):爆点(震惊事件)/ 虐点(心痛事件)/ 爽点(高光时刻)

  • 爽点公式:爽点 = 装 + 打脸 + 震惊 + 收获

三大密度(单集自检,均不能“低”)

  • 情绪密度:前3秒强钩子 → 中间30-40秒小爆发 → 结尾10秒悬念卡断;把情绪写进动作而非台词
  • 信息密度(快准新无):快=前10秒交代主角/危机/冲突;准=高效潜台词;新=必给新信息;无=无价值台词全删
  • 情节密度(三硬标准):因果锚定 + 冲突驱动 + 价值转变
  • 黄金单集公式:情节承接 + 冲突升级 + 价值转变 + 下集勾连

节奏 3-15-45:3 秒情绪冲击 / 15 秒剧情变化 / 45 秒强期待(留抉择时空)/ 结尾反转钩子

开篇 8 大规则(总则:开篇即绝境、开篇即高潮;三坑必避:介绍人物/开会/写景): 冲突即时性 / 信息量密集 / 信息差 / 铺垫≤ 3 集 / 关系拉扯感 / 每集必反转 / 压情绪 / 明确目标

单集钩子级反转三式(单集 ≤1 个):道具伏笔反转 / 情绪回弹反转 / 镜头错位反转(画面必须 100% 真实)

台词规范(总则:要展示,不要告诉):单句 ≤20 字;单角色单次 ≤50 字;高频潜台词但不晦涩;动作>台词

新手五大硬伤:情绪描写过多 / 小说化描写 / 心理描写过多 / 台词冗长 / 描述性动作过多

📎 完整规范(含剧本输出格式 scriptItem/△/OS/转场、BigBanana 工业化工作流)见 03_GitHub研究/R4_Toonflow_剧本创作与BigBanana.md

2.2 【导演规划】剧本→拍摄计划(参考 Toonflow 阶段1)⭐

位置说明:导演规划实际执行位置在 ⑤ 场景 之后、⑥ 分镜 之前(编号 ⑤.5)。放在这里是为了"为分镜提供节奏依据"。

位置:构建分镜表之前。把剧本转为拍摄计划。核心原则:只拆分、不创作(唯一例外:场间过渡);不规划光影/色调/配乐

分场:一个场 = 同一时空下一段连续戏;以地点变更/时间跳变/戏剧单元收束为切点;场次须全覆盖剧本

逐场统计:台词条数 + 台词字数(只计数,不预算时长/镜头数)+ 情绪浓度 0~10 + 情绪基调(标注 X→Y)。

场间过渡(唯一允许创作的环节):先判断是否必要;必要时用 动作衔接/空镜/淡入淡出。

逐场注意事项(留给下游):情感砸点 / 视觉一致性锚点 / 空间距离 / 环境音提示 / 易错提示。

📎 完整规范 + 改编策略 8 大要点(类型创新/矛盾强化/删减优先级)见 03_GitHub研究/R10_Toonflow_导演规划与改编策略.md

2.3 【合规前置】备案与内容红线(2026 新规,先搞清再开工)⚠️

2026-04-01 起 AI 漫剧「持证上岗」:未履行备案程序的存量动画微短剧已被全网强制下线,新作须先备案后上线。上架前先过这一节,避免「做完即下架」。政策更新频繁,以官方最新公告为准(详见附F)。

2026 下半年续推:2026-07-01《管理提示(AI 微短剧分类分层标准)》实施;2026-09-01 施行总局令第 16 号《微短剧发展管理办法》——国内第一部针对微短剧的专门规章。

① 三级分层备案(按投资额 + 题材类型):

层级 条件 审核主体 凭证
重点 投资 ≥300 万 涉政治/军事/民族/宗教/涉外/涉案 国家广电总局 《网络剧片发行许可证》
普通 投资 100 万–300 万、一般题材 属地省级广电 备案编号
其他 投资 <100 万、一般题材 平台自审 + 报省级备案 备案编号
  • 个人/小团队基本落第三档;但制作方须持《广播电视节目制作经营许可证》(个人常见解法:签约 MCN / 挂靠持证公司发行)。

② AI 强制标注:片头或显著位置标注。纯 AI「AI 生成」与 AI 辅助「AI 辅助生成」须分开标注;多平台要求封面+标题+片头双/三重标注(片头≥3s、字号≥画面短边 5%)。

③ 内容绝对红线(违者下架/封禁):极端复仇、以暴制暴、拜金炫富、畸形婚恋/美化出轨家暴 · 低俗色情擦边 · 封建迷信(算命/风水/灵异/玄学改命) · 血腥暴力/私刑 · 歧视对立 · 未成年人有害(早恋/霸凌/抽烟喝酒/成人化剧情) · AI 魔改经典与英模 · 未授权真人肖像与声音(AI 换脸) · 观感不适(血腥惊悚/怪异邪典画风)。

④ 版权存证:留存 AI 生成提示词、参数、生成日志、素材授权合同;剧本做查重自检。

⚠️ 对本流程的直接影响:② 转剧本环节的「合规零风险」要求,除原有血腥/色情/恐怖外,还须叠加上述 2026 红线(尤其是拜金爽感、极端复仇、封建迷信(重生/系统/风水玄幻常见)——玄幻/末世逆袭类须谨慎处理超自然金手指与复仇打脸尺度)。


③ 人物 & 道具提示词

  • 指令:《三、S级人物指令词》(原文见 01_原始素材/用户提供的指令词/03_S级人物指令词.txt,系统非常庞大)
  • 用法:把剧本里的人物、关键道具,用 DeepSeek / 豆包 生成提示词
  • 输出:每个人物 / 道具的标准提示词

角色定位:扮演顶级 3D/写实角色概念设计师,为即梦等平台生成电影级提示词,严格遵守敏感词规则。

核心机制:

  • 平台敏感词禁止列表 — 禁身体裸露类/身材过度描述类/材质暗示类/过度写实类/暗示性动作
  • 风格自适应 — 根据题材自动选美术风格,禁止默认国风古装
    • 修仙/武侠/宫廷 → 国风写实 | 现代都市 → 现代写实 | 科幻 → 科幻写实
    • 西幻 → 西幻写实 | 民国 → 民国复古 | 悬疑 → 现代写实+暗黑 | 混合 → 融合
  • 气质美学词汇 — 按题材加前缀(古风/都市/科幻/西幻/民国);女角(≤30)至少 2 个美学词,男角(≤35)至少 2 个
  • 五官差异化 — 拒绝脸盲,必须写明脸型/眉形/眼型/鼻型/唇形(各含词库)
  • 人类角色眼睛仅自然色系(非人/神明可用异色瞳,须有设定依据)
  • 头饰限制 — 禁夸张大头饰(除非皇后/女帝);优先无发饰或极简小发饰
  • 服装 — 至少 4 种高级材质混搭,立体剪裁,禁"宽腰封""勒紧";现代都市女性允许不限场景用高定礼服
  • 神态统一 — 所有风格中性平和,气质靠五官结构/骨相/姿态,不靠表情

每个角色输出四种风格版本:

风格 构图 特点
3D渲染风格 正面全身站立 UE5/八猴/Octane,次世代 PBR,光线追踪,8K,纯白背景
真人实拍风格 全身站立 超高清摄影,8K,电影级柔光,可见真实肤质纹理
GPT A版风格 半身特写(截到腰部) 国漫 3D 顶级渲染,可用增强描述(赤足/薄纱/曲线等)
GPT B版风格 全景站立 短词骨架 80-120 字,纯唯美,题材自适应,瞳色自由

任务流程:① 提取所有人物 → ② 提取高频道具 → ③ 每个角色出四版提示词 → ④ 道具出 1:1 正面居中提示词

质检点:同一人物在不同场次描述一致;敏感词自查通过;四种风格核心描述(脸型/眼型/眉形/鼻型/唇形/发型/气质词汇)在 3D/真人/GPT A版 之间必须一致。

③.6 【优化补强】角色档案与设定卡(参考 GitHub ai-comic-script-generator / ai-comic-studio)

角色设定卡「固定不变区」(保证跨镜一致性):

角色名 / 性别年龄 / 身高体型 / 气质关键词(3个)/ 发型(长度+类型+颜色)
/ 五官特征(≤3)/ 肤色 / 标志物(必有 1 个)/ 主穿搭 / 主色系 / 禁止出现项
  • 固定角色描述:每个镜头 prompt 中一字不差复制粘贴
  • 固定画风后缀:每个镜头必追加
  • 提示词模板 = 固定角色描述 + [表情/动作/场景] + 固定画风后缀

标准母图(定妆照):用设定卡生成 3-5 张正/侧/全身图 → 选最满意 1 张作 Master Reference → 后续所有镜头以它作参考(MJ --cref / IP-Adapter)。

其他一致性机制

  • 合并去重:手动合并重复角色(如"马管家"与"老马")
  • Character Memory:把角色档案注入每一格提示词
  • 神秘角色视觉方案:声音出场用暗色剪影+红光点;固定视觉元素(如黑暗背景+编号)
  • 角色四视图:正面/四分之三/侧面/背面(比三视图多一个 3/4 视角)

新增全局机制建议

  • 角色档案(Character Bible):集中管理所有角色固定描述 + 标志物 + 禁止项,全流程引用
  • 视觉连续性审核:全集分镜一次过审,批量重写保证跨镜一致
  • 参考素材库:Master Reference + 场景参考图 + 道具参考图,统一管理

③.6.1 一致性技术栈与「视觉契约」⭐(2026 工业侧)

源自 2026 工具链专文(素材 17)。为上面「标准母图 / Master Reference」补工业侧参数与落地手法。

闭源平台流:Midjourney V7 Omni Reference(取代 V6 Character Reference,除面部外还捕捉角色气质/色彩比例/服饰纹理);二次元加 --niji 7;用 --cw 平衡一致性与创意。快速风格化漫剧一致性约 85%-90%。

开源控制流(工业级):ComfyUI + SD 3.5 / SDXL,主流组合 = IP-Adapter FaceID Plus v2 + ControlNet Reference + ADetailer

  • 流程:先出 Master Reference 主参考图 → IP-Adapter FaceID Plus v2 实时锁定面部骨骼 → 面部细微偏移时 ADetailer 自动检测并高分辨率重绘面部。
  • 适用:动作复杂 / 需精确构图;一致性约 90%-95%
  • 对照:LoRA / Dreambooth(30-50 张不同角度/表情/光照图微调)→ 长期连载 IP,一致性接近 100%

「视觉契约」三段法(把一致性从「抽卡」变「规则」):

  1. 视觉身份证:每个核心角色一份固定核心描述(如「25岁男性,黑色连帽卫衣,暗黑系国漫风,眼角有痣」)。
  2. 提示词权重控制:不变项(发型/瞳色/标志性服饰)权重调高,可变项(光影/动作)权重调低;崩坏处用局部重绘定点修正(不必重绘整图)。
  3. 分镜头预览验收:批量生成前先查关键镜头草稿,发现偏差立即回改权重/描述,把问题扼杀在成片之前。

让角色「从环境里长出来」:生成角色时叠加环境光描述(如「被霓虹灯漫反射照亮」),生成背景时反向加入角色的光影投影参考;整集用整体色彩校正统一色调。

③.6.2 【开源工程管线】SD/AnimateDiff 自建一致性技术栈与工程参数 ⭐(2026 工业侧 · 硬核)

源自 某厂算法工程师《AI 漫剧全流程制作实战》(腾讯云/思否,1.2 万字含工程代码;原文见 01_原始素材/2026-09-21新增/30_AI漫剧全流程工程化实战(AnimateDiff·Wav2Lip·Kohya LoRA).md)。③.6.1 讲「技术栈选路与视觉契约」,本节补「以 Stable Diffusion 生态自建整条工程管线」的可复制参数——适合想脱离一站式平台、自建可复现管线的团队;与附G(本地离线 ComfyUI 路线)互补。

整条工程管线主题 →[LLM]结构化分镜JSON →[LLM]SD正负提示词+ControlNet →[一致性]LoRA+IP-Adapter →[关键帧]SDXL+ControlNet(OpenPose/Depth) 每场景4~6帧 →[动态]AnimateDiff v3 16帧 →[音频]Edge TTS 多情感 →[口型]Wav2Lip+GFPGAN →[合成]MoviePy+FFmpeg(A100 上每天可批量出 10 条)。

双 LLM 分工:GPT-4/Qwen-72B 生成「故事大纲+分场」固定 JSONscene_id/location/characters/visual_desc/dialogue[{speaker,text}]/duration_sec);Mistral-7B 专把 visual_desc 转 SDXL 正负提示词。⚠️ 踩坑:LLM 易生成「镜头移动」等非视觉词 → 提示词须强调只描述静态画面,动态交给 AnimateDiff(与 6.0「静态帧 vs 动态运镜分离」同源)。

LoRA 训练(Kohya_ss)实操参数:每角色 20 张半身像(不同角度/表情,SD1.5 生成);lr=1e-4+cosine / warmup 100 / batch 2 / epoch 10 / fp16 / network_dim 32 / network_alpha 16;loss ~800 步趋稳(≈0.12)safetensors96MB。⚠️ 服饰颜色单一易过拟合(背景也变单一)→ 训练集混入不同背景图 + lr 降至 5e-5

一致性「三板斧」(工程版)

  1. 固定随机种子:每场景内所有关键帧同一 seed(不同场景用不同 seed)→ 同场景风格统一。
  2. 首帧参考:场景 1 首帧纯 prompt 生成,后续每场景首帧用上一场景末帧作 ControlNet 姿势引导 → 防跨镜跳跃(与 6.10「承接上镜」一致)。
  3. IP-Adapter 权重动态调整:表情变化大时(笑→哭)0.8 → 0.5,让 prompt 主导,防五官扭曲。

⚠️ 工程坑:diffusers 对 IP-Adapter 与 ControlNet 同时支持不完善 → 实操改用 ComfyUI API(comfyui-client) 更稳。

AnimateDiff v3 调参num_frames 16 / context_length 16 / context_overlap 4 / fps 8(后插值到 24)/ motion_scale 1.0。经验:对话特写 scale 0.6~0.8(防五官扭曲);全景走动 1.2~1.5 + ControlNet(Depth)(防背景漂移);画面闪烁guidance_scale 降 6.0、context_overlap 增 6。运动描述靠 Motion LoRA / MotionDirector;实测「平移」尚可、「旋转」易崩 → 只保留 zoom in/out + pan left/right 四种

音频 & 口型工程化:Edge TTS 中文情感参数为 style(如 "style":"sad"),每角色固定 voice 防音色突变,生成后用 pydub 修剪首尾静音并算有效时长。Wav2Lip 对光照敏感 → retinaface 检测人脸 + 直方图均衡预处理;逐帧裁剪人脸→批量 inference→mask 融合贴回;GFPGAN 仅增强人脸区域(facexlib 提 mask),否则背景过锐。⚠️ 侧脸/遮挡时 Wav2Lip 效果差 → 仅对正面说话特写做口型,远景/背对直接省略

合成moviepy 长视频内存占用大 → 分段合成 + FFmpeg concatComicCompositoradd_scene(按精确时长裁剪 + 音频不足 loop / 超出 subclip + 字幕置画面 85% 高度)→ exportcrossfadein(0.5) + concatenate(method="compose"))。⚠️ 中文 TextClip 需装中文字体,否则乱码。

性能口径(A100,单场景):LLM 剧本 ~3s / 关键帧 4 张 ~25s / AnimateDiff 16 帧 ~60s / TTS+Wav2Lip ~20s / 合成 ~5s → 10 场景 ≈ 18 分钟。显存:AnimateDiff 16 帧约 14GB;出图后 empty_cache();多任务 CUDA_VISIBLE_DEVICES 隔离;模型常驻内存。

常见错误与修复表

现象 原因 修复
角色衣服颜色突变 LoRA 过拟合 / IP-Adapter 权重过高 IP-Adapter 降至 0.6,prompt 加颜色约束
AnimateDiff 视频闪烁 motion_scale 过大 / overlap 不足 overlap 增到 6、scale 降到 0.8
Wav2Lip 口型滞后 音频帧率与视频不匹配 统一视频 FPS=24、音频采样率=16000 并重采样
合成后音画不同步 未按音频精确截取视频 audio.duration 截视频,别依赖预估时长

现状:可稳定生成 60 秒内高质量漫剧;多人同框一致性互扰(拟引入 FaceID)、运动多样性有限(拟试 SVD/CogVideoX)为已知边界。


③.5 人物表情矩阵

  • 指令:《人物表情矩阵指令》(原文见 02_素材整理/人物表情矩阵指令.txt
  • 操作方法先参考一张人物图,再套用指令词
  • 输出:10 宫格表情板

核心要点:

  • 极简 UI 风格 + 影视角色设定卡排版
  • 纯白背景,无纹理无环境元素
  • 严格 两行五列(5×2),10 个等分卡片,仅靠留白区分边界
  • 每格:同一人物面部特写不露颈部以下,统一镜头距离/比例,只变表情,外貌完全一致
  • 居中构图,影棚柔光,皮肤真实干净,无夸张阴影
  • 每格底部居中编号 01~10,后接小字(如 01-微笑/02-愤怒/03-悲伤
  • ⚠️ 原指令书写矛盾(「正方形构图」vs「16:9 输出」)——已定案(2026-09-19)
    • 最终画幅:16:9
    • 理解为:多个正方形表情卡片拼合成一张 16:9 的图(每格内部为正方形构图,整体输出 16:9)
    • 即:5×2 十宫格,每个卡片本身是正方形,组合后整体为 16:9

质检点:10 格同一张脸,只有表情变化;编号对应准确。


③.5.1 【夸张表情专项】情绪→视觉翻译 + 27 组表情库(搞笑/名场面)⭐

素材:《AI 夸张表情提示词完全教程》(原文见 01_原始素材/2026-09-21新增/AI夸张表情提示词完全教程.md与 ③.5 的区别:③.5 是一致性用的 10 宫格表情板(同脸多情绪,做参考图);本节是出图用的夸张表情单片(搞笑/爽剧/鬼畜/名场面高光),追求「情绪外化 + 漫画符号」。两者互补,不要混用。

核心方法论:情绪 → 视觉翻译(三层拆解)

写「她很生气」= 模糊词,模型不认;要翻译成 ① 五官层 + ② 肢体毛发层 + ③ 漫画符号特效层 的具体像素指令。

模型不认「情绪」,只认「像素上长什么样」。

提示词写作核心公式(3.5.1 版):

角色基底描述(固定不变) + 五官变化(眼/眉/嘴/脸颊分项写) + 肢体毛发配合 + 漫画符号特效 + 光影/色调 + 镜头景别

① 角色基底描述 —— 同角色做多种表情时逐字复制、一字不改,只改表情段落(否则角色崩脸)。

② 五官变化分项拆解(禁写情绪词,逐项写形态):

部位 平静态 夸张化写法
眼睛 正常 瞳孔缩成针尖 / 放大占满眼眶 / 变螺旋/金币符号 / 死鱼横线眼
眉毛 自然 倒刺 V 形 / 飞起 / 紧皱川字 / 一高一低
嘴巴 自然 O 型张大 / 咧到耳根 / 嘴角下垂 / 咬牙切齿 / 喷水喷火
脸颊 正常 涨红 / 发白 / 汗珠挂脸 / 泪流成河
额头面部 正常 青筋暴起 / 扭曲变形 / 五官被拉扯位移

③ 漫画符号特效库(漫画/动画通用「情绪语言」,写进提示词大幅提升出图稳定性):

情绪 可用符号
震惊/惊讶 大红色感叹号(!!)、震动线、速度线、眼球凸出、下巴掉落
眩晕/头晕 螺旋蚊香眼、头顶星星、小鸟绕圈、旋转光带、问号(?)
愤怒 头顶火焰/浓烟/火山、井字青筋、V 字倒眉、红瞳、咬牙
委屈/悲伤 瀑布泪、眼角挂泪、嘴角下垂、皱脸、乌云、枯黄落叶
开心/兴奋 星星眼、爱心眼、嘴角咧到耳根、闪光/花瓣、灯泡、头顶冒花
无语/嫌弃 死鱼眼(横线眼)、黑线/乌鸦飞过、灵魂出窍、头顶青烟
贪婪/见钱眼开 瞳孔变金币符号、金币雨、$ 符号、眼睛发光
惊恐 炸毛(头发竖直)、大颗汗珠、速度线、瞪到极限
破防/心碎 面部裂纹、黑色碎片、冰霜结界、捂胸、雪花
困倦 Zzz 符号、眼皮耷拉、打哈欠、气泡、头下垂
好奇/八卦 雷达耳、头顶波纹、八卦光点、凑脸凑近
摆烂/放弃 翻肚咸鱼、灰败脸色、头顶青烟、身体瘫软、死鱼眼
得意/害羞 鼻尖高光、头顶小花、脸颊泛红、下巴微抬、星星闪烁
憋笑 鼓脸颊、嘴角抽动、挡手、抖动波纹、忍笑残影

情绪分级(9 组原案的三档递进)

  • 轻情绪档(1–3):平静面瘫 → 螺旋眼眩晕 → 震惊飞眼(视觉符号从「无」到「有」,日常桥段/小反转)
  • 强情绪档(4–6):炸毛惊恐 → 瀑布泪委屈 → 金币眼贪财(开始违背人体结构,搞笑爽剧主力)
  • 极致情绪档(7–9):喷火愤怒 → 融化大哭 → 灵魂出窍无语(情绪完全外化为物理特效,名场面高光)

夸张度三档调节法

档位 写法 适用
轻度 「略微/微微」修饰五官 日常对话、内心 OS
中度 「夸张/明显」加大幅度 剧情转折、情绪升级
重度 「极度/完全」突破人体结构 + 漫画符号 名场面、鬼畜、搞笑爆点

角色一致性三要点:① 基底描述逐字复制 ② 固定景别(统一「特写镜头」,避免忽近忽远) ③ 固定风格后缀(如「国风插画风格,8K 细腻皮肤质感」)。

负面提示词兜底面部变形扭曲(非刻意夸张时)、多余手指、五官错位、模糊、低分辨率、画风不一致、现代物品、文字水印

常见翻车与修正

问题 原因 修正
表情不够夸张 只写情绪词没写五官细节 补眼/眉/嘴具体形态
角色长相变了 基底描述不统一 每次完整复制,勿省略
特效不出现 符号太抽象 用通俗比喻(像蚊香/瀑布/金币)
画风不统一 风格词缺失或每次不同 固定风格后缀
嘴部畸形 嘴巴描述太复杂 简化成「O 型张大」「咧嘴笑」

完整表情库(27 组):9 组原案(面瘫/螺旋眼/飞眼/炸毛/瀑布泪/金币眼/喷火/融化/灵魂出窍)+ 18 组扩展(瞳孔地震/下巴掉地/歪嘴斜眼/豆豆眼/咸鱼/飞问号/火山喷发/心灵碎裂/头顶冒花/鼻尖高光/脚下弹簧/灵光一闪/下巴抖果冻/卷帘门眼/憋笑打摆子/雷达耳/喷彩虹/冻成冰雕)。完整提示词全文见 01_原始素材/2026-09-21新增/AI夸张表情提示词完全教程.md 第四、六章(按公式编写,角色基底可整体替换为你自己的角色)。


③.5.2 【写实表情 & 微表情专项】60 表情库 + FACS 微表情五层架构 ⭐

素材:02_素材整理/2026-09-21新增/09_60种人物表情提示词.txt(60 条)+ 13_人物微表情设计指南.txt(FACS) 与 ③.5.1 的分工:③.5.1 = 漫画化夸张(搞笑/名场面);③.5.2 = 写实细腻表演(正剧/情感戏)。两者按剧集调性选用。

A. 表情拆解 5 要素(不要只写"很伤心"): 眼神 + 眉毛 + 嘴角嘴唇 + 身体反应 + 剧情状态 组合公式:角色设定 + 表情提示词 + 场景情绪 + 镜头景别 + 光影风格

B. 60 条表情库(6 大类,直接复制改角色)

类别 代表 用法要点
基础微表情(10) 平静克制/轻微疑惑/欲言又止/强装镇定/不动声色 铺垫戏,先让人物不像木头人
开心松弛(10) 浅浅开心/忍不住笑/喜极而泣/温柔注视 别只写"笑得很开心",写眼睛弯+嘴角+肩膀
紧张恐惧(10) 突然警觉/不安预感/强烈恐惧/发现真相/大脑空白 瞳孔微缩/睁大是关键信号
悲伤崩溃(10) 隐忍难过/无声落泪/压住哭腔/彻底心碎/告别时微笑 递进:泛红→滑落→失控,不要一上来嚎啕
愤怒对抗(10) 忍着怒气/冷笑反击/含泪愤怒/被背叛的怒/决裂表情 愤怒分层次,下颌收紧→爆发
复杂转折(10) 笑里藏刀/强颜欢笑/半信半疑/突然明白/下定决心 短剧最需要,双层情绪(脸上A心里B)

C. 微表情 FACS 系统(写实特写镜头用)

  • 原理:Paul Ekman 面部动作编码系统,把表情拆成「动作单元 AU」对应肌肉群。AI 对解剖学名词响应比抽象情绪词精确。
  • 核心 AU 速查:AU4 皱眉肌(眉头下压) / AU6 颧大肌(脸颊上提) / AU7 眼轮匝肌(下眼睑绷紧) / AU12 嘴角上扬(真笑) / AU15 降口角肌(嘴角下垂) / AU17 颏肌(下唇上推)
  • 五层架构:①身份锚定(年龄脸型五官肤质) → ②情绪基调(视觉具象化,禁抽象词) → ③肌肉运动(核心) → ④时序编排(0-3s/3-6s/6-10s分段) → ⑤环境联动(光影影响表情呈现)
  • 肌肉运动五要素公式状态 + 部位 + 幅度 + 时长 + 衔接 例:双眼瞬时睁大至瞳孔外露18%,持续0.35秒,随后缓慢恢复自然
  • 量化优于形容:「上扬3mm」优于「微微上扬」;中英混写更准(中文写场景情绪,英文写肌肉:嘴角上扬 lip corner puller AU12 激活)
  • 防翻车:面部僵硬=只写单一肌肉群 → 眼轮匝肌+口轮匝肌+额肌三层联动+呼吸微动;幅度太大 → 加限定词(轻微/微妙/几乎不可见);跳帧 → 加过渡词(gradually transitioning from...to...);多次不一致 → 首帧参考图锁定+固定seed

D. 表情戏镜头铁律

  1. 一条镜头只选一种主情绪(禁止又开心又愤怒又害怕)
  2. 表情戏用近景/面部特写,远景看不清情绪
  3. 情绪要递进拆镜(克制→震惊→痛苦→决心 4 镜),不要突然爆炸
  4. 只写脸不够:手、肩膀、呼吸、后退半步比大动作更有戏
  5. 失败别急着重抽:先判断是角色图/表情词/镜头距离/场景情绪哪一环

自检:删掉台词后,观众还能不能从脸上看出人物正在经历什么?


③.7 【资产体系】role/scene/prop + 父子衍生(参考 Toonflow)⭐

资产类型role(角色)/ scene(场景)/ prop(道具)

父子资产结构

  • 主资产:基础形态
  • 衍生资产:状态变体(破损/染血/夜景/激活态/换装等)
  • 引用规则:衍生状态匹配剧情时必须用衍生 ID;同一分镜内禁主/衍生同存

图像资产标注:按引用顺序标 @图N 为xx{类型};提示词正文中该角色/场景/道具的位置必须用 @图N 替代名称,建立参考图绑定。

衣橱系统:多套造型共享同一角色身份。

主体库(Subject Library / 数字资产库):把角色的「标准像」(Master Reference,经确认的定妆母图)录入为可调用的数字资产,后续每个镜头强制参考它而非让 AI 自由发挥 —— 这是「参考生视频」模式的一致性基石(等价于 ③.6 的 Master Reference 机制,工业侧术语)。

  • 与「衍生资产」的关系:主体库存主资产(标准像),衍生资产(换装/破损/夜景等)由主资产派生并挂接引用。
  • 合规提醒:为规避「盗脸」侵权,专业团队建立专属数字资产库;个人创作者至少保证参考图来源合规。
  • 「撞脸」规避机制(2026 趋势报告补充):AI 生成的形象若与影视艺人或知名游戏/动漫 IP 角色高度相似 → 负面舆论 + 侵权隐患。在角色设计阶段就做主动「溶图规避」(调整五官组合/骨相/发色/配饰,避免与知名形象重合),而不是等争议发生后再被动应对。

④ 人物三视图

4.1 【分层叠加】L0-L6 服化妆造体系(参考 Toonflow)⭐

把人物拆成可独立替换的层级,便于换装/换妆复用,保证跨镜一致。

层级 内容
L0 底模(基础形象,不修改)
L1 妆容(先分析线索,再决策基础妆/轻妆/正式妆)
L2 发型造型 + 发饰
L3 中衣/内搭
L4 外衣/主服
L5 配饰(首饰/手表/眼镜/包袋)
L6 鞋履

六铁律:面容不变 / 姿态不变 / 逐层可控 / 风格统一 / 质感不降 / 纯服化范畴

妆容决策:底模虽素颜,衍生资产默认进入妆造流程(根据线索决策强度);道具/场景/姿态变化不得单独抬高妆容强度。

衍生资产:同一角色多套造型共享身份,建议用**图生图(以底模为参考)**保证一致性。

📎 完整规范(四视图规范/衍生提示词模板)见 03_GitHub研究/R7_Toonflow_人物衍生与四视图.md

4.2 三视图制作流程

  • 指令:《四、S级三视图指令词》+《三视图.docx》(原文见 02_素材整理/三视图指令.txt

制作顺序(来自《制作注意事项》,很重要):

  1. 先找参考、找灵感
  2. 熟练使用提示词反推
  3. 先创作面部特征
  4. 以面部为参考创建全身像(确保面部清晰一致)
  5. 最后做三视图(白色背景)

三视图要点:

  • 纯白背景、高精度、干净极简的「角色设定板 / turnaround board」
  • 左侧:全身三视图(正面 / 左侧面 / 背面),同一角色,五官发型服装一致,平视、中性棚拍光
  • 右上:6 张头部角度图(正面 / 俯视头顶 / 后脑 / 左侧轮廓 / 正侧脸 / 3-4 侧脸)
  • 右下:6 张局部细节图(上衣面料 / 下身 / 臀部剪裁 / 腿部皮肤 / 眼部五官 / 鞋子)
  • 输出约束:横版构图、白底、完整人物、不裁切;不出现多余道具/文字/LOGO/水印/UI/社交截图感

英文版三视图指令(来自《三视图.docx》)关键要素:基于上传参考图,中性纯背景,技术建模 turnaround 风格,与参考图视觉风格一致(realism/渲染/材质/色彩处理/整体美学);两行排布:上排 4 个全身站立视角(正面 / 左侧 / 右侧 / 背面),下排 3 张高精度特写头像;比例与对齐一致、解剖准确、剪影清晰;光照方向/强度/柔度跨面板一致;输出印刷级清晰参考表。

质检点:三视图面部与设定完全一致;排版干净统一。

4.3 【画风基因】按画风锁定“第一锚点”(参考 Toonflow 11 画风)⭐

不同画风的“灵魂锚点”不同,提示词要按画风锁定不同的第一锚点,不能千篇一律强调五官:

画风 核心基因 表现手法
2D 现代都市言情/国风 面容即灵魂 赛璐璐上色、清晰线条
2D 90年代复古日系 线条即灵魂 手绘流畅线条,避免数字化锐利边缘
2D 扁平设计 轮廓即灵魂 扁平色块,无阴影渐变
3D 建模 四视图标准 20 字避开同模描述(防同一张脸)
3D 黏土定格 黏土肌理为魂 手工捏塑痕迹、手指压痕
真人实拍 面容即灵魂 毛孔级精细渲染

📎 完整规范(场景五原则/季节色调映射/道具五原则/四视图体系)见 03_GitHub研究/R8_Toonflow_场景道具与画风基因.md


6.18 【卡点排查 & 返工定位】按层定位问题 + 单变量返工 🔧

源自 灵绘AI《AI漫剧制作卡点怎么破?》(素材 21)。创作诊断方法论,配合 6.7 七律 / 6.17 逐镜质检使用。

核心认知:卡点不是「不会生成画面」,而是前期材料没被拆成模型能执行的镜头任务(剧本太文学化 / 角色信息不固定 / 提示词每镜重写 / 分镜缺衔接目标)。

① 四类卡点 → 优先修正

问题 表现 优先修正
剧本不可生成 有情绪缺可见动作 内心戏改成画面/动作/道具
角色不固定 每镜脸型/年龄/服装变 先写角色卡,再写镜头
分镜没有任务 画面好看但不推进 每镜标信息增量
提示词过散 风格/限制冲突 建母版,只替换镜头变量

② 诊断口诀连续 3 次方向不对 → 剧本/分镜(结构层)方向对但细节不稳 → 改提示词(执行层)删掉某镜信息无损失 → 装饰镜头

③ 可生成剧本四字段:场景目标 / 可视动作 / 情绪变化 / 镜头钩子(核心判断:「观众看完这一镜,信息增加了什么?」)。

④ 角色卡:先定固定项(要保留什么)+ 禁止变化(不发挥到哪里),后续镜头只引用,避免「每镜重新介绍主角」→ 变脸(配合 ③.6 / ③.6.1)。

⑤ 提示词母版画风母版 + 角色固定 + 镜头变量 + 负面提示词 分开写——结构 > 长度,越长越易冲突失控。

⑥ 单变量返工:每轮只改一个变量(如先固定角色卡,只改第 5 镜镜头变量);把「哪里不好」拆到 剧本/角色/分镜/提示词/质检具体一层,制作即从玄学变可迭代流程。

完整方法见 02_素材整理/2026-09-21新增/21_2026AI漫剧卡点排查与返工定位.txt

6.19 【零代码智能体编排】用「大脑+双手」把管线串成自动化生产线 🆕

源自 阿里云《ComfyUI 搭建 AI 漫剧生产线:零代码 AI 漫剧视频工作流》+ 腾讯云《部署并搭建视频生成 Pipeline》(素材 28)。解决「工具各干各的、没人串」:把 ③④⑥⑦ 的重复劳动交给智能体编排层。

核心范式:编排层(大脑)+ 执行层(双手)

  • 编排层 = Dify / n8n 等可视化 Workflow·Agent 平台:负责剧本生成、分镜拆解、多 Agent 协作、JSON 结构化输出、循环批量、工具调用(把「故事大纲」拆成含 镜头号/时长/提示词/运镜/对话 的 JSON)。
  • 执行层 = ComfyUI:负责出图/图生视频/配音,靠 IP-Adapter + ControlNet 锁角色一致性。导出 API 格式 JSON 后即可被编排层调用。

Dify + ComfyUI 集成四步:① ComfyUI 打开工作流 → Save (API Format) 导出 JSON → ② Dify Marketplace 装官方 ComfyUI Plugin → ③ 填 ComfyUI 服务器 URL → ④ 加「ComfyUI Workflow」节点,传 JSON + 变量(prompt / seed)。

多 Agent 分工(对应本流程环节角色)编剧 Agent(写剧情,≈②)→ 导演 Agent(拆分镜,≈⑥ 导演规划)→ 提示词优化 Agent(加风格描述与角色一致性约束,≈③④);可用 Question Classifier 路由。

起手式与选型

方案 难度 部署 适合
MoneyPrinterTurbo 15min 个人/零基础(主题→成片)
编排层 + ComfyUI ★★ 1-2h 批量生产、可复用模板
n8n + ComfyUI + MCP ★★★ 1-2h 团队协作、可共享工作流

落地要点:① 角色一致性——编排层建「角色知识库」(脸部参考图 + 固定描述 + LoRA),每次生成都引用;② 显存——ComfyUI 用 FP8/GGUF 量化版模型,12G 可跑 1080P;③ 风格统一——全局 System Prompt 固定画风;④ 批量——编排层 Loop + Scheduler,一晚可跑多集(呼应 7.4)。

避坑:ComfyUI API 报错先查 JSON 格式与服务器是否在跑;提示词漂移用 Prompt IDE 反复测;低配可「云端编排 + RunPod 租卡跑 ComfyUI」。

完整方法见 02_素材整理/2026-09-21新增/28_零代码智能体编排与视频Pipeline(自动巡检).txt


⑤ 场景

  • 指令:《五、S级场景指令词》+《场景设定.docx》(02_素材整理/场景设定公式.txt

5.1 场景提示词万能公式(《五》)

  1. 定调光影氛围 — 写光的质感与情绪(丁达尔效应、黄昏死寂金光、黎明蓝调)
  2. 描绘核心主体与背景 — 精准名词组合构建空间
  3. 强调材质与光影互动 — 光如何"触碰"物体表面
  4. 锁死渲染与画质后缀 — 写实场景、UE5、CG、极致细节、8k

全局约束:

  • 绝对真空匿名:严禁出现人影/人名/衣物/身体部位等暗示人物的元素
  • 场景命名四字以上带修饰词
  • 固定开头:不能出现其他人,无人纯场景,
  • 四大要素:环境类型 / 具体时间 / 空间氛围 / 视觉主要特征
  • 必选视角:宏大鸟瞰全景 / 低角度仰视 / 平视深远构图(禁用微距特写)
  • 唯美高级感 5 条:情绪词 + 诗意光影对抗 + 情绪化时间天气 + 动态氛围细节 + 情绪色彩
  • 风格可选:东方古典仙侠(默认)/ 硬派写实东方幻想(永劫无间)/ 现代都市 / 日常校园

输出两套格式(缺一不可):

  • 格式一:场景提取清单 → 专业场景设定表 → 可复制 Prompt
  • 格式二:GPT版场景指令词(主图 + 4 张副图,每张带四字以上括号名称)

5.2 场景设定通用公式(《场景设定.docx》)

【已定案 2026-09-19】两套场景体系均保留:《五、S级场景指令词》侧重「无人纯场景 + 诗意光影 + 宏大空间」;《场景设定.docx》侧重通用六模块公式(可含人物)。两者互补使用。

核心公式: 空间属性 + 视觉风格 + 光影色彩 + 时间环境 + 细节质感 + 叙事

简版: 时代(环境天气,色调)地点,景别+视角,人物,(表情,动作)干什么,风格

六大模块:

  1. 空间属性 — 核心场景类型 / 空间尺度(景别)/ 物理布局
  2. 视觉风格 — 美术风格 / 画质参数 / 镜头设定(含画幅比)
  3. 光影色彩 — 主光源 / 光影氛围 / 色彩基调 / 色阶
  4. 时代环境 — 时间维度 / 环境氛围 / 天气特效
  5. 细节质感 — 材质表现 / 物体比例 / 细节精度
  6. 叙事 — 主体互动关系 / 镜头运动适配

5.3 【场景变体】景别/时段/天候衍生(参考 Toonflow)⭐

同一场景可通过三种变体复用(建筑/布局/材质/色调保持不变):

景别变体:大全景(建立空间)→ 全景(展示结构)→ 中景(聚焦功能区)→ 近景(细部)→ 特写(纹理)

时段变体:清晨(冷白薄雾)/ 正午(明亮短影)/ 黄昏(金色长影)/ 夜间月光(冷蓝幽静)/ 夜间灯火(暖黄对比)

天候变体:晴天 / 阴天(柔光无硬影)/ 薄雾 / 细雨 / 飞雪

📎 完整规范(含 11 种画风视频标签库,可复制)见 03_GitHub研究/R9_Toonflow_画风标签库与场景变体.md


5.4 【场景氛围专项】60 种氛围提示词:让画面有故事感 ⭐

素材:02_素材整理/2026-09-21新增/07_60种场景氛围提示词.txt 定位:5.1/5.2 管「场景是什么」;5.4 管「场景在讲什么故事」。氛围不是滤镜,是叙事。

氛围公式(7 要素)角色 + 具体地点 + 时间 + 光源 + 天气/空气 + 空间细节锚点 + 情绪目的

例:黑衣少年站在雨夜旧巷尽头,深夜冷蓝月光从屋檐缝隙落下,湿石板路反射远处暖黄灯笼,空气有薄雾和细雨,墙角有一枚破碎玉佩,整体氛围悬疑压抑,像真相即将被揭开。

60 条氛围库(6 大类)

类别 代表 叙事作用
光影氛围(10) 冷蓝月光/暖黄灯火/红色危险光/逆光剪影/窗格斑驳光/顶光压迫 定情绪方向:悬疑/回忆/危险/登场/审问
天气空气(10) 细雨压低情绪/暴雨追逐/薄雾遮挡/雪夜寂静/晨雾初散 环境参与叙事:雨=压抑、雾=隐藏信息、暖光=希望
时间氛围(10) 黎明前的蓝/正午强光/黄昏将尽/深夜空街/节日夜色 同场景不同时间=不同故事
空间质感(10) 旧巷石板路/空旷大殿/破败院落/狭小房间/屋顶夜风 让观众相信这个地方存在
情绪氛围(10) 悬疑感/压迫感/孤独感/温柔感/宿命感 先定这场戏让观众感到什么
短剧高频(10) 雨夜相遇/反派登场/女主回忆/真相揭露/诀别告白/悬念收尾 直接放进分镜

氛围写法五步:①地点具体化(别写"古风场景",写"雨夜旧巷尽头破败院落木门半开")→ ②时间给情绪 → ③光源制造重点(冷暖对比)→ ④天气推动紧张 → ⑤细节落到剧情(破碎玉佩/旧信=线索锚点)

红线

  • 不要只写抽象词(电影感/氛围感前面必须有具体光影天气细节)
  • 一条提示词别塞多种风格(雨夜+雪山+霓虹同框=画面乱)
  • 场景别抢人物(氛围服务剧情,不是淹没人物)
  • 别每场都黑暗悬疑(治愈/重逢/希望各有氛围写法)

自检:遮住人物后,观众还能不能感觉这里马上要发生故事?


⑥ 分镜头提示词

  • 指令:《六、S级镜头提示词 10秒》✅ /《六、S级镜头提示词 2-15秒》✅
  • 辅助素材:九宫格提示词 / 景别 / 视角 / 动态镜头(02_素材整理/
  • 输出:分镜头提示词(按 10 秒版 / 2-15 秒版切分)

两版规则体系完全相同(六维一致性/四步法/违禁词/自检机制),仅时间轴收尾风格要求不同。

6.0pre 【分镜实战要诀】(18篇知乎方法论精编,拆分镜前先读)

完整版见手册「分镜实战要诀」章节;原始 18 篇在 01_原始素材/2026-09-22分镜技巧/。这些是让分镜有戏而不是只完整

  • 不拍台词拍变化:别「谁说话就给谁」。镜头跟关注点转移走(交流→试探→施压→失控→沉默),多拍听者反应与停顿,不只拍发言者
  • 先抓重音:整场先定 1-2 个最该放大的点(关键台词/态度转折/情绪裂口/线索出现),有轻有重,禁平均铺陈
  • 拍情绪过程不拍结论:不写「她很紧张」,写手指收紧/话卡住/视线移开/呼吸不稳语气在撑
  • 心理转译成画面:心理状态→外在表现→镜头表达(表情细节/身体动作/环境反应/镜头节奏四层)
  • 善用留白:情绪转折、关系微妙处、重大事件前后故意不拍满,给观众推断空间;剧情镜头要清、信息镜头要准、情绪镜头可留
  • 环境参与叙事:用空房/没碰的水杯/开着的门/吹动的窗帘承接情绪、埋线索、调节奏;可拆成建立/氛围/细节/收束镜头
  • 信息分层:分主/辅/氛围信息;主镜头承载核心戏,补充镜头少量增层次,一镜一主一辅
  • 重复克制:同一信息不用两镜重复表达,能一镜说清不拆三镜
  • 一场景拆几镜:不按字数/句子,按变化点(关注点转移次数)拆;不追求多也不追求少,追求合理
  • 人物首出场立住:先局部后完整/先环境反应后出人/带动作出场,给记忆抓手;重要角色不用普通正面中景一笔带过
  • 快慢判断:偏剧情推进(外部冲突/信息)→快而利落;偏情绪关系(内部冲突/心理)→给足停留与停顿
  • 导后自检:拆完能一句话说清本段重点;删 1/3 镜会不会反而更清楚;该留白处是否还在拼命解释

6.0 【10秒版】分镜拆分核心规则(《六、S级镜头提示词10秒》)

拆分原则:以 35-50 字为一段拆分文案,单句内容要完整;逐段生成提示词。

六维一致性准则(相邻分镜必须无缝衔接):

  • 人物一致:严格匹配角色信息库,未出现角色绝不写入
  • 时空一致:时间(晨/午/晚)、地点、光线与上一镜一致
  • 物品一致:关键道具(钢笔/背包)位置状态延续
  • 动作连贯:新分镜起始动作承接上一镜结束状态
  • 台词合规:仅当前说话角色有张嘴动作,台词用中文引号
  • 敏感过滤:违禁词自动替换为中性词

【3秒决策原则】执行前必检:人物是否齐全 / 场景是否连贯 / 有无违禁内容 —— 任一不满足立即中止重推

【分镜生成四步法】:① 场景锚定(时间/地点/人物三角)→ ② 连续性检查 → ③ 台词植入 → ④ 敏感扫描

时间轴结构(两版差异)

10 秒版(1-4 个镜头):

[0-3秒] 核心动作     [3-6秒] 互动反应
[6-8秒] 情绪特写     [8-10秒] 下一镜铺垫

2-15 秒版(长镜头版):

[0-4秒] 核心动作     [4-8秒] 互动反应
[8-12秒] 情绪特写    [12-15秒] 下一镜铺垫

收尾风格要求(两版差异)

  • 10 秒版:动漫风格;不要表格
  • 2-15 秒版:3D动漫风格;不要背景音乐在提示词前面加上这句话,加上画外音并标注出处

关键约束

  • 全中文输出,禁用英文引号,一律用中文引号
  • 图片提示词不映射人物;视频提示词必须有角色标签映射(只写实际出现的角色)
  • 视频提示词必须含「衔接前置指令」段落
  • 景别:⚠️ 注意适用范围——“多用近景/特写/大特写,不用远景,少用中景”仅适用于漫剧(动漫风)的台词与情绪镜头;对环境建立、换场首镜、动作戏尺度升级,仍按 6.2/6.6/6.7/6.11 切全景/大全景。两者不矛盾:日常镜靠近,空间镜靠远
  • 台词时段镜头固定,不切换、不推拉
  • 违禁词词典:血腥暴力类 / 裸露低俗类 / 色情暗示类 / 其他高危(封建迷信、公序良俗、宗教政治)
  • 每项文案生成 1 个分镜,总数 = 文案条目数,禁自行拆分合并

输出自检:字段数=3(panel_index/prompt/video_prompt)、中文引号、video_prompt≤500字符、人物100%映射、场景信息一字不改、含衔接前置指令

输出格式

  • 有拆分子文案 → 分镜头1 / 原文案 / 子文案 / 分镜头1-1 [时间轴] 场景:...
  • 无拆分 → 原文案 / 分镜头N [时间轴] 场景:...
  • 风格:动漫风格;不要表格

6.1 九宫格生成法(02_素材整理/九宫格提示词.txt

  • 基于参考图,生成 3×3 网格故事板,每格标注序号
  • 每格分镜 16:9,电影质感,一致的人物和光影,4K 级别
  • 需包含不同景别、不同角度的 9 张分镜
  • 确保人物角色、服装、环境一致,色彩分级一致
  • 每格左下角标注分镜序号
  • 可反向:根据九宫格分镜生成故事脚本;也可提取某一宫格放大为全画幅(去序号、保 4K)

6.2 景别(02_素材整理/景别.txt

远景 / 全景 / 中景 / 近景 / 特写 / 微距 (远景=重氛围环境;全景=主体全貌+环境;中景=动作+局部环境;近景=局部细节+近距离感;特写=极小局部+情绪冲击;微距=微观极致放大)

6.3 视角(02_素材整理/视角.txt

平拍 / 仰拍 / 俯拍 / 第一人称 / 第三人称 / 微俯 / 微仰 / 鸟瞰(无透视)/ 虫眼 / 侧拍 / 斜侧拍

6.4 动态镜头 / 运镜(02_素材整理/动态镜头运镜.txt

基础运镜 6 种:推镜、拉镜、摇镜、移镜、跟拍、固定镜头 创意组合运镜:镜头穿梭机视角、环绕运镜、升降运镜、甩镜、变焦运镜、晃动运镜、滑轨运镜

(每种含关键词 + 适用场景,详见参考文件)

🔗 进阶:以上是运镜名词层面的清单;如果要让运镜“能用、不翻车”,见 6.12 五变量运镜系统(把光圈/焦距/物距/对焦/摄影机运动变成可执行参数,并区分真 Dolly 与假变焦)。 📎 另见附C 动作戏的 CAM01–CAM20 运镜库(6.11)。

6.5 视频风格(02_素材整理/视频风格.txt

  • 写实类:超写实真人风、3D 电影写实风(偏好)、纪实纪录片风
  • 动漫/二次元类:日系赛璐璐、国漫水墨、赛博朋克动漫
  • 艺术创意类:极简线条、蒸汽波复古、黏土定格
  • 科幻专属:硬核科幻写实风(偏好)、科幻概念原画

质检点:镜头提示词要与 ③人物、⑤场景、关键道具对齐,便于第 ⑦ 步引用。

6.6 【优化补强】叙事拆解与镜头语言(参考 GitHub LuxReal short-drama-skills)

以下为 GitHub 主流项目验证过的通用规则,与 S 级镜头提示词互补

A. 全局节奏控制(最高优先级)

  • 信息密度原则不提供新信息就不切镜。新镜头必须含新情节推进/新环境细节/新情绪强度;否则允许同景别机位延续。
  • 非叙事镜头控制:单 beat 内空镜/过渡镜头总时长占比 ≤20%,超出优先砍空镜。

B. 分镜拆分原则

  • 复杂动作三段式:动机/准备 → 执行过程 → 结果/反应
  • 空间转场 / 时间跳跃 / 人物关系变化 → 必须切镜
  • 同框超 2 人必须拆散(优先单人特写或双人中景)
  • 情绪突变切特写情绪渐变靠景别递进、不切镜
  • 对话视线乒乓:说话者→聆听者→说话者(关键反应镜头比说话更重要)
  • 静态画面单镜停留 ≤6s;台词超 6s 当场拆子镜头
  • 节拍控制:紧张/打斗用短镜头,抗情/悬疑用长镜头

C. 视觉转化五大铁律

  1. 台词具象化:涉及具体过去事件必须插闪回;禁只拍说话大头
  2. 潜台词外化:抽象情绪转具体肢体动作("焦急"→"手指抠衣角,指甲发白")
  3. 动作零脑补:严格忠实原著,动作跳跃须补过渡,禁瞬移
  4. 视点锁定:除剧本明确外禁主动切场景;画外音时聚焦听者反应
  5. 关键信息特写:关键道具必须独立特写

D. 视觉描述四维度 【镜头与构图】景别+运镜+视角 |【主体描述】禁"同上/他她",同角色动作表情合并长句用逗号 |【光影/氛围】只写必要光影 |【画面背景】仅首镜或方向大变时填(8 字左右)

E. 分镜时长估算(实用公式)

类型 公式/时长
台词(正常语速) 字数÷8+1 秒
台词(争吵/急促) 字数÷10+1 秒
台词(深情/遗言) 字数÷5+1 秒
VO 旁白 字数÷7+1 秒
微动作/常规动作 2 秒
复杂连续动作 4 秒
强烈情绪反应 3 秒
环境/空镜/静物 2 秒
慢动作特效 3-4 秒

同时含台词+动作取较大值;单分镜 ≤12s(长台词切分锚点:话题转折→情绪变化→逻辑层级→自然气口)。

F. 首尾帧三层决策(参考 ai-comic-studio)

  • 自动决定每镜生成「首帧+尾帧」还是「仅首帧」:确定性规则 → LLM 语义判断 → 安全兜底
  • 镜头衔接自动传尾帧:上镜尾帧作为下镜首帧,保证画面连贯

📎 完整调研与逐环节优化建议见 R1_调研总览 📎 深度挖掘:生产级提示词与规范(七律视觉连续性/帧描述五要素/motionScript/时长预算)见 03_GitHub研究/R2_生产级规范_ai-comic-studio与openframe.md

6.7 【S级标准】七律视觉连续性(参考 ai-comic-studio 分镜督导)⭐

集级色温弧(Q0):全集开始前先定本集整体色温走向,统摄所有镜头主光:

  • 冷→暖(情感接近型)/ 暖→冷(情感离散型)/ 冷→暖→冷(希望破灭型)/ 中性→极端→收回(战斗揭秘集)

每镜三问(Q1-Q3):单一视觉概念 / 核心反差对 / 主动排除

七律(核心铁律)

  1. 动作连续 — 新分镜起始承接上一镜结束状态
  2. 景别递进 — 情绪渐变靠景别靠近
  3. 视轴守恒(180°铁律) — 同场景所有镜头在假想轴线同侧;越轴会导致"人物瞬移"
  4. 朝向逻辑 — 反打镜头朝向互补
  5. 信息控制 — 不提供新信息不切镜
  6. 节拍密度 — 2~3s≥1拍、4~6s≥2拍、7~9s≥3拍、10s+≥4拍
  7. 头尾安全区

帧描述五要素(用全角分号「;」分隔): ① 景别/视角+取景范围;② 角色位置姿态;③ 主光完整叙述句;④ 环境道具可见细节;⑤ 情绪解剖词——背景锚定词

  • ③主光必须完整叙述句(如"左侧晨光均匀铺洒,角色身形半受光"),禁只写短词
  • ⑤背景锚定词必须从场景描述摘取原文,同场景连续镜头完全一致
  • 首尾帧禁用动词:走向/转身/迈步/抬手/张嘴/挥手/冲/跑/跳 (会渲染动态模糊)

motionScript 时间轴:每段用 [] 包裹,顺序即叙事顺序; 分隔连续动作;结尾加 | 朝向:角色名+方位词触发-反应铁律(外部触发先给短促反应拍);台词顺序是铁律

cameraDirection起幅[景别] → 运动+速度 → 落幅[景别],目的:[揭示/跟随/强调];运镜速度须匹配情绪功能(禁清一色"缓慢")。

特殊镜头:换场首镜必须全景/大全景(禁特写开场);情绪顶点后接 1 个「呼吸镜头」。

动作合规替换:描述运动轨迹和画面构成,结果用空间/姿态变化代替("刀刺入身体"→"刀刃弧线向前→人物重心后倒")。

6.8 【时长预算】S级分镜时长规划(参考 ai-comic-studio shot-split)

  • 硬性下限:目标总时长×0.9;软上限×1.2
  • 典型目标:≥ 目标÷9(平均每镜 9s);时长地板:对话/情绪 ≥10s、环境 ≥9s、动作 ≥8s
  • 先输出规划注释<!-- PLAN: 场景1=Ns(Xshots) | ... | Total=Ns(Xshots) -->
  • 每场景硬性扩展:对话≥2镜(说+反应)、新地点≥3镜、情绪拍≥2镜、打斗≥4镜
  • 可插入镜型:反应镜/角色拍/环境细节/平行动作/过渡镜(增加时长而不注水)

6.10 【承接上镜】跨片段连贯机制(参考 Toonflow)⭐

承接上镜段(同场内、非该场第一组才写):以同场上一组末行为依据,通读其「画面描述」与「角色动作」,推早为一句过渡,至少覆盖:

  1. 画面/场景定格状态 — 上镜结束瞬间的角色与关键道具位置、姿态、交互
  2. 角色最后动作 — 动作收尾后的形态(定格终态,不是动作起始)
  3. 位置与朝向 — 角色方位与面向

示例:承接上镜:上镜定格于角色A 立于书房窗前、左前位、面朝右,刚将信纸放回桌面、右手收回胸前——本镜由此姿态与机位延续

铁律:不得跨「场」承接(硬切换场不写承接)。

📎 完整规范(三层 Agent 架构/六阶段流水线/资产体系/@图N标注/11 种画风约束手册/videoDesc 12 字段)见 03_GitHub研究/R6_Toonflow_Agent架构与资产体系.md

分镜完成后必过一遍审核。完整规则见 03_GitHub研究/R3_Toonflow_分镜表与审核.md

四条绝对红线(违反任一 = 严重问题)

  • R1 资产引用合法 — 引用资产 ID 必须存在;画面可辨识角色必须引用对应资产;每片段必须引用场景资产
  • R2 剧本忠实 — 所有台词与剧本一字不差;不遗漏场次和关键事件;不新增情节
  • R3 具象可感 — 禁「开心/悲伤/烘托气氛」等抽象笼统词;声音具体到声源
  • R4 父子资产选择 — 衍生状态(破损/染血/夜景/激活态)必须用衍生 ID

高频严重项(必检)

  • 禁光影色调:任何字段不得出现 光/影/逆光/侧光/色温/明暗/色调/暖冷 等词
  • 音效禁配乐:音效列仅环境音+动作音,禁 BGM/配乐/音乐
  • 人物外观不进提示词:画面描述不写服装/发型/长相
  • 片段时长:每片段 ≤15s;含台词镜 ≥ 字数÷4+1s;无台词镜 ≤6s

评分:A 可直接用 / B 小修 / C 较大修改 / D 重做


6.10b 【智能分镜工具】专业分镜 / 动态分镜 / 九宫格机位(工业侧)

源自 2026 产业专文(素材 16)。6.1 九宫格 解决「一张参考图出多格」;本节补充「导演级镜头语言」与「动态预览」工具层。

专业分镜工具

  • Drawstory — 内置电影镜头语言逻辑,可上传角色参考图 + 场景资产,保证数十格中面部/服装/透视严格一致;自动拆镜头语言并输出带景别标注的分镜本。
  • DomoAIFrames-to-Video,把 2-8 帧分镜转为动态分镜做动效预览(在进入昂贵视频生成前预判张力/节奏/音画冲突)。
  • StoryboardHero — 极速剧本转分镜,适合快速交付提案稿。
  • Katalist.ai — 4-5 分钟完成剧本→分镜,可导出 Premiere Pro。
  • LTX Studio — 深度创意控制,支持光影/动态与 Pitch Deck 整合。

九宫格机位(3×3 镜头角度库):在虚拟空间定义 9 个标准机位;按情绪/关系自动选机位组合,例:

  • 「主角愤怒」→ 特写 + 仰视
  • 「两人对话」→ 过肩镜头

与 6.1「九宫格生成法」的区别:6.1 = 一图出 9 格分镜;6.10b 九宫格机位 = 9 个预设镜头角度供按需调用

「抽卡师」新职业:工业化流水线催生的提示词工程师岗——把脚本翻译成 AI 指令。Seedance 2.0 / 可灵 3.0 已把生成可用率提到 90%+,不再需要盲抽上千次;但极致一致性仍靠人工深夜微调提示词(「人机协作」)。

6.11 【动作戏专项】电影级动作分镜(AI ACTION SCALE V6.0)⭐

素材:02_素材整理/2026-09-21新增/01_动作分镜导演Skill_V6.0.txt

用途:把一句“想看什么打斗”自动转成可拍/可剪/可生成的电影级动作分镜,并输出可直接复制的 AI 视频 Prompt。适用于武侠/仙侠/枪战/格斗/超能力/怪兽/机甲/追逐等。

核心公式意图 → 动作 → 交互 → 结果 → 反馈 → 下一动作

三条第一原则

  • 动作第一 + 因果第一:后一动作必须由前一动作的结果推动(禁止 A打→B躲→A硬切下一招)。
  • 分镜第一:任何 超过 3 秒的复杂动作必须先拆 Shot
  • 受力必须可见:每次命中/格挡/跌落都必须有身体或环境反馈。

一个 Shot 原则:一个主要动作 + 一个主要结果 + 一个主要摄影任务。

六步动作因果检查:意图 / 动作 / 交互 / 结果 / 反馈 / 下一动作。

默认 15 秒节奏骨架(不是机械模板):

0.0-1.0  冲突已发生     1.0-3.0  第一轮攻防    3.0-5.5  动作链
5.5-7.5  战术变化       7.5-10.5 升级         10.5-12.5 关键反击
12.5-14.2 高潮          14.2-15.0 确认 + CUT

强制:中段至少一次战术变化(高级战斗优先「优势→破解→反制→再反制」);15s 以上建议至少一次优势逆转;高潮只发生一次,结果确认后立即 CUT。

输出三层:① 一句话理解 → ② 完整时间轴 Shot 分镜 → ③ 一整段可复制的最终 Prompt(+ AI 生成约束)。


6.12 【运镜专项】五变量运镜系统(AI 电影运镜三变量 Skill Pro V2.0)⭐

素材:02_素材整理/2026-09-21新增/02_电影运镜三变量_Skill_Pro_V2.0.txt

用途:把光圈/焦距/物距/对焦/摄影机运动转换成 AI 视频模型可执行的动态运镜语言。

五变量:光圈 T 值(景深/注意力)、焦距 mm(视野/压缩)、物距 m(真实透视)、对焦(观众看哪里)、摄影机空间运动(空间关系)。

最关键区分 —— 真运镜 vs 假运镜

  • 推进 + 焦距固定 = 真 Dolly In(主体变大,透视真实变化)
  • 不动 + 焦距增加 = Zoom In(主体变大,透视基本不变)
  • 推进 + 焦距同步增加 = Dolly Zoom(希区柯克变焦)

AI 提示必须写明“摄影机真实移动”,防止模型把运镜理解成单纯数字放大。

情绪→参数速查:高级人物 50–85mm/T1.4–2.8 慢推锁焦;史诗宏大 24–35mm/T5.6–11 低机位大景深;压迫恐惧 85–135mm/T2–4 缓靠或 Dolly Zoom;梦幻爱情 65–85mm/T1.4–2;现实主义 35–50mm/T2.8–5.6。

时间轴式运镜设计:0–25% 建立空间 → 25–60% 引入变化 → 60–85% 加大变化产生转折 → 85–100% 完成视觉落点。

输出模板字段:运镜核心 / 摄影机运动 / 焦距变化 / 光圈变化 / 物距变化 / 对焦变化 / 空间变化 / 节奏 / 最终 Prompt / 负面约束。


6.13 【范例参考】真人 Vlog 级完整分镜(0–25 秒)

素材:02_素材整理/2026-09-21新增/03_情侣Vlog拍摄脚本_范例.txt

价值:一份逐镜到 0.1 秒的成品分镜范例,展示真人系(非动画)分镜要写到多细:

  • 全片设定:16:9 / 8K / 原生手机质感 / 人物一致性(禁止换脸、五官漂移)/ 妆容皮肤与头发细节 / 拍摄关系与焦段规划(24/28/35mm)
  • 逐镜要素:时间码 + 景别 + 焦距 + 景深 + 画面任务 + 面部/身体表演细节 + 台词
  • 情绪弧线:开心大笑 → 甜甜微笑 → 憋笑特写收尾(全片形成完整情绪曲线)

借鉴点:面部捕捉重点(眼睛/眼睑/眉毛/鼻翼/嘴角/脸颊/呼吸)、同一人物跨镜连续性写法、真实手持质感约束。


6.14 【动作表演库】60 种角色动作:让人物不像木头人 ⭐

素材:02_素材整理/2026-09-21新增/08_60种角色动作提示词.txt 与 6.11 的分工:6.11 = 打斗/动作戏(强冲突);6.14 = 日常/情感表演动作(所有戏都在用)。

动作 5 段拆解(动作不是一个词,是一段表演): 起始状态 + 触发原因 + 动作过程 + 结束状态 + 情绪目的 (+镜头配合)

例:黑衣少年站在雨夜旧宅门前(起始),听到屋内脚步声(触发),扶门框的手慢慢收紧后缓慢推开木门(过程),停在门口没有立刻进入(结束),眼神从犹豫变成警觉(情绪),镜头从中景缓慢推近(配合)。

60 条动作库(6 大类)

类别 代表 戏点
基础身体(10) 缓慢回头/低头沉默/后退半步/攥紧拳头/松开手指 微小动作=内心活动
情绪动作(10) 强忍眼泪/压住怒气/犹豫伸手/冷笑转身/失神坐下 把内心变化变成可见动作
互动动作(10) 拉住手腕/护在身前/递出旧物/擦肩而过/轻轻推开手 关系张力在接触与不接触之间
行走追逐打斗(10) 雨中奔跑/翻身躲开/拔剑出鞘/跌倒爬起 节奏提速
道具动作(10) 捡起玉佩/打开旧信/点亮油灯/倒茶停住 动作连线索(道具=剧情钩子)
高频组合(10) 雨夜追逐/发现真相/决裂转身/英雄救场/重逢拥抱 直接进分镜

铁律:一镜一主动作(禁止又奔跑又拔剑又拥抱);写起始状态(回头前是背对还是低头,结果完全不同);别忽略手部(攥紧/悬空/松开比大动作有戏);动作情绪不分家(同是奔跑:逃命/寻找/愤怒状态不同)。 自检:删掉台词后,观众能否从身体看出人物在经历什么?

6.15 【运镜即用库】40 种运镜提示词 ⭐

素材:02_素材整理/2026-09-21新增/12_40种运镜提示词.txt 三层体系:6.4 名词层(认识运镜)→ 6.15 即用层(复制改角色) → 6.12 参数层(精细控制防翻车)。

运镜公式角色设定 + 场景 + 主体动作 + 景别 + 运镜方向 + 速度 + 情绪目的(一条镜头只选一种主运镜)

40 条运镜库(5 类):推拉(8:缓慢推近/压迫式变焦/背影推到侧脸…)、横移摇镜(8:平移揭示/门缝横移/甩镜转场…)、跟拍运动(8:背后跟拍/低机位跟拍/手持轻晃/从脚步跟到脸…)、环绕角度(8:半环绕/双人环绕/过肩对峙/主观视角/虚焦转实焦…)、高频组合(8:雨夜追逐/突然回头/反派登场/真相揭露/决战前环绕…)。 情绪→运镜映射:压迫=推近低角度 / 孤独=缓慢拉远 / 悬念=横移揭示 / 慌乱=手持轻晃 / 关系张力=双人环绕/过肩。 铁律:别全片都推近(不同镜头不同任务);运镜必须跟人物动作走;忽略景别=白运镜(远景管空间/近景管情绪/特写管反应)。

6.17 【多集工程 & 分镜字段规范】标准化分镜脚本 + 资产库 + 批量容错 🆕

源自 飞书×OpenClaw 自动化生产专文 / CSDN 分镜工具文(素材 19)。面向多集/系列化生产:把「分镜」做成可表格化、可程序化的中间层。

① 标准化分镜脚本固定字段(13 项)(多集批量生产的通用骨架):

字段 说明 示例
集数 第几集 EP01
镜头号 镜头编号 S01
时长建议 预计视频时长 3-5 秒
场景 空间与氛围 深夜办公室,冷色灯光
角色 出现角色 女主、反派
景别 远/中/近/特写 女主手部特写
画面描述 画面发生什么 女主攥紧文件,手指发抖
动作 角色动作 抬头、后退、冲入
情绪 人物情绪 震惊、愤怒、压抑
对白/旁白 需保留台词 「你一直在骗我?」
出图提示词 生成分镜图 画面 prompt
图生视频提示词 生成动态片段 镜头运动 + 动作 prompt
质检标准 如何判断可用 人物一致、场景一致、动作合理

字段固定的意义:这张表是后续自动化工作流的核心数据源(可被脚本逐行读取、批量出图)。模板见 工具箱.md 模板⑳。

② 资产库四类(多集稳定生产的前提,配合 ③.6 / ③.7):

  • 角色资产:姓名/年龄/外貌/服装/发型/表情特征/参考图 → 人物一致
  • 场景资产:名称/空间结构/光线/色调/道具 → 环境一致
  • 风格资产:画风/镜头语言/色彩/质感/构图偏好 → 视觉统一
  • 提示词资产:正向/负向提示词/镜头运动/动作描述 → 生成稳定

③ 逐镜质检清单(生成后逐镜过,配合 6.7 七律 / 7.2b 音画同步): 变脸?· 服装变化?· 场景跳变?· 动作符合分镜?· 镜头过度夸张?· 多手/畸形/错位?· 情绪与剧情一致?

④ 三种分镜工具定位(按产能阶段选):全链路型(蛙蛙写作 / 纳米流水线:工作流串联、前序结果自动引用)/ 画面质感型(Runway Gen-4:4K 光影细腻,但缺工作流、长文本弱、一致性靠调提示词)/ 动态效果型(Pika:动作与衣摆发丝自然,但无工作流、分镜弱)。


6.16 【质感词库】2026 高级质感词:告别"电影感" ⭐

素材:02_素材整理/2026-09-21新增/10_2026高级质感词.txt 定位:6.5 定画风类型;6.16 定画面质感——"电影感"已烂大街,2026 拉开差距的是把抽象风格拆成可执行画面语言。

核心原则:"电影感"是结果不是指令。普通人写形容词,高手写画面结构:光源性质 + 材质细节 + 空气介质 + 色彩倾向 + 镜头特征

10 类质感词(按题材选)

质感 适用题材 代表词
胶片 复古/年代/人文 35mm胶片颗粒、低对比暖色、轻微曝光不均、手持纪录片影像
湿润 雨夜/悬疑/赛博 雨后反光路面、霓虹倒影、玻璃雨痕、冷青色湿冷氛围
空气感 治愈/清晨/梦境 清晨薄雾、逆光尘埃颗粒、柔和体积光、远景轻微雾化
皮肤 人物特写/情绪戏 真实皮肤纹理、自然毛孔、不过度磨皮、眼神湿润感
金属 科幻/机甲 拉丝金属、边缘高光锐利、磨损痕迹、微弱蓝色反射光
粗粝 废土/战争/纪实 高颗粒噪点、低饱和灰黄、尘土弥漫、手持晃动
柔雾 爱情/女性向 高光泛白、粉白色调、逆光发丝光、边缘柔焦
高级灰 商业/品牌片 低饱和、浅灰蓝倾向、干净留白、克制视觉表达
微距材质 产品/细节 极浅景深、材质纹理放大、焦点呼吸感
真实纪录 纪实/vlog 自然光、轻微失焦、抓拍感、生活化噪点

写法对照:❌"雨夜街头,电影感,超清" → ✅"雨夜街头,湿润柏油路反射蓝紫霓虹,空气细密雨雾,远处车灯柔和散景,侧后冷色轮廓光勾脸,背后低角度缓慢跟拍,冷青孤独都市夜质感"。 铁律:质感词服务题材(别给治愈片加粗粝);一条提示词一种主质感;高级=具体(说清哪种光/哪种材质/什么空气)。


⑦ 视频生成(即梦 / 可灵)

  • 输入:⑥ 镜头提示词 + 人物参考 + 场景参考 + 道具参考 + 参考声音
  • 输出:视频片段(逐镜生成)

关键方法(来自《制作注意事项》):

  • 只有 单帧首尾帧 两种方法;不用多帧、不用中间帧
  • 例:机器人爆炸镜头 → 用好的机器人输入爆炸提示词直接生成爆炸效果,而非先生成爆炸图再转视频
  • 视频口型(即梦/可灵):说"XXXXXX"
  • 首尾帧:必须写明过渡效果(如 <人物变身>出现一道金光伴随烟雾过渡到尾帧),或合适的镜头移动

7.1 【方言配音】AI 配音控制词典(50 套 + Seedance2.5 版)⭐

素材:02_素材整理/2026-09-21新增/04_全国50套方言AI配音控制词典.txt05_方言AI配音控制词典_Seedance2.5.txt

用途:需要方言台词/配音时的控制词典。两份内容互补——#04 覆盖 50 个地区(更全)#05 面向 Seedance 2.5(含总控规则,更细)

⚠️ 重复说明:#05 的前 34 条与 #04 的前 34 条地区完全重合(北京→西宁)。同一地区优先用 #05(描写更细);#04 独有的 16 个地区(锦州/汕潮/温州/黄山/闽南/苏州/宁波/泉州/雷州/柳州/天水/大同/漳州/文昌/湘西/大理)只能用 #04。

统一结构:地区 → 方言 → 核心发音 → 声调 → 节奏 → 语气 → 口语特征 → 执行要求。

总控 12 条(两份共同红线,直接沿用)

  1. 优先保证地域听感,其次保证台词清晰度。
  2. 人物必须像当地年轻人真实聊天,不像演员表演方言。
  3. 方言不能为了突出地域感而故意拖音、夸张变调。
  4. 禁止普通话播音腔、新闻腔、广告腔、舞台腔。
  5. 禁止混相邻地区口音(西安≠兰州、成都≠重庆、广州≠港台)。
  6. 同地区不同人物可有轻微个体差异,核心地域听感必须稳定。
  7. 年轻人物优先现代城市年轻人口吻,避免老年人语气。
  8. 完整方言保真实音系;“本地普通话”以清晰度为基础叠加轻微地域特征。
  9. 台词与人物口型严格同步(发音/停顿/重音与动作自然对应)。
  10. 禁止 AI 合成音的机械感、字字分离、过度标准化和情绪断层。
  11. 旅游类视频不能读成导游播报,要像当地人生活里自然说出。
  12. 方言强度默认“明显能听出地域、但不影响理解”;用户指定“纯方言”再提高。

完整 50 套原文见 02_素材整理/2026-09-21新增/04_...txt(50 地区)与 05_...txt(34 地区 + 总控)。


7.2 【声音一致性】角色声音资产体系(跨集不变声)⭐

素材:02_素材整理/2026-09-21新增/11_短剧声音一致性指南.txt 定位:画面一致性的姊妹篇——上一段是少年下一段变成熟男声,比画面穿帮更让观众出戏。

声音一致性三层面:音色(声纹指纹)+ 风格(语速/停顿/重音/情感基调/能量)+ 区分度(角色间辨识度)。

方法一:从满意视频「抢救」声音(实战最高效):

  1. 偶然抽到符合角色的声音 → 剪辑软件「音频分离」→ 人声分离(去BGM音效)
  2. 截取最清晰的 3-5 秒短句(短而精 > 长而杂)作「声纹锚点」
  3. 后续所有片段生成时上传该参考音频 + 绑定角色参考图

方法二:从零设计专属音色(不是抽卡是设计):

角色类型 音色 语速 情感基调 记忆点
少年/儿童 清凉明亮 偏快 轻快活泼 尾音上扬
青年男性 清朗干净 中等 自信有力 咬字清晰
成熟女性 温柔圆润 中偏慢 温暖包裹感 气息感强
老年 低沉略沙哑 偏慢 沉稳沧桑 停顿较多
反派 冷静克制 偏慢 压迫危险 语调平稳少起伏
搞笑 夸张多变 偏快 跳脱不正经 语气词多

多人对话铁律(一人一音):每角色独立参考音频;对白前标角色名 + @音频N + (语气:xx):

男主(@音频1)站在门口,表情严肃:"把宝物交出来。"(语气:冷静、克制)
女主(@音频2)后退一步,声音颤抖:"什么宝物?我不知道。"(语气:害怕、紧张)

区分度检测:闭眼听一遍,仅凭声音能否分辨谁在说话?不行就回去拉大音色差异。

声音资产卡(每角色一张,跨集复用):角色名/类型/音色描述/参考音频文件/语速(字/分)/音调/默认情感/可变范围/版本号/变更日志。版本管理:v1.0 初始 → v1.1 微调语速 → v2.0 角色黑化变低沉。

翻车对照:同角色变声=没用声纹参考 / 多人串音=没标@音频 / 跨集变声=资产不统一 / 口型对不上=音频视频帧率不对齐+说话镜头保持正面或小侧面 / 情绪激动失真=文字描述情绪别靠AI发挥 / 跨语言不像=相似度只有60-70%需分语言备参考。

7.2b 【音画同步 · 音频工具链】口型同出与音乐生成 🆕

源自 2026 工具链专文(素材 17)。与 7.2「声音一致性」互补:7.2 管跨集不变声,本节管口型同步 + 配乐生成

音画同步(口型终极方案)

  • SkyReels-V4(昆仑万维,对称双流 MMDiT):视频分支「看」音频、音频分支「听」视频,在生成基座层绑定 → 毫秒级对口型,连呼吸频率都与语调起伏匹配,彻底解决音画分离/口型错位。
  • Vidu Q3(生数科技「参考生视频」):音画同出(视频与音频同步生成,支持中/英/日多语),多主体参考 + 场景特效复刻(可用指令改写参考视频中的物体材质而不重生成整个场景)。
  • 传统流程是「先生视频 → 再用口型软件对齐」(易僵硬/不同步),能一步同出则优先同出。

配音工具按需求选:ElevenLabs v3(情感控制头部,1 分钟样音克隆含呼吸/停顿)/ Fish Audio(出海跨语言一致:中文样音训 → 角色说地道日/英语且保留音色情感;表情标签(兴奋)(低落))/ 火山引擎(中文语境 + 大规模并发,适合互动短剧/长篇连载)。

背景音乐生成

  • Suno v4:风格遵循度高,Studio 编辑器支持曲式结构定制。示例提示词:「古风武侠战斗曲,唢呐为主,节奏先缓后急,2 分 30 秒处有高潮」。
  • Minimax Music-2.0:1 万免费积分,人声分离 + 克隆,风格混合生成。
  • 环境音:剪映专业版音效库自动匹配(见 ⑧)。

7.4 【批量生成与容错】多集生产的工程化能力 🆕

源自 飞书×OpenClaw 自动化生产专文(素材 19)。单集能出不难,多集稳定、可续跑才是工业化门槛。

生产级脚本 6 项能力

能力 解决什么问题 具体表现
多集处理 一次处理多集分镜 支持 EP01/EP02/EP03 批量生成
断点续传 中途失败不用从头跑 已完成镜头自动跳过
失败重试 降低 API 波动影响 自动重试 N 次并记录原因
进度通知 不用人工盯 生成完成后推送通知
结果质检 判断画面是否可用 见 6.17 逐镜质检清单
失败日志 避免重复踩坑 记录失败原因

零基础耗时参考(单集):脚本 10-20min → 分镜 15-30min → 画面 20-40min → 动态 15-30min → 音频 10-20min → 合成 20-30min;熟练后 30-40 分钟/集,模板化后可日更。节奏基准:单集 3 分钟内、每镜 3-8 秒。

一致性小贴士:用角色锁定/角色种子固定面部与服饰;同一角色尽量同一套提示词,避免频繁更换模型(配合 ③.6.1 / 7.2)。

提示词三件套( 出图):角色特征 + 场景 + 风格 + 画质;图生视频用首尾帧约束保转场流畅(配合 6.10 承接上镜)。


7.3 【配音情绪控制】标点符号=TTS 的情绪遥控器 ⭐

素材:02_素材整理/2026-09-21新增/14_配音情绪控制指南.txt 与 7.1 的分工:7.1 方言词典管「口音地域感」;7.3 管「情绪演技」。配音像机器人的根源:标点乱写——TTS 读文案时标点就是指挥棒。

停顿层级表

标点 停顿 效果
顿号、 几乎一点就过 轻快利落
逗号, 0.3-0.5s 自然呼吸
分号; 比逗号长 层次感
句号。 0.6s+ 语义结束
换行 最强断句 情绪转折/重置

符号情绪用法

  • 省略号…… = 尾音拖长 → 犹豫/不舍/悬念("别走。"=决断 vs "别走……"=挽留)
  • ?=句尾升调;!=力度加重;?!=又惊又疑;……!=犹豫后爆发
  • !的上限是 3 个(1个轻微提升/3个激动/5个+过度夸张)
  • 圆括号()= 气声耳语级 → 内心独白/悄悄话
  • 破折号—— = 微停顿+音调微变 → 一句完成情绪反转("我一直在等你——但你从来没来过")
  • 方括号[] = 不发音的导演指令:[停顿一秒] [深吸一口气] [声音突然变小]
  • 直接写情绪方向:低声:/哽咽:/强忍着眼泪笑出来:(可与符号叠加)

研究背书:停顿是情感主要载体——语速+停顿完整时 AI 语音情感感知达人类 82%,只留音调则 <50%。

角色状态公式状态提示词 + 标点控制(刚睡醒=沙哑慢速+逗号拉长呼吸 / 醉酒=咬字模糊+省略号不规则断句 / 紧张=语速加快+破折号模拟卡壳)

一句话情绪渐变:前半句温柔参数(语速85%,音高+0.5) → 转折处插 0.5s 停顿 → 后半句切愤怒参数(语速125%,音高+2.5)。60% 配音「不像人」是因为从头到尾一个调子——塞入两处情绪变化听感质变。

对口型三要素:嘴巴在画面可见(中近景,远景口型无意义)/ 语速别过快(提示词写「语速偏慢」)/ 单段对白 ≤15 秒(长了拆段生成再拼接)。

7.5 【视频生成 Pipeline】四种无人值守方案的部署与避坑 🆕

源自 腾讯云《部署并搭建视频生成 Pipeline:从零到一,让 AI 替你自动出片》(素材 28)。适用:要「输入主题/剧本 → 自动出片」的批量或无人值守生产;单集可压到 30 分钟级。

四种 Pipeline 方案

方案 难度 部署 适合
MoneyPrinterTurbo 15min 只需主题 → 自动脚本/素材/配音/合成
narrator-ai-cli + Skill ★★ 30min 开发者/AI Agent 集成(40+ 原子接口,Markdown Skill 自然语言驱动)
n8n + ComfyUI + MCP ★★★ 1-2h 团队协作、可复用可视化模板
编排层 + 漫剧 Skill ★★ 30min 批量生产漫剧/解说

n8n 节点串法Webhook 触发 → HTTP Request 调 LLM 出文案 → Code 节点解析生成分镜 → HTTP Request 调 ComfyUI API 出图/出视频 → Execute Command 调 FFmpeg 合成 → Email/Webhook 回传成品

MCP(Model Context Protocol):统一 AI 服务调用协议,把 ComfyUI / 大模型 / TTS 等能力标准化暴露给编排层,是「零代码接工具」的关键粘合层。

避坑三坑:① 显存不足 OOM → 量化模型 + 降分辨率/批量;② FFmpeg 找不到 → 加 PATH 或用绝对路径;③ 素材 API 返回空 → 换素材源/加兜底。

完整方法见 02_素材整理/2026-09-21新增/28_零代码智能体编排与视频Pipeline(自动巡检).txt


⑧ 剪映合成

  • 输入:⑦ 的所有视频片段
  • 工具:剪映
  • 输出:成片

剪辑要点(来自《制作注意事项》):

  • 首尾帧生成的视频到尾帧会静止。想让尾帧动 → 再生成一个尾帧图片的单帧视频,然后剪辑衔接
    • 例:三体中镜头绕老兵旋转一周 → 接瞄准镜单帧视频里的机器人走动
  • 丰富的音效与音乐之间的衔接过渡

8.1 成片导出规格(竖屏发布标准)

源自 CSDN《仿真人短剧保姆级教程》《GitHub 全流程调研》,补齐原流程未覆盖的导出参数。

参数
容器格式 MP4
分辨率 1080×1920(竖屏)
帧率 30 fps
码率 8000–10000 kbps

发布策略:晚 7-10 点或周末中午发布;标题用「悬念 + 情绪 + 身份」公式。

导出规格为成片技术标准发到哪个平台、怎么分账、怎么变现 → 见 ⑨ 发行与变现

8.2 转场衔接(跨镜过渡三法)🆕

源自 北航《爆款AI漫剧教学手册》(素材 22)。补齐 ⑧ 此前只在 ② 导演规划「场间过渡」中零星提及的剪映合成阶段跨镜过渡

技巧 做法 适用
首尾帧补间 上传前后场景图(首帧/尾帧),AI 生成自然过渡(可灵 AI 强项) 场景硬切换(如办公室 → 校园)
运镜驱动 用「推进 + 环绕」运镜隐藏剪辑点 同场景内的时空推进
元素关联 借共同视觉元素过渡(文件从 A 镜延续到新场景) 跨场景的内容连贯

原文标称「5 种万能过渡技巧」,可见 3 种核心;其余与知识库已有的硬切 / 动作衔接 / 空镜 / 淡入淡出(见 ② 导演规划「场间过渡」)互补。默认仍硬切,仅在必要时用上述补间。

8.3 后期打磨(节奏 · 高光 · 字幕)🆕

源自 北航《爆款AI漫剧教学手册》(素材 22)。成片观感的三处「加分项」。

  • 节奏卡点(快剪处理):冲突场景用短镜头 2-3 秒/个,抒情场景用长镜头 4-6 秒/个(与 6.8 时长预算、6.17 时长字段配合)。
  • 高光定格:反转/爆点时刻加 0.5 秒定格 + 文字特效(如「真相竟然是?」)。
  • 字幕设计:字体统一(黑体 / 思源黑体);颜色对比强(白字幕 + 黑描边);关键台词放大突出。
  • 标签搭配#AI漫剧 #原创剧情 #短视频爆款 + 垂直领域标签(如 #职场日常 #校园故事)。
  • 画质统一:帧率 30 fps 全局一致;分辨率参照 8.1 竖屏标准(原文建议 2K,本流程按发布平台取 1080×1920)。

⚠️ 一致性提示:转场用「首尾帧补间」时,首/尾帧务必来自同一角色设定与场景母版,否则补间会放大不一致(配合 ③.6 角色卡 / 6.10 承接上镜)。

8.4 声音设计(配乐 · 音效 · 混音)🆕

源自 骆驼AI学社《音乐骤停让情绪炸裂》(素材 23)+ SunoMV《电影感配乐 7 步法》(素材 24)+ 画音社《音效后期流程》。补齐 ⑧ 此前**音频侧仅剩一句「音效音乐要丰富过渡」**的空白。

音乐骤停(短剧网感第一狠招)

  • 用途:解决「画面漂亮但剪出来平、拖、没劲」——缺节奏。
  • 找爆点:台词关键信息 / 关键动作 / 推动剧情的道具(没爆点硬停 = 尴尬)。
  • 三大时机高潮 / 反转 / 重点(缺一不算最佳)。
  • 操作:在关键词出口后、下一句爆发前那半拍呼吸间BGM 直接切掉(非淡出) + 叠一个低频「咚」;骤停环节用固定镜头(摇移会分散爆发力)。
  • 按类型选:喜剧反差 / 信息强调 / 悬念营造 / 高光展示。

配乐 7 步法(电影感的来源不是「高级音色」,而是动机连贯 + 动态克制 + 配器留白):

  1. 主题动机:整片只有一个 3-5 音符动机,反复变奏(观众音乐工作记忆约 3-5 音符)。一次生成「原型 + 3 变奏」。
  2. 情绪曲线:先拉画面,每 30 秒标一个情绪值(-5 ~ +5) → 即「音乐分镜(music breakdown)」。
  3. 动态布局:ppp 30% / mp-mf 50% / ff 仅 5-10% / 过渡 10-15%;ff 只给 1-2 个高潮,不平均铺。
  4. 配器留白:Intimate 钢琴+大提琴 / Cinematic 弦乐+法国号 / Epic 全管弦+合唱+打击 / Hybrid 弦乐+合成器;prompt 务必标 include rests
  5. 流程:主题先行、cue 后填(Day1 主题歌 → Day2 6-8 个 cue → Day3 过渡+混音+对位)。
  6. 混音规范:人声 -16 LUFS;配乐(有人声段)-28 LUFS 且削 200-500Hz 5dB 给人声让路;配乐(无人声段)-18 LUFS;真峰 -1 dBTP。(工具见 7.2b:Suno v4 / Minimax Music-2.0)
  7. 成片对位:A 节拍对位(cut on beat)/ B 情绪对位 / C 动作对位(Mickey-mousing)。

音效后期四步(画音社 · Studio One 8):音轨分离整理 → 音效重建 → 音效检查 → 音效层次优化。

三层混音最佳实践对白最清晰、配乐其次、音效最低(示例:对白 100 / 配乐 40 / 音效 60);音效可按时间轴分段配置(每段起止 + 描述)。

与 7.3 配音情绪控制互补:7.3 管「配音像不像人」,本节管「成片听感有没有劲」。

8.5 画幅适配与多平台发布 🆕

源自 新浪《AI漫剧横屏格式会一直持续下去吗?》(素材 24)+ 有戏AI 多格式成片实践。与 8.1 竖屏导出标准互补:8.1 定竖屏参数,本节补横屏 + 一套素材多用

画幅 尺寸 平台 特点
竖屏 9:16 1080×1920 抖音 / 快手 / 红果 流水线爽漫主流;多特写、背景少;单集 2-5 分钟
横屏 16:9 1920×1080 B站 / 腾讯 / 爱奇艺 / YouTube 算力效率最高、人眼视野偏好、后期天然适配;精品化中长剧方向
  • 横屏为何是算力最优:主流视频模型训练多用横向素材,16:9 输出效率最高、失真最少;竖屏裁切横向像素,单位面积细节精度下降。
  • 行业趋势:竖屏爽漫陷投流内卷(2026 上半年上新 22 万部、千次播放收益 60→15 元);横屏中长剧成新方向(腾讯《北派笔记》、爱奇艺首部获发行许可 AI 网络故事片)。
  • 一套素材多用(跨平台)
    • 安全区间构图法:主体锚定在中央安全区、四周留余量 → 同一构图可裁出 9:16 与 16:9,字幕/关键元素不越界。
    • 导出两版:竖屏 1080×1920(→ 8.1)、横屏 1920×1080(帧率/码率一致)。
    • 部分一站式平台支持上传长剧本后直接生成「抖音竖屏 / B站横屏」多格式成片。

画幅选型服务发行策略 → 见 ⑨ 发行与变现


⑨ 发行与变现(可选 · 出片之后)🆕

源自 AIGC SDM 分账攻略 / 腾讯新闻 / 浙江日报一线报道等(原文见 01_原始素材/2026-09-21新增/20_2026AI漫剧平台分账与变现发行全景.md)。发行运营参考,非制作流程强制;平台政策高频变动,以官方最新公告为准。

  • 输入:⑧ 成片
  • 输出:上线发布 + 分账/变现 + 数据迭代

9.1 平台分账速查(截至 2026-05,⚠️以官方最新为准)

平台 分成比例 保底 / 奖励 适配
抖音(星光/辰星) 优质 90%-95% 付费净收益 S+ 保底 75 万(≈5000 元/分);超头部 3 万/分、单部最高 360 万 男频玄幻/都市,流量天花板
快手(星芒创想) 90% 广告+付费;出海 ≤91% S+ 75 万保底;爆款最高 70 万买断 下沉市场、家庭伦理/逆袭
B站(漫剧觉醒) 分账 ≤80%;广告 ≤90% 30%-100% 成本补贴 + 30%-100% 稿酬保底 二次元/原创 IP
微信视频号 90%-95%;联合发行 ≤110%、爆款 135% 单条 3000-8000 元;系列爆款 ≤100 万 私域、情感/家庭/女频
爱奇艺(漫剧专项) 独家首发 ≤100%;非独家非首发 50% 单部 ≤5 万剧本费 精品长漫 5-20 分钟
腾讯视频(火龙) S+/S 独家 85%、非独家 80%;A 级 80%/70% 稀缺精品 ≤100 万;番茄 IP 爆款 +50 万(独家系数曾达 200% 二次元/国漫/IP 向
百度(星跃+成帧奖) 独家 70%、非独家 50% 成帧奖 ≤10 万;专项补贴 40 万 男频爽文
阅文(创作合伙人) 基础 70% + 衍生分成 亿元基金、单项目千万级保底 网文 IP 改编

分账系数(抖音口径):仿真人 60× / 3D 50× / 2D 40× / 沙雕 10× / 静态 1× → 仿真人/3D 优先,静态漫几乎无分账价值。

9.2 平台选型决策表(按团队档位)

档位 首选 备选 策略要点
零基础个人 即梦 AI + 剪映 来画 AI / 漫小芽 免费 IP 改编;单集 3-5 分钟;每周更 3-5 集
单人长期连载 漫映 AI / 扣子 APP + 即梦 角色不崩;韩漫风;项目管理
男频玄幻/打斗 海螺 AI + 可灵 AI 增加画面动态
小工作室(2-4 人) 扣子 APP + 即梦 漫映 AI 稳定日更;单集成本可压至 20-40 元
免费长期创作 ComfyUI(Flux + IP-Adapter FaceID + ControlNet) A1111 SD WebUI 需中高配电脑、上手陡
MCN 工业量产 纳米大片流水线 / AniShort 百集批量、多集并行
出海 TikTok AI 译配 + 海外专项扶持 一次生产、全球本土化再生产(详见附I)

选型硬标准(漫剧核心痛点):跨镜头不变脸 / 剧本自动拆分镜 / 9:16 竖屏 / 中文语境 / 低成本日更。

9.3 变现路径与免费 IP 库

  • 变现四层:①广告分成+付费解锁(基础,拼完播率)→ ②品牌商单/定制(300 元-8 万;「内容即广告」)→ ③IP 授权衍生(周边/小游戏/授权)→ ④出海(东南亚供给不足,海外分成最高 91%)。
  • 三大免费 IP 库:抖音系番茄小说(6 万+,免费改编+50% 补贴)/ 腾讯系阅文(3D/古风)/ 百度系七猫(男频爽文)。
  • IP 筛选:付费榜 TOP50 / 完读率 >70% / 章节 >100 / 角色鲜明。

9.4 投流经济学与爆款率(⚠️ 数据口径差异,引用须标来源)

  • 市场:2025 中国 AI 漫剧 168 亿 → 2026 上半年 >220 亿,全年预期冲 400 亿(+138%);用户 1.2 亿→6 亿。
  • 爆款率:2026 上半年新增 22.19 万部,破亿仅 1055 部 = 0.47%;Q1 以 95% 产量只换 4% 播放。(另有 0.16% / 0.117% 等口径,须标注来源
  • 投流:日均消耗 1.5-1.7 亿元;大量普通项目 ROI <0.8。核心矛盾 = 制作端 AI 降本,但买量成本刚性甚至上涨 → 剪刀差。
  • 成本结构:算力 30%-40% / 人力 40%-50% / 剧本 10%-15%;2D ~1000 元/分、3D 2000-2500 元/分、仿真人精品 3000 元/分。
  • 本质:AI 漫剧 = 传统流量采买逻辑(收益 = 投资 × 爆款概率 × 爆款收益率);渠道集中 → 内容方议价弱。

9.5 上线前自检(发行侧)

  • [ ] 选平台与目标受众匹配(见 9.2)
  • [ ] 免费 IP 改编已获授权(避免侵权红线,见 2.3 / 附F)
  • [ ] 已备案 + 持证 + AI 标注(见 2.3 / 附F;先合规后上线
  • [ ] 开场 3 秒强钩子 + 每 30 秒一个反转(拉完播率 → 决定算法推荐)
  • [ ] 单集时长与平台匹配(竖屏漫剧 3-5 分钟;前 5-10 集免费引流)
  • [ ] 算力/投流预算已核算,避免「制作降本、买量烧钱」剪刀差
  • [ ] 发布前质检(七步法收口):完整看一遍导出文件 → 黑帧 / 口型 / 字幕在移动端安全区 / 音量 / 品牌露出 / 素材授权 / 平台规则(源自 aigc 七步流程,见 附J)

9.6 一线经验红线(浙江日报采访 · 温梦卜动漫)

  • 镜头语言思维:把提示词写成「记叙文」→ AI 给出荒诞机位(如把游戏画面贴到手机背面)。正解 = 拆解镜头(中景交代人物+动作,切镜头切到关键细节特写)。
  • 资产管理:一部精良漫剧光人物+场景设定就几百个,道具(手表/刀)都要单独做资产;前期美术规范有漏洞 → 后期生成连锁反应、修改成本巨大
  • 人机协同节奏:生成 → 筛选 → 修改 → 剪辑 → 按需补生成;素材按「可用/待修/废镜头」分类;等生成的间隙切剪辑(双线操作)。
  • ⚠️ 心态:AI 让一部分工作变快,但没让创作变简单;纯靠 AI「机跑」废镜头多、逻辑连贯性差;对审美(美术/影视/传媒基础)要求高。

9.7 发布首屏:封面 · 标题 · 追更 🆕

源自塔猴钩子文 + 小云雀连载观察(素材 27)。发布运营参考;封面/标题直接决定点击率(CTR)。

  • 封面:直接复用开场 3 秒最强一帧(情绪峰值 / 奇观画面 / 反差构图),不另起炉灶;主体居中或三分法、人脸/情绪特写优先(竖屏 9:16 留足文字安全区,见 8.5);主文案 ≤8 字、强对比色 + 描边(同 8.3 字幕规范);封面文字必须与内容一致(挂羊头卖狗肉 → 高跳出);连载保持统一模板/角标便于识别追更。⚠️ 封面须叠加 AI 标注(见 2.3 / 附F)。
  • 标题公式:沿用 8.1「悬念 + 情绪 + 身份」。
  • 追更钩子:单集结尾留钩子、中段张力层层加码(呼应 ①.2 钩子与 8.3 节奏卡点)。
  • 连载运营(小云雀观察):一部片子爆了之后想接着做,撞上的全是流程问题——角色跨集一致 / 世界观延续 / 多人同项目并行 / 成片接续可剪;工具普及、门槛降低后,稀缺的是创作者的审美判断 + 能一季一季接着开发的角色/世界观资产(呼应 ③.7、9.3)。

附A:工具清单(02_素材整理/软件清单.txt

文本/提示词生成:豆包、Gemini、ChatGPT、DeepSeek 出图/出视频:即梦、Midjourney、Nano Banana、VEO3、Wan、Lovart、Tapnow、可灵AI、海螺AI 音频:Nicevoice(配音) 剪辑:剪映 资源站:https://www.aiwind.org/

本地/离线工具链(8G 显存可跑,免 API / 无水印 / 不限次):Ollama+Qwen(写分镜)→ ComfyUI(绘图+图生视频)→ LTX2.3(微动)→ Qwen3-TTS(配音)→ FFmpeg(合成)。详见 附G开源项目生态:waoowaoo / Huobao Drama / 魔因漫创 / DirectorAI / 智剧通。详见 附H编排/自动化(智能体工作流):Dify / n8n / MCP(统一调用协议)/ MoneyPrinterTurbo / narrator-ai-cli + FFmpeg 合成。详见 附J


附B:制作注意事项(原文 02_素材整理/制作注意事项.txt

优先级高于理论流程,制作时以本节为准。

准备阶段:脚本/分镜只是思路;先评估难易度与是否想要;自主创作可随时改。

角色设定:先找参考 → 提示词反推 → 先面部 → 以面部为参考做全身像 → 三视图(白底)。

分镜(图片):熟练使用参考图 + 九宫格生成法 + 各种景别提示词。

视频生成:单帧/首尾帧;不用多帧与中间帧;首尾帧必写过渡效果。

剪辑:尾帧静止 → 补一张尾帧图的单帧视频衔接;音效音乐要丰富过渡。


附C:GitHub 调研与流程优化

调研了 GitHub 主流漫剧/短剧生成项目,提取可落地做法。详细报告见 R1_调研总览

重点参考项目:

  • YvonneMovingon/short-drama-skills(LuxReal 实战验证):叙事拆解原则、分镜时长估算、长台词切分、Clips→Shots 聚合 → 已并入 6.6 节
  • neilalexanderlee/ai-comic-studio:分镜督导批量重写、首尾帧三层决策、视频提示词直出、镜头衔接传尾帧、角色四视图
  • wzY-toRitchie/ai-comic-script-generator:4.5 步工作流、角色设定卡、标准母图 → 已并入 ③.6 节
  • Dapeng960208/AI-Comic-Generator:角色一致性(图生图参考 + 合并去重)、上下文感知分镜
  • murongg/openframe:人物关系图谱、FCPXML/EDL 导出

已落地的优化:

  • ⑥ 新增 6.6 节:全局节奏控制 / 分镜拆分原则 / 视觉转化五大铁律 / 视觉描述四维度 / 分镜时长估算公式 / 首尾帧三层决策
  • ③ 新增 ③.6 节:角色设定卡「固定不变区」/ 标准母图 / 一致性机制 / 视觉连续性审核
  • 建议新增全局机制:角色档案(Character Bible)视觉连续性审核情绪曲线管理时长预算表参考素材库

附D:提示词模板库与自检清单

完整的可复制填空模板制作自检清单、速查表、时长公式见: 工具箱.md

包含:

  • 模板 ① 爆款改文 ② 台词分幕 ③ 人物四风格 ④ 三视图 ⑤ 表情矩阵 ⑥ 场景 ⑦ 分镜 ⑧ 角色设定卡
  • 每环节制作自检清单(勾选项;含 合规前置清单 → 模板⑲;含 发行/变现自检 → 模板㉒)
  • 发行侧速查:模板㉑ 平台选型决策表(按团队档位)/ 模板㉒ 发行变现自检清单 → 对应主流程 ⑨
  • 景别/视角/运镜/情绪 速查表
  • 时长估算公式、视觉连续性五大铁律、禁止词速查

附E:2026 漫剧产业与工具链(速查)

源自 2026 AI 漫剧趋势报告 / 春节档产业分析 / CSDN 教程 / 七牛云方案(原文见 02_素材整理/2026-09-21新增/15_2026漫剧产业工具链与行业趋势.txt)。产业参考,非流程强制

市场:2025 中国 AI 漫剧市场 168–189.8 亿元(同比 +276.3%),用户破 1.2 亿;单分钟成本 <800-1000 元,百集成本可 <15 万。形态:AI 仿真人漫占百强榜近 60%,成主流。

2026 五大趋势:①精品化(回归视听语言/叙事节奏)②工业化+产业链细分(代工厂/发行机构)③创作定位差异化(重工业团队 vs 微工作室)④告别单一模型依赖(自部署开源模型 + 垂类插件)⑤平台补贴退潮、转向效果导向。 工具链速查(含费用):剧本 Claude/GPT/DeepSeek(免费额度)→ 角色 Midjourney/即梦(¥68/月)→ 图生视频 可灵 2.0/即梦(¥99/月)→ 配音 ElevenLabs/剪映 → 剪辑 剪映/DaVinci。性价比组合全程约 ¥200/月。

平台对比:即梦(全流程轻量)/ Runway(运镜写实)/ 可灵(国风适配)/ 万兴剧厂(工业化,5 天整剧、成本降 72%)/ 巨日禄(700 元/分钟)/ 阿里 LumenX(AI 原生一站式短漫剧平台,API Key 启动,集成 10+ 模型 + CosyVoice/Qwen3-TTS 对白合成) / 纳米大片流水线(全流程效率 +10 倍)/ 七牛云 AI Canvas(多模型整合 + 智能剪辑)/ 小云雀(一站式短剧 Agent)/ 腾讯视频 WorkRally(S+ 级影视动漫技能库,穿帮检测使批量角色一致性 >95%)/ 橙星梦工厂(八大智能体协同)/ LibTV / Vidu。

量产口径(2026,素材 29):AI 漫剧=搭流水线而非写提示词;「五层架构」= 剧本结构化 → 分镜拆解 → 角色/场景资产 → 视频生成与配音 → 剪辑合成导出。360 纳米漫剧流水线素材成功率 >90%、单集 30min~1h腾讯 WorkRally 一致性 >95%、返工率 40%-50% → <10%;传统工具抽卡成功率仅 15%(催生职业「抽卡师」),工业级已达 90%+(「流水线推进 + 智能画布调整」双模式替代纯手动抽卡)。市场规模预测 243.6 亿、播放 >700 亿次、15 人 20 天做 60 集、单集成本千元级。三边界:抽卡待工程化、AI 著作权无定论、内容判断力才是长期护城河

质量红线与成本(2026-04 起):低质 AI 漫剧被平台集中下架(红果短剧一周下架 3522 部),行业从「拼速度」转「拼质量」;合规团队建专属数字资产库(单个原创虚拟人建模 5000 元 → 3 万元),精品 80 集+算力成本可 >10 万元、总成本向 30 万元级别迈进。「抽卡碰运气」的低质路线已被淘汰。

资本/模型格局:视频生成赛道 Seedance 2.0(字节)/ Sora 2(OpenAI)/ Kling 可灵 3.0(快手)「三足鼎立」;Adobe Firefly 2026 集成 Premiere,LLM 自动生成粗剪稿(粗剪省 ~80%)。

详细素材(含剧本黄金公式、分镜 7 要素、7 天排期、一致性参数、行业数据)见 15_2026漫剧产业工具链与行业趋势

2026-09 增补(工具链与工业化,素材 17)

  • 技术栈:MJ V7 Omni Reference(--cref/--cw)→ SD3.5/SDXL 开源流(IP-Adapter FaceID Plus v2 + ControlNet Reference + ADetailer)→ LoRA/Dreambooth 高精训练(详见 ③.6.1)。
  • 合规反转:网传「3人48小时做5亿播放AI短剧」已被导演澄清——3000 元仅为算力成本、团队近 20 人、所谓 80 集实为两支短片。算力成本 ≠ 总成本,团队人才与统一认知才是真成本。
  • 成本/周期:单分钟 1000-2500 元(国信测算可 <800-1000);全剧 7-14 天;《气运三角洲》75 集 3 人 5 天。
  • 剧本要求(抖音版权中心):AI 仿真人短剧不少于 70 集、字数≥7 万字(真人 80 集约 5-6 万字),且需详细场景描写(镜头语言/空间调度/动作站位/环境细节)。
  • 音频工具链:ElevenLabs v3 / Fish Audio(表情标签)/ 火山引擎;Suno v4 / Minimax Music-2.0;口型同出 SkyReels-V4、Vidu Q3(详见 7.2b)。
  • 视频生成三足鼎立(补定位):Seedance 2.0(导演之选·多模态参考/多镜头叙事)/ Sora 2(世界模拟器·物理真实)/ Kling 3.0(动作大师·人体动力学);SkyReels-V4(原生音画同步)。
  • 一站式平台:即梦 AI 工作室(智能多帧 2.0 + 画布 Agent + 分发闭环)/ 纳米漫剧流水线(360,单集 30min-1h,成功率 >90%)/ 万兴剧厂(多模集成,抽卡率 40%→80%+,总成本 -60%+)/ Adobe Firefly 2026(粗剪 -80% 时间,单帧生成补拍镜头)。
  • 两套工作流:极速流(约 1h、单人、<50 元/集)vs 精品连载流(资产库 3-5 天前置 + LoRA + 母版 + 音画同步,5-10 人 15-30 天,500-2000 元/集)。
  • 本地/离线工具链(2026-09 增补):Ollama + Qwen2.5 → ComfyUI(IP-Adapter Plus FaceID + DWpose ControlNet + LTXVideo + KJNodes + Qwen-TTS)→ FFmpeg 合成;8G 显存可跑通全流程,免 API/无水印/不限次。轻量分镜工具链亦见附G。
  • 开源项目生态waoowaoo(剧本→角色→分镜→视频全自动)等 5 个项目,详见附H;工业化一致性佐证见 ③.6.1(固定特征库 + 控制网 / AI 指挥 AI)。

附F:2026 合规监管与备案制度(速查)⚠️

源自 流媒体网 / 21经济报道 / 腾讯新闻(红果官方原文)/ 无忆研习社 / wzbj1616 平台规则汇总 / 广电总局通告(原文见 01_原始素材/2026-09-21新增/18_2026AI漫剧合规监管与备案制度.md)。合规参考,非流程强制;以官方最新公告为准

监管沿革:2024-02 分类分层+白名单 → 2025-09-01《AI生成合成内容标识办法》 → 2025-11 动画微短剧专项治理(首次纳入 AIGC)→ 2026-01-01 分级新标准 → 2026-04-01 AI 漫剧「持证上岗」(未备案存量全网下架)→ 2026-04-07 红果/抖音新规执行 → 2026-05-26 精品创作传播计划 → 2026-07-01《管理提示(AI 微短剧分类分层标准)》2026-09-01 总局令第 16 号《微短剧发展管理办法》施行(国内首部微短剧专门规章)。

三级备案(投资额 + 题材):≥300 万或敏感题材 → 总局审核发《网络剧片发行许可证》;100-300 万一般题材 → 省级广电备案;<100 万一般题材 → 平台自审 + 报省级备案。制作方须持《广播电视节目制作经营许可证》(个人签约 MCN / 挂靠持证公司)。

AI 强制标注:片头/显著位置;纯 AI「AI 生成」vs AI 辅助「AI 辅助制作」分开标注;多平台需封面+标题+片头双/三重标注(片头≥3s、字号≥画面短边 5%)。

内容六大零容忍(红果 2026-05-18):不良价值观 / 低俗擦边 / 封建迷信 / 观感不适(血腥惊悚怪异画风)/ 侵权盗版(无授权 IP·肖像·声音、AI 魔改经典)/ 未成年人有害。

版权存证:留存 AI 提示词 / 参数 / 生成日志 / 授权合同;剧本查重自检。

平台分账速览:快手(最高 90% + AIGC 创投;磁力新剧单部最高 200 万 + 1 亿流量)/ 爱奇艺(独家 100%·非独家 70% + AIGC 补贴 20%)/ 优酷(会员 70%·广告 80%)/ 多多视频(独家 75%·非独家 55%;<30 万超低成本仅免费流量)/ 红果(审核最严);腾讯火龙/B站(企业须许可证,B站个人签约 MCN)。

详细清单(时间线/分级表/红线条目/版权三踩雷/各平台规则)见 01_原始素材/2026-09-21新增/18_2026AI漫剧合规监管与备案制度.md


附G:本地/离线全流程(低配可跑 · 免 API)🆕

源自 阿里云《2026 零基础本地 AI 漫剧完整实操教程》+ 头条《AI制作漫剧全攻略》+ 七牛云《工业化管线》(原文见 01_原始素材/2026-09-21新增/25_本地离线全流程与开源漫剧项目(自动巡检).md)。适合:零预算/隐私敏感/想无限次生成、不想买 API 额度

硬件门槛:NVIDIA 独显 8G 显存 + 内存 16G(32G 更顺)+ Win10/11。

链路本地 Qwen 写分镜 → ComfyUI 画统一角色分镜图 → LTX2.3 图生微动画 → Qwen3-TTS 本地配音 → FFmpeg 拼合成片(全程离线、无水印、不限次)。

环境:Python 3.10(勾 Add to PATH)/ Git / FFmpeg;显卡加速 pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu121

分镜脚本(Ollama + Qwen2.5)ollama pull qwen2.5:14b-q4_K_M,提示词要求输出 JSON 分镜数组(字段:镜号 / 正向画面描述 / 负面避坑描述 / 人物动作 / 角色台词 / 时长 3-5s),脚本 POST localhost:11434/api/generatecomic_scene.json

ComfyUI 插件(防变脸/闪烁/爆显存三痛点)

  1. IP-Adapter Plus FaceID — 锁人物五官、跨镜不变脸(核心)
  2. ComfyUI-LTXVideo — 本地图生视频微动
  3. DWpose ControlNet — 骨骼姿态控制、防肢体畸形
  4. KJNodes — 批量循环渲染 + 本地文件读写
  5. Qwen-TTS-ComfyUI — 内置本地配音节点

模型路径models/checkpoints(Flux-Schnell 量化 / SD1.5 漫画)/ models/ipadapter(FaceID)/ models/ltx_video(LTX2.3 量化,8G 专用)/ models/controlnet(DWpose)。

低配最优固定角色组合:固定一张角色正面人设参考图 + IP-Adapter-FaceID 权重 0.65 + DWpose 骨骼控制,再循环批量生成所有镜头视频。(云端侧一致性参数见 ③.6.1;如需脱离 ComfyUI 图形界面的纯 diffusers 工程管线(SDXL+AnimateDiff+Wav2Lip,含 LoRA 训练参数/显存/耗时/错误修复表),见 ③.6.2

升级路线:本附G 为「低配可跑」起点;量产/自定义需求可按 ③.6.2 开源工程管线附J 编排层(Dify/n8n 把 ComfyUI 串成自动化生产线)渐进升级。


附H:AI 漫剧平台对比 & 开源项目生态(速查)🆕

源自 GitHub Gist《AI漫剧制作平台全流程调研报告》(原文见素材 25)。⑨ 9.2 是「发行/分账选平台」,本附H 是「制作工具选平台 + 可自建的开源项目」,两者互补。

制作平台对比

平台 特点 适用场景
即梦 AI 分镜生成、图生视频、角色一致性控制 全流程轻量化
Runway 运镜流畅、写实风格强 高质量动态渲染
可灵 Kling 理解中国元素、国漫风格适配 国风/校园/玄幻
万兴剧厂 Reelmate 工业化生产,5 天完成整剧,成本降 72% 专业团队爆款
FD Studio 多模型集成(MJ+Runway+可灵),云端协作 团队高效迭代
巨日禄 强一致性,1 人 1 天出 1-2 分钟,700 元/分钟 批量矩阵号

开源 AI 漫剧生成项目(可二次开发/私有部署):

  • waoowaoo — 剧本 → 角色 → 分镜 → 视频全流程自动生成(首选参考)
  • Huobao Drama / 魔因漫创 / DirectorAI / 智剧通

效率/参数参考:万兴剧厂分镜一抽可用率 80%、单集分镜从 1 人/天/1 集 → 1 人/天/8 集;云端参数 Runway --motion5、单次生成 10-15s、配音语速 1.1 倍、BGM -18dB / 人声 -6~-3dB;导出与 8.1 一致(MP4 / 1080×1920 / 30fps / 8000-10000 kbps)。

零基础六步耗时口径:选题+剧本 20min → 角色设定 → 分镜图 30min → AI 动态 → 配音音效 20min → 剪辑合成 30min(单集 1-3 分钟,3 秒爆点、10 秒立人设)。


附I:AI 译配 & 出海本地化(多语种流水线 · 速查)🆕

源自 腾讯云《48 小时 9 语种译制流水线》+ 腾讯新闻《小云雀出海本土化》+ 澎湃/钛媒体出海市场数据 + 腾讯云《音画同步难题》(原文见 01_原始素材/2026-09-21新增/26_AI译配流水线与出海本地化(自动巡检).md)。⑨ 9.3 出海是「概览」,本附I 是「落地流水线 + 成本 + 本土化方法论」

why 出海卡在译制:单集 90s 人工译制周期 3~5 天、单语种 200~600 元;100 集 × 9 语种 = 900 集,传统模式 4~6 周、破百万。四大痛点:硬字幕/水印(海外平台不允许原平台标识)/ 音色一致性(男主跨语种同一声音)/ OCR(画面内招牌·聊天·合同)/ 分区合规

七步流水线(AI 化)

① 智能擦除(去字幕无痕)   3 元/分钟 → 干净母版
② ASR 识别                0.03 元/分钟
③ 大模型翻译(9 语种)    0.20(首)+0.05×8(附加) 元/分钟
④ OCR 提取并翻译          0.80 元/分钟
⑤ AI 配音(见下)
⑥ 字幕压制(双语/单语)   0.063 元/分钟
⑦ 智能审核(分区合规)    0.08 元/分钟

配音三模式(决定上线层级):全自动高情感克隆 9 元/分钟(主线/付费档)| 基于音色 ID 0.5 元/分钟(长尾/广告/试播)| 音色克隆 25 元/音色·一次性工业化打法:先「音色克隆」固化男一/女一音色 ID → 再用「音色 ID」批量铺 100 集 → 100 集同一声音 + 成本不爆

成本口径:100 集 × 9 语种 ≈ 2433 元(900 集),单集综合 ≈ 2.7 元,降至人工译制约 1/10。时间线 48h:0~6h 擦除+ASR+OCR → 6~18h 翻译+克隆 → 18~36h 配音 → 36~44h 压制+审核 → 44~48h 人工 QC。

音画同步三层策略(译配最大坑:翻译后时长偏差 → 嘴闭音未停):① TTS 语速参数调整(偏差 5%-20%)② 约束改写(20%-40%)③ 混合策略(≥40%)。口型适配更难(口型驱动/重绘)。

出海 2.0:从「翻译搬运」到「本土化再生产」:核心障碍不是语言,而是文化折扣(读懂字面、读不懂情绪逻辑 →「看得懂却看不进」)。正解流程 = 剧本语境重构 → 镜头画面重制(欧美面孔/美式场景/当地风格)→ 角色资产 → 多语种情绪配音 → 规模化量产;不用先拍中文原片再转绘,直接从文字剧本生成本土化视觉素材。转绘三项关键参数:风格 / 比例(竖屏 9:16 适配 TikTok·Reels)/ 目标地区

市场口径(2026,引用须标来源):全球 AI 短剧市场 2025 ≈1 亿美元 → 2026 预计 ≈6.5 亿美元(+6 倍);TikTok Q1 AI 短剧分成超 200 万美元;阅文 ToonScroll;字节 Melolo/MiniShorts/PineDrama;中文在线 FlareFlow(3300 万用户)。风险:日上线超 1300 部、爆款率约 1/1000、译制剧完播/付费双降 → 精品化 + 原创。

ROI 三条:① 配音分层(S 级钩子集高情感克隆 / 长尾集音色 ID);② 音色 ID 库沉淀为公司资产(复用省克隆费);③ 「擦除+OCR+翻译」打包成母版工厂(先产干净母版,再按平台二次烧字幕)。


附J:零代码编排 · 智能体工作流 & 视频 Pipeline(速查)🆕

源自 阿里云《ComfyUI 搭建 AI 漫剧生产线(Dify + ComfyUI)》+ 腾讯云《部署并搭建视频生成 Pipeline》(原文见 01_原始素材/2026-09-21新增/28_零代码智能体编排与视频Pipeline(自动巡检).md)。附G 是「单机本地链路」,附H 是「平台/开源项目」,本附J 是「把工具串成自动化生产线的编排层」

分层心智模型编排层(大脑:剧本/分镜/多 Agent/JSON 结构化/循环批量) + 执行层(双手:ComfyUI 出图·图生视频·配音) + 粘合协议(MCP 统一调用) + 合成(FFmpeg)

Dify + ComfyUI 落地

① ComfyUI 工作流 → Save (API Format) 导出 JSON
② Dify Marketplace 装 ComfyUI Plugin
③ Dify Tools → ComfyUI 填 服务器 URL
④ 加「ComfyUI Workflow」节点:传 JSON + 变量(prompt/seed)

模型栈参考:Flux.1(漫画风)/ LTX-2.3(开源视频)/ Qwen3-TTS(配音)/ Flux2Klein·NanoBanana(强一致性)。

多 Agent 分工:编剧 Agent(②)→ 导演 Agent(⑥)→ 提示词优化 Agent(③④)。起手式复杂度:MoneyPrinterTurbo(15min)< 编排层+ComfyUI(1-2h = n8n+ComfyUI+MCP)。

提效 / 避坑:角色一致性用「角色知识库(参考图+描述+LoRA)」;显存用 FP8/GGUF 量化(12G 可 1080P);低配可「云端编排 + RunPod 租卡跑 ComfyUI」;OOM 降分辨率、FFmpeg 走 PATH、素材 API 空换源。


推荐目录结构

漫剧项目/<剧名>/
├── 00_台词分幕/
├── 01_小说文案/
├── 02_剧本/
├── 03_人物道具提示词/
├── 03b_表情矩阵/
├── 04_三视图/
├── 05_场景提示词与图/
├── 06_分镜头提示词/
├── 07_视频片段/
└── 08_成片/

素材收集状态

首批全部文档已收集完毕(19 份),流程闭环。

2026-09-21 新增 5 份专项素材(已归档 01_原始素材/2026-09-21新增/ + 02_素材整理/2026-09-21新增/):

  • 动作戏专项:AI ACTION SCALE V6.0(→ ⑥ 6.11)
  • 运镜专项:AI 电影运镜三变量 Skill Pro V2.0(→ ⑥ 6.12)
  • 分镜范例:情侣 Vlog 0-25 秒完整分镜(→ ⑥ 6.13)
  • 方言配音:全国 50 套方言词典 + Seedance2.5 版(→ ⑦ 7.1)
  • 夸张表情:AI 夸张表情提示词完全教程(→ ③.5.1,27 组)

2026-09-21 第二批新增 8 份专项素材(已归档 + 提取,07~14):

  • 场景氛围:60 种场景氛围提示词(→ ⑤ 5.4)
  • 角色动作:60 种角色动作提示词(→ ⑥ 6.14)
  • 人物表情:60 种人物表情提示词(→ ③.5.2)
  • 视频质感:2026 高级质感词 10 类(→ ⑥ 6.16)
  • 声音一致性:AI 短剧声音一致性指南(→ ⑦ 7.2)
  • 运镜:40 种运镜提示词(→ ⑥ 6.15)
  • 微表情:人物微表情 FACS 设计指南(→ ③.5.2)
  • 配音情绪:配音情绪控制指南(→ ⑦ 7.3)

已补清:二、小说转剧本指令词(②)、三、S级人物指令词(③)、六、S级镜头提示词10秒(⑥)、六、S级镜头提示词2-15秒(⑥)、台词分幕(⓿)—— 均为 2026-09-19 用户粘贴。

2026-09-21 自动巡检新增 1 份(15):2026 漫剧产业工具链与行业趋势(→ 附E;含剧本黄金公式、成片导出规格、分镜 7 要素等)。提取文本:02_素材整理/2026-09-21新增/15_2026漫剧产业工具链与行业趋势.txt

2026-09-22 自动巡检新增 1 份(16):2026 漫剧工业化与角色一致性专文(→ ③.7 主体库 / 6.10b 智能分镜 / 附E 扩充;含参考生视频、九宫格机位、质量红线与成本、WorkRally/橙星梦工厂、SD3.5 一致性技术栈等)。提取文本:02_素材整理/2026-09-21新增/16_2026漫剧工业化与角色一致性专文.txt

2026-09-22 自动巡检(第二轮)新增 1 份(17):2026 漫剧工具链与工业化实践专文(→ ③.6.1 一致性技术栈与视觉契约 / 6.10b 补 LTX Studio 与抽卡师 / 7.2b 音画同步与音频工具链 / 附E 增补;含 MJ V7 Omni Reference、IP-Adapter FaceID Plus v2、SkyReels-V4、Fish Audio、Suno v4、极速流/精品流两套方案、事实澄清等)。提取文本:02_素材整理/2026-09-21新增/17_2026漫剧工具链与工业化实践专文.txt

2026-09-22 自动巡检(第三轮)新增 1 份(18):2026 AI 漫剧合规监管与备案制度(→ ② 2.3 合规前置 + 附F;含三级备案/资质/AI强制标注/内容红线/版权存证/平台分账)。原件 md:01_原始素材/2026-09-21新增/18_2026AI漫剧合规监管与备案制度.md;提取文本:02_素材整理/2026-09-21新增/18_2026AI漫剧合规监管与备案制度.txt

2026-09-22 自动巡检(第四轮)新增 1 份(19):2026 AI 漫剧自动化生产工作流(→ ⑥ 6.17 多集工程 & 分镜字段规范 + ⑦ 7.4 批量生成与容错;含标准化分镜脚本 13 字段表、资产库四类、逐镜质检清单、生产级脚本 6 项能力、零基础耗时参考、三类分镜工具定位)。原件 md:01_原始素材/2026-09-21新增/19_2026AI漫剧自动化生产工作流.md;提取文本:02_素材整理/2026-09-21新增/19_2026AI漫剧自动化生产工作流.txt

2026-09-22 自动巡检(第五轮)新增 1 份(20):2026 AI 漫剧平台分账与变现发行全景(→ ⑨ 发行与变现 + 工具箱模板㉑/㉒ + 术语表「十一、发行与变现术语」;含八大平台分账速查/平台选型决策表/免费 IP 库/投流经济学与爆款率/出海与译配/一线经验)。原件 md:01_原始素材/2026-09-21新增/20_2026AI漫剧平台分账与变现发行全景.md;提取文本:02_素材整理/2026-09-21新增/20_2026AI漫剧平台分账与变现发行全景.txt

2026-09-22 自动巡检(第七轮)新增 1 份(22):北航《爆款AI漫剧教学手册》(→ ⑧ 8.2 转场衔接 + 8.3 后期打磨;含首尾帧补间/运镜驱动/元素关联三法、节奏卡点 2-3s vs 4-6s、0.5 秒高光定格、字幕设计黑体/白字黑描边、引流标签、避坑 5 雷区)。原件 md:01_原始素材/2026-09-21新增/22_北航爆款AI漫剧教学手册(转场·定格·字幕).md;提取文本:02_素材整理/2026-09-21新增/22_北航爆款AI漫剧教学手册(转场·定格·字幕).txt

2026-09-22 自动巡检(第六轮)新增 1 份(21):2026 AI 漫剧卡点排查与返工定位(→ ⑥ 6.18 卡点排查 & 返工定位 + 工具箱模板㉓ + 术语表「十二、诊断与返工术语」;含四类卡点→优先修正表、诊断口诀、可生成剧本四字段、角色卡固定项/禁止变化、提示词母版结构>长度、单变量返工法则)。原件 md:01_原始素材/2026-09-21新增/21_2026AI漫剧卡点排查与返工定位.md;提取文本:02_素材整理/2026-09-21新增/21_2026AI漫剧卡点排查与返工定位.txt

2026-09-22 自动巡检(第八轮)新增 2 份(23、24)

  • (23)音乐骤停与声音后期(→ ⑧ 8.4 声音设计;含音乐骤停三步/三大时机/按类型打法、音效后期四步、三层混音最佳实践)。原件 md:01_原始素材/2026-09-21新增/23_音乐骤停与声音后期(漫剧剪辑必杀技).md;提取文本:02_素材整理/2026-09-21新增/23_...txt
  • (24)配乐 7 步法与画幅适配(→ ⑧ 8.4 声音设计 + 8.5 画幅适配;含主题动机/情绪曲线/动态布局/配器留白/混音规范/成片对位 + 竖屏横屏一套素材多用)。原件 md:01_原始素材/2026-09-21新增/24_配乐7步法与画幅适配(漫剧声音·发行).md;提取文本:02_素材整理/2026-09-21新增/24_...txt

2026-09-22 自动巡检(第九轮)新增 1 份(25):本地/离线全流程与开源漫剧项目(→ 附G / 附H;含 Ollama+Qwen 分镜、ComfyUI 插件链与参数、LTX2.3/Qwen3-TTS/FFmpeg 本地链路、平台对比、waoowaoo 等 5 个开源项目、零基础耗时口径)。原件 md:01_原始素材/2026-09-21新增/25_本地离线全流程与开源漫剧项目(自动巡检).md;提取文本:02_素材整理/2026-09-21新增/25_...txt

2026-09-22 自动巡检(第十轮)新增 1 份(26):AI 译配流水线与出海本地化(→ 附I:AI 译配 & 出海本地化 + 术语表「十六、出海与译配术语」;含七步译配流水线与单价/配音三模式/100 集×9 语种成本测算/音画同步三层策略/文化折扣与本土化再生产/TikTok Q1 分成 200 万美元等市场口径/ROI 三条)。原件 md:01_原始素材/2026-09-21新增/26_AI译配流水线与出海本地化(自动巡检).md;提取文本:02_素材整理/2026-09-21新增/26_...txt

2026-09-23 自动巡检(第十三轮)新增 2 份(29/30)

  • 29 零基础 AI 漫剧智能量产技术拆解(阿里 LumenX·五层架构) → 附E 补「阿里 LumenX + 量产口径」;含五层架构、零基础三条路径(LumenX / Dify+ComfyUI / Agent)、三个边界。原件 md:01_原始素材/2026-09-21新增/29_...md;提取 txt:02_素材整理/2026-09-21新增/29_...txt
  • 30 AI 漫剧全流程工程化实战(AnimateDiff·Wav2Lip·Kohya LoRA)③.6.2 开源工程管线 + 附G 升级路线;含 SDXL+ControlNet+AnimateDiff+Wav2Lip 整条管线、Kohya LoRA 训练参数、一致性三板斧、AnimateDiff 调参、口型工程化、显存/耗时、错误修复表。原件 md:01_原始素材/2026-09-21新增/30_...md;提取 txt:02_素材整理/2026-09-21新增/30_...txt

2026-09-23 自动巡检(第十二轮)新增 1 份(28):零代码智能体编排与视频 Pipeline(→ ⑥ 6.19 零代码智能体编排 + ⑦ 7.5 视频生成 Pipeline + 附J + 工具箱模板㉙ + 术语表「十八、智能体编排与 Pipeline 术语」;含 Dify+ComfyUI 大脑/双手分层、多 Agent 分工、MCP 协议、n8n 节点串法、四种 Pipeline 方案与避坑)。原件 md:01_原始素材/2026-09-21新增/28_零代码智能体编排与视频Pipeline(自动巡检).md;提取文本:02_素材整理/2026-09-21新增/28_...txt

2026-09-23 自动巡检(第十一轮)新增 1 份(27):爆款钩子公式与发布首屏运营(→ ① ①.2 爆款钩子(视觉补偿+预期管理+十大公式) + ⑨ 9.7 发布首屏:封面·标题·追更 + ③.7 「撞脸」规避机制 + 2.3/附F 新规口径续推;含十大钩子公式、封面/标题/追更打法、小云雀连载运营观察、2026 市场与监管新口径)。原件 md:01_原始素材/2026-09-21新增/27_爆款钩子公式与发布首屏运营(自动巡检).md;提取文本:02_素材整理/2026-09-21新增/27_...txt


版本记录

  • v3.30(2026-09-23):自动巡检轮(开源工程管线 / 量产架构整合)。③.6 新增 ③.6.2 【开源工程管线】SD/AnimateDiff 自建一致性技术栈与工程参数(双 LLM 分工:GPT-4 出结构化 JSON + Mistral-7B 出提示词 / Kohya LoRA 训练参数 / 一致性三板斧:固定 seed·首帧参考·IP-Adapter 权重动态调整 / AnimateDiff v3 调参 / Wav2Lip+GFPGAN 口型工程化 / MoviePy+FFmpeg 分段合成 / A100 单场景耗时 / 错误修复表);附E 补「阿里 LumenX」一站式平台与「量产口径(五层架构 / 抽卡 15%→90%+ / 返工率 40-50%→<10% / 243.6 亿)」;附G 补「升级路线」指向 ③.6.2 与附J;工具箱新增 模板㉚ 开源工程管线速查;术语表新增「十九、开源工程管线术语」;素材归档至 29_零基础AI漫剧智能量产技术拆解(阿里LumenX·五层架构)30_AI漫剧全流程工程化实战(AnimateDiff·Wav2Lip·Kohya LoRA)(原件 md + 提取 txt)。补齐「脱离一站式平台的自建工程管线参数」空白。无删除项

  • v3.29(2026-09-23):自动巡检轮(零代码编排 / 智能体工作流整合)。⑥ 新增 6.19 零代码智能体编排(编排层「大脑」Dify/n8n + 执行层「双手」ComfyUI;Dify+ComfyUI 集成四步;编剧/导演/提示词优化三 Agent 分工;FP8/GGUF 量化与角色知识库);⑦ 新增 7.5 视频生成 Pipeline(四种无人值守方案与部署复杂度 / n8n 节点串法 / MCP 协议 / 避坑三坑);新增 附J:零代码编排 · 智能体工作流 & 视频 Pipeline(速查);⑨ 9.5 上线前自检补「发布前质检(七步法收口)」;附A 工具清单补编排/自动化项;工具箱新增 模板㉙ 零代码编排 & Pipeline 速查 并补自检项;术语表新增「十八、智能体编排与 Pipeline 术语」(12 项);素材归档至 28_零代码智能体编排与视频Pipeline(自动巡检)(原件 md + 提取 txt)。补齐「编排层/智能体工作流/无人值守 Pipeline」空白。无删除项

  • v3.28(2026-09-23):自动巡检轮(发布首屏/爆款钩子整合)。① 新增 ①.2 爆款钩子(黄金3秒「视觉补偿 + 预期管理」+ 十大钩子公式 + 避坑3条);⑨ 新增 9.7 发布首屏:封面 · 标题 · 追更(封面复用开场最强帧 / ≤8字 / 与内容一致 / 连载统一模板 + 追更钩子 + 小云雀连载运营观察);③.7 补「撞脸」溶图规避机制;② 2.3 与 附F 补充 2026-07-01 分类分层标准 + 2026-09-01 总局令第 16 号《微短剧发展管理办法》;工具箱新增 模板㉘ 爆款钩子·封面·标题速查;术语表新增「十七、钩子与首屏运营术语」;素材新增 27。补齐「钩子内容配方 + 封面/标题/追更」空白。无删除项

  • v3.27(2026-09-22):自动巡检轮(出海译配/多语种本地化整合)。新增 附I:AI 译配 & 出海本地化(多语种流水线·速查)(七步流水线与单价:去字幕 3 元/分钟·ASR 0.03·翻译 0.20+0.05×8·OCR 0.80·配音三模式(高情感克隆 9 / 音色 ID 0.5 / 克隆 25 元一次性)·字幕压制 0.063·智能审核 0.08;100 集×9 语种 ≈2433 元、单集 ≈2.7 元、48h 交付;音画同步三层策略;出海 2.0 从「翻译搬运」到「本土化再生产」+ 文化折扣;ToonScroll/FlareFlow/TikTok 分成等市场口径;ROI 三条);⑨ 9.2 出海行补「本土化再生产」指向;术语表新增「十六、出海与译配术语」(17 项);素材归档至 26_AI译配流水线与出海本地化(原件 md + 提取 txt)。补齐上轮建议的「AI 漫剧出海译配」空白。无删除项

  • v3.26(2026-09-22):自动巡检轮(本地/离线全流程 + 平台/开源生态整合)。新增 附G:本地/离线全流程(8G 显存可跑·免 API)(Ollama+Qwen 写分镜 → ComfyUI 插件链:IP-Adapter Plus FaceID + DWpose ControlNet + LTXVideo + KJNodes + Qwen-TTS → LTX2.3 微动 → FFmpeg 合成;固定角色组合 = 正面人设图 + FaceID 权重 0.65 + DWpose)与 附H:平台对比 & 开源项目生态(即梦/Runway/可灵/万兴剧厂/FD Studio/巨日禄 + waoowaoo 等 5 个开源项目 + 效率参数);附A 工具清单加本地/开源项;附E 增补本地工具链与开源生态两条;工具箱新增 模板㉖ 本地/离线全流程速查;术语表新增「十五、本地部署与开源术语」;素材归档至 25_本地离线全流程与开源漫剧项目(原件 md + 提取 txt)。补齐「低配/零预算/离线路线」与「开源项目生态」空白。无删除项

  • v3.25(2026-09-22):自动巡检轮(声音设计/画幅适配整合,补齐 ⑧ 音频侧空白)。⑧ 新增 8.4 声音设计(配乐/音效/混音)(音乐骤停三步+三大时机+按类型打法 / 配乐 7 步法:主题动机 3-5 音符·情绪曲线每 30s·动态布局 ppp30%-mf50%-ff5-10%·配器留白·混音 -16/-28 LUFS·A/B/C 三种对位 / 音效后期四步 / 三层混音对白>配乐>音效)与 8.5 画幅适配与多平台发布(竖屏 9:16 vs 横屏 16:9 选型表 + 安全区间构图一套素材多用);工具箱新增 模板㉕ 声音设计 & 画幅适配速查,⑧ 自检加声音/画幅项;术语表新增「十四、声音与画幅术语」;素材归档至 23_音乐骤停与声音后期24_配乐7步法与画幅适配(原件 md + 提取 txt)。补齐上轮建议的「⑧ 声音层」与「跨平台画幅适配」空白。无删除项

  • v3.24(2026-09-22):自动巡检轮(转场衔接/后期打磨整合)。⑧ 新增 8.2 转场衔接(跨镜过渡三法:首尾帧补间/运镜驱动/元素关联)8.3 后期打磨(节奏卡点 2-3s vs 4-6s / 0.5 秒高光定格 / 字幕设计黑体+白字黑描边 / 引流标签);工具箱新增 模板㉔ 转场衔接 & 后期打磨速查,⑧ 自检加转场/字幕项;术语表新增「十三、转场与后期打磨术语」;素材归档至 22_北航爆款AI漫剧教学手册(转场·定格·字幕)(原件 md + 提取 txt)。补齐 ⑧「剪映合成」阶段的转场与后期打磨空白。无删除项

  • v3.23(2026-09-22):自动巡检轮(卡点排查/返工定位整合)。⑥ 新增 6.18 卡点排查 & 返工定位(四类卡点→优先修正表 / 诊断口诀 / 可生成剧本四字段 / 角色卡固定项+禁止变化 / 提示词母版结构>长度 / 单变量返工法则);工具箱新增 模板㉓ 卡点排查 & 单变量返工表 与自检项;术语表新增「十二、诊断与返工术语」;素材归档至 21_2026AI漫剧卡点排查与返工定位(原件 md + 提取 txt)。无删除项

  • v3.22(2026-09-22):自动巡检轮(发行/分账/变现全景整合)。新增 ⑨ 发行与变现(9.1 平台分账速查 / 9.2 平台选型决策表 / 9.3 变现路径与免费 IP 库 / 9.4 投流经济学与爆款率 / 9.5 上线前自检 / 9.6 一线经验红线);工具箱新增 模板㉑ 平台选型决策表模板㉒ 发行变现自检清单,⑧ 自检加发行项;术语表新增「十一、发行与变现术语」(9 项);素材归档至 20_2026AI漫剧平台分账与变现发行全景(原件 md + 提取 txt)。补齐知识库「变现侧」空白。无删除项

  • v3.21(2026-09-22):自动巡检轮(多集工程化/分镜字段规范整合)。⑥ 新增 6.17 多集工程 & 分镜字段规范(标准化分镜脚本 13 字段表 / 资产库四类 / 逐镜质检清单 / 三类分镜工具定位);⑦ 新增 7.4 批量生成与容错(多集处理·断点续传·失败重试·通知·质检·失败日志 + 零基础耗时参考 + 角色锁定一致性);工具箱新增 模板⑳ 标准化分镜脚本字段表 与自检项;术语表补工程术语;素材归档至 19_2026AI漫剧自动化生产工作流(原件 md + 提取 txt)。无删除项

  • v3.20(2026-09-22):自动巡检轮(2026 合规监管专文整合)。② 新增 2.3 合规前置(备案与内容红线)(三级分层备案 / 《广播电视节目制作经营许可证》/ AI 强制标注 / 内容六大零容忍 / 版权存证 + 对本流程的直接影响);新增 附F:2026 合规监管与备案制度(速查);工具箱新增 模板⑲ 上线合规自查清单 与自检清单合规前置项;术语表新增合规术语;素材归档至 18_2026AI漫剧合规监管与备案制度(原件 md + 提取 txt)。无删除项

  • v3.19(2026-09-22):自动巡检轮(工具链与工业化专文整合)。③.6 新增 ③.6.1 一致性技术栈与「视觉契约」(MJ V7 Omni Reference / SD3.5 IP-Adapter FaceID Plus v2 + ControlNet + ADetailer / LoRA / 三段法);6.10b 补 LTX Studio 与「抽卡师」职业;⑦ 新增 7.2b 音画同步·音频工具链(SkyReels-V4 / Vidu Q3 / ElevenLabs v3 / Fish Audio / Suno v4 / Minimax);附E 增补 2026-09 工具链与工业化块(含《霍去病》事实澄清、剧本 70 集/7 万字要求、两套工作流);素材归档至 17_2026漫剧工具链与工业化实践专文(原件 md + 提取 txt)。

  • v3.18(2026-09-22):自动巡检轮(工业化/一致性专文整合)。③.7 新增「主体库(数字资产库)」;⑥ 新增 6.10b 智能分镜工具(Drawstory/DomoAI/StoryboardHero/Katalist + 九宫格机位);附E 扩充(WorkRally/橙星梦工厂/Vidu、质量红线与成本、Seedance2.0/Sora2/可灵3.0 三足鼎立、Adobe Firefly 粗剪);素材归档至 16_2026漫剧工业化与角色一致性专文(原件 md + 提取 txt)。

  • v3.17(2026-09-21):自动巡检轮(产业/教程文章整合)。① 新增「短剧剧本黄金公式」(3秒钩子/每集画面事件/≤3轮对话,源自 CSDN 仿真人短剧教程);⑧ 新增 8.1 成片导出规格(MP4/1080×1920/30fps/8000-10000kbps + 发布策略);新增 附E:2026 漫剧产业与工具链(市场/五大趋势/工具链费用/平台对比);素材归档至 15_2026漫剧产业工具链与行业趋势(原件 md + 提取 txt)。

  • v3.16(2026-09-21):新增「漫剧长度设定」可选前置(①.1)。起点B 写小说前可填整部「集数 / 每集时长」固定栏(留空不限),AI 按目标长度规划分集体量与卡点;操作台 s1-p0/s1-p1 已加固定栏,提示词自动拼接【漫剧长度设定】段。适配操作台起点A/B 命名(s0=起点A 故事骨架、s1=起点B 选本改文,二选一入口)。

  • v3.15(2026-09-21):第二批 8 份知乎/viddo 素材整合。新增 ③.5.2 写实表情&微表情专项(60表情库+FACS五层架构)/ 5.4 场景氛围专项(氛围7要素+60条库)/ 6.14 动作表演库(动作5段拆解+60条)/ 6.15 运镜即用库(40条+情绪映射)/ 6.16 质感词库(10类高级质感词)/ 7.2 声音一致性(声纹锚点+声音资产卡)/ 7.3 配音情绪控制(标点遥控器+对口型三要素);总览表、SOP、素材状态同步。

  • v3.14(2026-09-21):新增《AI 夸张表情提示词完全教程》整合。③.5 下新增 ③.5.1 夸张表情专项(情绪→视觉翻译三层法 / 五官分项拆解 / 漫画符号特效库 / 情绪分级 / 夸张度三档 / 27 组表情库);工具箱新增模板 ⑫(夸张表情提示词)+ 自检项 ③.5.1;术语表补 5 个术语;素材归档至 01_原始素材/2026-09-21新增/AI夸张表情提示词完全教程.md、提取文本至 02_素材整理/2026-09-21新增/06_...txt

  • v3.13(2026-09-21):新增 5 份专项素材整合。⑥ 新增 6.11(动作分镜 V6.0)/ 6.12(运镜三变量)/ 6.13(Vlog 范例);⑦ 新增 7.1(方言配音词典 ×2);素材归档至 01_原始素材/2026-09-21新增/、提取文本至 02_素材整理/2026-09-21新增/

  • v3.10(2026-09-19):Toonflow 收尾挖掘。新建 13_导演规划与改编策略.md(导演规划完整方法论/改编 8 大要点/类型创新三方向/三死路/删减优先级);② 新增 2.2(导演规划)。

  • v3.9(2026-09-19):Toonflow 画风标签+场景变体挖掘。新建 12_...;⑤ 新增 5.3。

  • v3.8(2026-09-19):Toonflow 场景/道具/画风挖掘。新建 11_...;④ 新增 4.3。

  • v3.7(2026-09-19):Toonflow 衍生资产挖掘。新建 10_...;④ 新增 4.1。

  • v3.6(2026-09-19):Toonflow 架构挖掘。新建 09_...;③ 新增 ③.7;⑥ 新增 6.10。

  • v3.5(2026-09-19):Toonflow 骨架 Agent 挖掘。新建 08_...;主流程新增「【前置】故事骨架」。

  • v3.4(2026-09-19):Toonflow 剧本 Agent + BigBanana 挖掘。新建 07_...;② 新增 2.1。

  • v3.3(2026-09-19):Toonflow 深度挖掘。新建 06_...;⑥ 新增 6.9(分镜审核)。

  • v3.2(2026-09-19):GitHub 深度挖掘(ai-comic-studio / openframe)。新增 6.7(S级七律)、6.8(时长预算)。

  • v3.1(2026-09-19):新增快速上手 SOP + 附D 提示词模板库。

  • v3.0(2026-09-19):GitHub 调研补强。新增「附C:GitHub 调研与流程优化」;⑥ 新增 6.6 节;③ 新增 ③.6 节。

  • v2.5(2026-09-19):补入《台词分幕》。至此全部 19 份文档收集完毕,流程闭环。

  • v2.4(2026-09-19):补入《六、S级镜头提示词2-15秒》。

  • v2.3(2026-09-19):补入《三、S级人物指令词》(③ 完整展开:四种提示词风格体系 + 安全合规规则)、《六、S级镜头提示词10秒》(⑥ 分镜拆分规则:六维一致性/四步法/时间轴/自检)。

  • v2.1(2026-09-19):补入《二、小说转剧本指令词》。

  • v2.0(2026-09-19):整合全部 8 份 docx(场景设定/动态镜头/景别/九宫格/软件/三视图/视角/视频风格)+ 表情矩阵 + 制作注意事项;新建 02_素材整理/ 归档全部原文;流程扩展为 ⓿~⑧。

  • v1.2(2026-09-19):并入《制作注意事项》。

  • v1.1(2026-09-19):新增表情矩阵(③.5)、台词分幕(⓿)。

  • v1.0(2026-09-19):首版,基于流程骨架 + 部分指令词。

配套 00_主流程.md。这里存放可直接复制使用的模板、清单、对照表。 用法:找到对应环节 → 复制模板 → 替换 【】 内容 → 丢给 AI 工具。

本文件速查

基础工具(一~六):提示词模板库 / 制作自检清单 / 景别视角运镜 / 时长公式 / 视觉连续性 / 禁止词 研究精华(七~十八):故事骨架 / 改编策略 / 剧本规范 / 导演规划 / 帧描述五要素 / 分镜审核 / 资产体系 / 画风标签 / 连贯性 / 提取提示词 / 剧情节奏 / 深度索引


一、提示词模板库(填空即用)

模板 ①:爆款改文(环节 ①)

请将以下原文小说,严格按照抖音短视频黄金3秒推流逻辑、全网爆款网文标准,
全程合规改编。要求:开篇3秒抛出极致冲突/绝境/反转/悬念,无铺垫;
每80字1个小爽点、每200字1个大爽点;段段留钩;无血腥/暴力/色情/低俗。
单章800-1000字,短句为主。

原文:
【粘贴原文小说】

输出:改编后的爆款文案全文。

模板 ②:台词分幕(环节 ⓿)

你的任务是将给定小说内容划分为角色和内容,并输出为结构化JSON结果。

台词识别规则:
1. 完整保留原文,不得遗漏/删改/省略任何字句
2. 提取带引号(“”)、破折号(——)、感叹号(!)、冒号(:)等标记的台词;
   双引号内容提取后将双引号改成‘’。其余均为旁白
3. 角色在已知列表则直接使用;否则根据上下文合理判断
4. 相邻同角色台词可合并,但单条不超过50字(标点也算)
5. 超50字按语义完整性拆分,每条不超过50字,确保原文不缺失
6. 以35-50字为一个对话提取限制
7. 确保原文没有漏,不出现原文截断
8. 拆分的对话必须是同一角色说的

旁白识别规则:
1. 所有非台词的叙述性内容(心理/环境/动作/场景过渡)均标记为"旁白"
2. 保留原文所有文字,不得遗漏/删改
3. 相邻旁白可合并,单条不超过50字
4. 超50字按语义拆分,不超过50字
5. 同一角色说的
6. 确保原文没有漏、不截断

情绪与强度:
1. 根据上下文语境、语气及场景变化识别情绪与强度
2. 必须严格从 possible_emotions 与 possible_strengths 中选择
3. "旁白"统一为:情绪"平静",强度"中等"
4. 情绪识别不得改写原文,仅用于标注

输出格式:严格 json 数组,每条含 role_name / text_content / emotion_name / strength_name

输入:
可能包含的角色列表:<possible_characters>【角色1, 角色2, 旁白, ...】</possible_characters>
可能包含的情绪列表:<possible_emotions>高兴, 生气, 伤心, 害怕, 厌恶, 低落, 惊喜, 平静</possible_emotions>
可能包含的情绪强弱列表:<possible_strengths>微弱, 稍弱, 中等, 较强, 强烈</possible_strengths>

小说内容:
【粘贴小说原文】

模板 ③:人物提取 + 四风格提示词(环节 ③)

你是一位顶级的3D/写实角色概念设计师,专精于为即梦等AI绘画平台生成
电影级、高质感、极繁美学的3D人物与道具。严格遵守平台敏感词规则。

【任务】当用户提供小说后:
第一步:提取所有人物角色(姓名、性别、大致年龄、外貌特征【须具体到脸型/眼型/眉形/鼻型/唇形】、穿着风格、气质性格、标志物品)
第二步:提取高频道具(武器/法器/首饰/书信等)
第三步:为每个角色生成四种风格版本提示词
第四步:为每个高频道具生成一套道具提示词(1:1,正面居中,纯白背景)

【风格自适应】根据题材自动选择:修仙/武侠/宫廷→国风;现代都市→现代;
科幻→科幻;西幻→西幻;民国→民国;悬疑→现代+暗黑;混合→融合。
禁止默认国风。

【四种风格】
- 3D渲染风格:正面全身站立,UE5/次世代PBR/光线追踪/8K,纯白背景
- 真人实拍风格:全身站立,超高清摄影/8K/电影级柔光
- GPT A版风格:半身特写(截到腰部),国漫3D顶级渲染,可用增强描述
- GPT B版风格:全景站立,短词骨架80-120字,纯唯美,瞳色自由

【颜色规则】人类角色眼睛仅自然色系;非人/神明可用异色瞳(须有设定依据)。
【安全】禁用敏感词(深V/低胸/裸露/超模身材等);服装至少4种高级材质混搭;
      立体剪裁,禁"宽腰封""勒紧";神态统一中性平和。

小说内容:
【粘贴小说/剧本】

输出:按"角色名称/基本信息/外貌特征/身材/穿着/气质性格 + 四种风格提示词"格式输出。

模板 ④:三视图(环节 ④)

一张高精度、干净极简的角色设定板/人物三视图参考页,纯白背景,
整体像游戏角色建模设定图,角色turnaround board,排版整齐清晰,
写实高级质感,统一光线、统一人物一致性。

画面左侧为人物全身三视图:正面全身站姿 / 左侧面全身站姿 / 背面全身站姿
(三人必须同一角色,五官发型服装体型完全一致,平视,中性棚拍光,无遮挡)

画面右上区域:6张人物头像/头部视角图(正面/俯视头顶/后脑勺/左侧轮廓/正侧脸/3-4侧脸)
画面右下区域:6张人物局部细节图(上衣面料/下身正面/臀部剪裁/腿部皮肤/眼部/鞋子)

整体风格:极简、专业、写实、统一、干净、高级。

人物设定:
【人物形象描述】

输出要求:横版构图,白底,完整人物,不裁切;不出现多余道具/文字/LOGO/水印/UI元素。

模板 ⑤:人物表情矩阵(环节 ③.5)

采用极简UI设计风格与影视角色设定卡排版。
整体采用严格的两行五列网格布局(5×2 grid),共10个等分卡片,
每个卡片边界清晰但极简,无厚重边框,仅通过留白区分。
每个卡片内部为同一位人物的面部特写,不露出颈部以下,
保留所有真实面部细节,统一镜头距离与构图比例,
仅变化面部表情(喜怒哀乐愁等各种情绪),保持角色外貌完全一致。
人物居中构图,影棚柔光照明,皮肤质感真实但干净,无夸张阴影。
每个卡片底部居中放置编号标签01至10,标签后写一行小字:"01-微笑/02-愤怒/03-悲伤"。
整体风格参考角色设定表、影视分镜表情板与产品设计UI卡片。

【画幅】最终输出 16:9,由多个正方形表情卡片拼合而成(每格自身正方形)。

参考图:【粘贴人物参考图】

模板 ⑥:场景提示词(环节 ⑤)

你将扮演专业场景设定师。根据用户提供的小说段落或场景描述,
优先提取具有广阔空间感、大场面、史诗气质的环境,
为每个地点生成唯美、情绪饱满、诗意光影的电影级场景设定及AI绘画Prompt。

【万能公式】
第一步:定调光影氛围(写光的质感与情绪)
第二步:描绘核心主体与背景(精准名词组合构建空间)
第三步:强调材质与光影互动(光如何"触碰"物体表面)
第四步:锁死渲染与画质后缀(写实场景/UE5/极致细节/8k)

【全局约束】
- 绝对真空匿名:严禁出现人影/人名/衣物/身体部位等暗示人物存在的元素
- 场景命名四字以上带修饰词
- 固定开头:"不能出现其他人,无人纯场景,"
- 四大要素:环境类型/具体时间/空间氛围/视觉主要特征
- 必选视角:宏大的鸟瞰全景 / 低角度仰视 / 平视深远构图(禁用微距特写)
- 唯美高级感:情绪词 + 诗意光影对抗 + 情绪化时间天气 + 动态氛围细节 + 情绪色彩

【输出两套格式(缺一不可)】
格式一:场景提取清单 → 专业场景设定表 → 可复制 Prompt
格式二:GPT版场景指令词(主图 + 4张副图,每张带四字以上括号名称)

风格要求:【默认为东方古典仙侠;可选硬派写实东方幻想/现代都市写实/日常校园清新】

小说内容:
【粘贴小说段落或场景描述】

模板 ⑦:分镜头提示词(环节 ⑥)

根据旁白和对话拆分分镜头。

【内容镜头一致性原则】内容以35-50个字以内进行一次分镜头拆分,
要求拆分出的单句文案内容要完整。

【六维一致性准则】
人物一致 / 时空一致 / 物品一致 / 动作连贯 / 台词合规 / 敏感过滤

【分镜生成四步法】
STEP1 场景锚定 → STEP2 连续性检查 → STEP3 台词植入 → STEP4 敏感扫描

【时间轴】
10秒版:[0-3秒]核心动作 [3-6秒]互动反应 [6-8秒]情绪特写 [8-10秒]下一镜铺垫
15秒版:[0-4秒]核心动作 [4-8秒]互动反应 [8-12秒]情绪特写 [12-15秒]下一镜铺垫

【关键要求】
- 全中文输出,禁用英文引号,一律用中文引号
- 图片提示词不映射人物;视频提示词必须有角色标签映射(只写实际出现的角色)
- 视频提示词必须含"衔接前置指令"段落
- 景别多用近景/特写/大特写,不用远景,少用中景
- 台词时段镜头固定,不切换、不推拉
- video_prompt ≤ 500字符
- 每项文案生成1个分镜,总数 = 文案条目数

【输出格式】
有拆分子文案:分镜头N / 原文案 / 子文案 / 分镜头N-1 [时间轴] 场景:...
无拆分:原文案 / 分镜头N [时间轴] 场景:...

风格:【动漫风格 / 3D动漫风格】
【2-15秒版追加】不要背景音乐;在提示词前加上指定句,加画外音并标注出处。

角色信息:
【粘贴角色信息库】

章节文案:
【粘贴待拆分的文案】

模板 ⑧:角色设定卡(一致性核心,环节 ③)

请为以下角色建立角色设定卡:

角色信息:【角色描述】

【角色设定卡 - 固定不变区】
角色名:
性别/年龄段:
身高体型:
气质关键词(3个):
发型(长度+类型+颜色):
五官特征(最多3个):
皮肤色调:
标志物(必须有1个):
主穿搭:
主色系:
禁止出现项:

【固定角色描述 - 每次必带】
(英文,每个镜头的Prompt中一字不差地复制粘贴)
例:A 25-year-old Asian male, short messy black hair, black-framed glasses...

【画风设定 - 固定不变区】
整体画风:
光线风格:
色彩倾向:

【固定画风后缀 - 每次必追加】
例:realistic manga style, cinematic lighting, dramatic composition, 8k

【AI提示词模板】
【固定角色描述】 + [表情/动作/场景] + 【固定画风后缀】

模板 ⑨:动作戏分镜(环节 ⑥ · 专项)

适用:武侠/仙侠/枪战/格斗/超能力/怪兽/机甲/追逐等。完整规则见主流程 6.11。

我要拍一段【时长】的【动作类型】动作戏:
主体:【谁 / 几人 / 身份】,战斗目的:【】,胜负条件:【】
武器/能力:【】,环境:【场景/天气/地形/可利用物】
风格:【真人电影 / 3D动画 / 写实 / 动漫】,镜头偏好:【一镜到底 / 多镜头】
开场要求:【】【可选:紧凑/刺激】,结尾:【】【可选:悬念/干净收束】

请按 AI ACTION SCALE V6.0 执行:
1) 建立 Combat DNA + 空间地图 + 战术关系
2) 按因果链:【意图→动作→交互→结果→反馈→下一动作】
3) 超过3秒的复杂动作先拆 Shot(一 Shot = 一主要动作+一结果+一摄影任务)
4) 输出:①一句话理解 → ②时间抽 Shot 分镜(景别/机位/焦距/光圈/物距/运镜/动作/结果/剪辑) → ③一整段可复制 Prompt + AI 生成约束

模板 ⑩:电影运镜设计(环节 ⑥ · 专项)

完整规则见主流程 6.12。

场景:【主体 + 环境 + 动作 + 情绪 + 想要的效果】

请按「光圈×焦距×物距×对焦×摄影机运动」五变量输出:
【运镜核心】【摄影机运动】【焦距变化:起→止】【光圈变化:起→止】
【物距变化:起→止】【对焦变化】【空间变化】【节奏】
【最终 AI 视频 Prompt】【负面约束】

要求:必须写明“摄影机真实移动”;推拉必须区分真 Dolly 与数字变焦;
参数变化必须有因果关系,禁止无意义堆叠运镜。

模板 ⑪:方言配音控制(环节 ⑦)

完整 50 套词典见 02_素材整理/2026-09-21新增/04_全国50套方言AI配音控制词典.txt

请按方言配音控制词典,为以下台词生成配音控制要求:
地区/城市:【】,人物年龄:【】,方言强度:【默认“明显但不影响理解” / 纯方言】
台词:【】

要求:以当地年轻人真实日常口语为基准;自然、连贯、清晰;
禁止播音腔/舞台腔/刻意学方言腔;台词与口型严格同步;
不得混相邻地区口音(西安≠兰州、成都≠重庆、广州≠港台)。

模板 ⑫:夸张表情提示词(环节 ③.5.1 · 专项)

完整 27 组表情提示词见 01_原始素材/2026-09-21新增/AI夸张表情提示词完全教程.md

【角色基底(固定不变,逐字复制)】
古风少女,鹅蛋脸,柳叶眉,杏仁眼,乌黑长发高髻配银色发簪,淡蓝交领襦裙,皮肤白皙细腻,五官精致

【表情:{情绪名}】
- 眼睛:【瞳孔缩成针尖 / 放大占满眼眶 / 变螺旋蚊香 / 死鱼横线 / 金币符号】
- 眉毛:【倒刺 V 形 / 飞起 / 紧皱川字 / 一高一低】
- 嘴巴:【O 型张大 / 咧到耳根 / 嘴角下垂 / 咬牙 / 喷水喷火】
- 脸颊:【涨红 / 发白 / 汗珠挂脸 / 泪流成河】
- 面部:【青筋暴起 / 扭曲变形 / 五官被拉扯位移】

【漫画符号特效(按情绪选用)】
【大感叹号(!!) / 震动线 / 速度线 / 螺旋眼 / 头顶星星 / 火焰浓烟 / 瀑布泪 / 金币雨 / 炸毛 / 灵魂出窍 / Zzz…】

【风格后缀(固定)】
特写镜头,8K 细腻皮肤质感,国风插画风格,夸张漫画表现

【负面提示词】
面部变形扭曲(非刻意夸张时)、多余手指、五官错位、模糊、低分辨率、画风不一致、现代物品、文字水印

⚠️ 铁律:写「她很生气」无效,必须写「眉毛倒竖 V 形 + 双眼发红 + 头顶喷火 + 青筋暴起」。模型只认像素,不认情绪。


模板 ⑬:场景氛围提示词(环节 ⑤ · 5.4)

【氛围 7 要素公式】
{角色} + {具体地点} + {时间} + {光源} + {天气/空气} + {空间细节锚点} + {情绪目的}

【示例】
黑衣少年站在雨夜旧巷尽头,深夜冷蓝月光从屋檐缝隙落下,湿石板路反射远处暖黄灯笼,
空气有薄雾和细雨,墙角有一枚破碎玉佩,整体氛围悬疑压抑,像真相即将被揭开。

【自检】
- 地点具体(禁"古风场景"这类大词)
- 光源有方向、有冷暖对比
- 至少 1 个细节锚点(旧物=线索)
- 遮住人物仍有故事感

模板 ⑭:写实微表情提示词(环节 ③.5.2 · FACS 五层)

【第一层 身份锚定】{年龄}{脸型}{发型}{五官}{肤质}{服饰}{体态}
【第二层 情绪基调】(视觉具象化,禁 happy/sad 抽象词)
【第三层 肌肉运动】状态 + 部位 + 幅度 + 时长 + 衔接
   例:双眼瞬时睁大至瞳孔外露18%,持续0.35秒,随后缓慢恢复自然
【第四层 时序编排】
   0-3秒:{初始状态}
   3-6秒:{触发反应}
   6-10秒:{情绪高峰}
【第五层 环境联动】{光影方向}{景别:超近面部特写}{氛围}
【技术参数】4K,面部稳定,五官清晰,无模糊无闪烁

【中英混写】中文场景情绪 + 英文肌肉术语(lip corner puller AU12 激活)

模板 ⑮:声音资产卡 + 多人对白标注(环节 ⑦ · 7.2)

【声音资产卡】(每角色一张,跨集复用)
角色名 / 类型 / 音色描述 / 参考音频文件 / 语速(字/分) / 音调 /
默认情感 / 可变范围 / 版本号 / 变更日志

【多人对白标注格式】
男主(@音频1)站在门口,表情严肃:"把宝物交出来。"(语气:冷静、克制)
女主(@音频2)后退一步,声音颤抖:"什么宝物?我不知道。"(语气:害怕、紧张)

【区分度检测】闭眼听:仅凭声音能分辨谁在说话吗?

模板 ⑯:配音情绪标点(环节 ⑦ · 7.3)

【标点遥控器】
,=0.3-0.5s呼吸  。=0.6s+结束  ……=拖尾犹豫  ——=情绪反转
()=气声耳语  []=不发音指令([停顿一秒][深吸一口气])  ?!=又惊又疑
!上限3个

【状态公式】状态提示词 + 标点控制
(虚弱、气息不稳)我没事……真的没事。

【一句话渐变】前段温柔(语速85%音高+0.5) → 0.5s停顿 → 后段愤怒(语速125%音高+2.5)

【对口型】中近景嘴可见 / 语速不过快 / 单段≤15秒

模板 ⑰:短剧剧本黄金公式(环节 ①② · 专项)

【结构】开场3秒钩子(冲突/反转/悬念)
→ 第1集:建立人物 + 抛出问题
→ 第2-N集:每集一个小冲突 + 一个钩子(结尾留悬念)
→ 最后集:高潮 + 反转 + 留余味(为续集埋伏笔)
【体量】每集 45-90 秒;总集数 8-16 集

【硬规则】
❌ 不写闲聊场景(画面要求低、留存最低)
✅ 每集必须有「画面事件」:摔杯子/推开门/手机响/表情变化
❌ 对话 ≤3 轮/集(靠画面和表情讲故事)
✅ 每个转折点加「视觉符号」:戒指特写/雨中的伞/微信弹窗

模板 ⑱:一致性技术栈选路 + 视觉契约(环节 ③④ · 专项)

【第1步:选一致性路线(按项目体量)】
□ 快速风格化短剧        → Midjourney V7:--cref + --cw 80(+ --niji 7 做二次元)
□ 动作复杂/需精确构图   → ComfyUI + SD3.5/SDXL:IP-Adapter FaceID Plus v2 + ControlNet Reference + ADetailer
□ 长期连载 IP(百集)   → LoRA / Dreambooth,30-50 张不同角度/表情/光照图微调

【第2步:视觉身份证(每角色一份,固定不变)】
角色名:
固定核心描述(一字不差):如「25岁男性,黑色连帽卫衣,暗黑系国漫风,眼角有痣」

【第3步:提示词权重控制(锁不变项 / 放可变项)】
高权重(铁律):发型 / 瞳色 / 标志性服饰 / 标志物
低权重(可发挥):场景光影 / 肢体动作 / 表情
崩坏处理:只对问题区域做局部重绘,配高权重正确描述(如「修长的手指」)

【第4步:母版与环境光融合】
场景母版:为每个关键场景定一张色调/光影/风格母版,同场景所有分镜以它为准
角色入景:生成角色时叠加环境光描述(『置身阴雨街角,被霓虹灯漫反射照亮』)

【第5步:预览验收】
批量生成前先看关键镜头草稿 → 偏差即回改权重/描述 → 再进视频生成

模板 ⑲:上线合规自查清单(环节 ⓿ / 上线前 · 2026 新规)

【一、备案与资质】
□ 已按投资额+题材定层级:≥300万/敏感=总局发证 | 100-300万=省级备案 | <100万=平台自审+省级报备
□ 制作方持《广播电视节目制作经营许可证》(个人:签约MCN/挂靠持证公司)
□ 先备案后上线(2026-04-01 起,未备案存量已全网下架)

【二、AI 强制标注】
□ 片头/显著位置已标注;纯AI「AI生成」 vs AI辅助「AI辅助生成」分开标
□ 封面+标题+片头 双/三重标注;片头≥3s、字号≥画面短边5%

【三、内容红线自查】
□ 无极端复仇/以暴制暴/拜金炫富/畸形婚恋/美化出轨家暴
□ 无色情擦边/性暗示/暴露服饰/低俗封面标题
□ 无封建迷信(算命/风水/灵异/玄学改命)
□ 无血腥暴力/私刑/人格羞辱;无歧视对立
□ 未成年人保护(无早恋/霸凌/抽烟喝酒/成人化剧情)
□ 无 AI 魔改经典/英模/英雄人物;无未授权真人肖像与声音(无 AI 换脸明星)
□ 画风无邪典/丑陋/过度暴露;无观感不适

【四、版权存证】
□ 留存 AI 提示词 / 参数 / 生成日志 / 素材授权合同
□ 剧本已查重(无抄网文剧情/搬运 IP 人物关系)

模板 ⑳:标准化分镜脚本字段表(环节 ⑥ · 多集工程化 🆕)

配合 6.17。多集批量生产时,分镜脚本用固定字段表提交,便于逐行读取/批量出图。

请作为分镜导演,把剧本拆成【标准化分镜脚本表】(每镜一行):

字段(固定 13 列,不得缺项):
集数 | 镜头号 | 时长建议 | 场景 | 角色 | 景别 | 画面描述 | 动作 | 情绪 | 对白/旁白 | 出图提示词 | 图生视频提示词 | 质检标准

要求:
- 镜头间有连续性;角色外貌/服装/场景风格保持一致;
- 单镜不塞太多动作;优先出适合图生视频的清晰画面;
- 每镜均可独立生成分镜图。

集数命名:EP01 / EP02 …;镜头号:S01 / S02 …;时长:3-5 秒为主
场景示例:深夜办公室,冷色灯光
质检标准示例:人物一致、场景一致、动作合理

批量生产附加要求(选填):
- 支持 EP01/EP02/EP03 批量;已完成镜头可跳过(断点续传);
- 生成失败自动重试 N 次并记录原因(失败重试);
- 完成后推送通知。

模板 ㉑:平台选型决策表(环节 ⑨ 发行 · 运营 🆕)

配合 9.2。出片前先定平台,避免“做完才想发哪里”。

【我的漫剧发行选型】
1. 团队档位:☐零基础个人 ☐单人连载 ☐小工作室(2-4人) ☐MCN量产 ☐技术自部署 ☐出海
2. 题材:☐男频玄幻/都市 ☐女频甜宠/豪门 ☐家庭伦理/乡村 ☐二次元/国漫 ☐悬疑/科幻 ☐其它____
3. 主发平台(参考 9.2):________(备选:________)
4. 工具组合:出图____ + 视频____ + 配音____ + 剪辑____
5. 单集时长:____ 分钟(竖屏漫剧 3-5 分钟)
6. 更新频率:每周 ____ 集
7. 成本预算:单集 ____ 元(含算力+投流)
8. 选型硬标准自检:☐跨镜头不变脸 ☐自动拆分镜 ☐9:16竖屏 ☐中文语境 ☐低成本日更

模板 ㉒:发行变现自检清单(环节 ⑨ · 上线前 🆕)

配合 9.5 / 9.3。每次上线前逐项勾选

【发行前自检】
☐ 平台与目标受众匹配(见 9.2)
☐ 免费 IP 改编已获授权(防侵权,见 2.3/附F)
☐ 已备案 + 持证 + AI 标注(先合规后上线,见 2.3/附F)
☐ 开场 3 秒强钩子 + 每 30 秒一个反转
☐ 单集时长与平台匹配;前 5-10 集免费引流
☐ 算力/投流预算已核算(避免“制作降本、买量烧钱”剪刀差)
☐ 分账条款已核对平台最新规则(政策高频变动,以官方为准)

模板 ㉓:卡点排查 & 单变量返工表(环节 ⑥ · 诊断 🔧)

配合 6.18。卡住时先判层,再单变量返工——不要一次性改一堆提示词。

【第一步:判层】
连续 3 次生成都「方向不对」 → 结构层:查剧本 / 分镜
方向对但细节不稳           → 执行层:改提示词(角色固定 / 负面词)
删掉某镜信息无损失         → 该镜是装饰镜头,删

【第二步:按层修】
☐ 剧本不可生成 → 内心戏改成「画面/动作/道具」
☐ 角色不固定   → 先写角色卡(固定项+禁止变化),再写镜头
☐ 分镜没任务   → 每镜补一处「信息增量」
☐ 提示词过散   → 建母版:画风母版 + 角色固定 + 镜头变量 + 负面提示词

【第三步:单变量返工】
本轮只改【  】一个变量;其余保持不动 → 重生成 → 记录结果
仍不稳再改下一层(负面词 / 分镜任务)

模板 ㉔:转场衔接 & 后期打磨速查(环节 ⑧ · 合成 🆕)

配合 8.2 / 8.3(源自北航手册)。默认硬切;跨镜不顺畅时才用过渡三法。

【跨镜过渡三法】
☐ 首尾帧补间:上传前后场景图 → 生成自然过渡(场景硬切,如办公室→校园)
☐ 运镜驱动:用「推进 + 环绕」隐藏剪辑点(同场景时空推进)
☐ 元素关联:共同视觉元素延续(文件 A镜→B新场景)
⚠️ 首/尾帧必须同角色设定 + 同场景母版,否则补间放大不一致

【节奏卡点】
☐ 冲突场景:短镜头 2-3 秒/个
☐ 抒情场景:长镜头 4-6 秒/个
☐ 反转/爆点:0.5 秒定格 + 文字特效(如「真相竟然是?」)

【字幕 / 画质 / 标签】
☐ 字幕:字体统一(黑体/思源黑体)+ 白字幕黑描边 + 关键台词放大
☐ 画质:全片 30fps;分辨率按 8.1(1080×1920)
☐ 标签:#AI漫剧 #原创剧情 #短视频爆款 + 垂直标签

模板 ㉕:声音设计 & 画幅适配速查(环节 ⑧ · 合成/发行 🆕)

配合 8.4 / 8.5(源自音乐骤停专文 + 配乐 7 步法/画幅专文)。

【音乐骤停】
☐ 找爆点:台词关键信息 / 关键动作 / 推动剧情的道具
☐ 三大时机:高潮 / 反转 / 重点(缺一不算最佳)
☐ 操作:关键词出口后半拍「BGM 硬切(非淡出)+ 低频咚」;固定镜头
☐ 按类型:喜剧反差 / 信息强调 / 悬念营造 / 高光展示

【配乐 7 步法】
☐ ① 主题动机:3-5 音符,整片反复变奏(一次生成 原型+3变奏)
☐ ② 情绪曲线:每 30 秒标一个情绪值 -5~+5(music breakdown)
☐ ③ 动态布局:ppp 30% / mp-mf 50% / ff 仅 5-10%(只给 1-2 个高潮)
☐ ④ 配器留白:prompt 标 include rests;单乐器/4拍空气/silence
☐ ⑤ 流程:主题先行→6-8 cue→过渡+混音+对位
☐ ⑥ 混音:人声 -16 LUFS / 配乐有人声段 -28 LUFS 削200-500Hz / 真峰 -1 dBTP
☐ ⑦ 对位:A 节拍 / B 情绪 / C 动作(Mickey-mousing)

【音效 & 混音】
☐ 后期四步:音轨分离整理→音效重建→音效检查→音效层次优化
☐ 三层平衡:对白最清晰 > 配乐 > 音效(示例 100/40/60);音效可时间轴分段

【画幅适配】
☐ 竖屏 9:16(1080×1920,抖音/快手/红果)/ 横屏 16:9(1920×1080,B站/腾讯/爱奇艺/YouTube)
☐ 一套素材多用:安全区间构图(主体锚中央、四周留余量),导出两版

模板 ㉖:本地/离线全流程速查(环节 ④⑥⑦⑧ · 低配/零预算 🆕)

配合 附G / 附H(源自阿里云本地教程 + Gist 调研)。适合:8G 显存、免 API、隐私敏感、想无限次生成

【硬件】NVIDIA 独显 8G 显存 + 内存 16G(32G 更顺)+ Win10/11
【链路】本地 Qwen 写分镜 → ComfyUI 画统一角色 → LTX2.3 图生微动 → Qwen3-TTS 配音 → FFmpeg 合成

【环境】Python3.10(勾 Add to PATH)/ Git / FFmpeg
        显卡加速:pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu121

【分镜脚本】ollama pull qwen2.5:14b-q4_K_M
        → 提示词要求输出 JSON 分镜数组(字段:镜号/正向描述/负面描述/动作/台词/时长3-5s)
        → POST localhost:11434/api/generate 存 comic_scene.json

【ComfyUI 插件(防变脸/闪烁/爆显存)】
  ☐ IP-Adapter Plus FaceID(锁五官·跨镜不变脸,核心)
  ☐ ComfyUI-LTXVideo(本地图生视频微动)
  ☐ DWpose ControlNet(骨骼姿态、防肢体畸形)
  ☐ KJNodes(批量循环渲染 + 本地文件读写)
  ☐ Qwen-TTS-ComfyUI(内置本地配音节点)

【低配最优固定角色组合】固定一张角色正面人设参考图 + IP-Adapter-FaceID 权重 0.65 + DWpose 骨骼控制 → 循环批量生成所有镜头

【模型路径】checkpoints(Flux-Schnell量化/SD1.5漫画)/ ipadapter(FaceID)/ ltx_video(LTX2.3量化)/ controlnet(DWpose)

【效率参考】零基础六步:选题+剧本20min → 角色设定 → 分镜图30min → AI动态 → 配音20min → 剪辑30min
【开源项目】waoowaoo(剧本→角色→分镜→视频全自动)/ Huobao Drama / 魔因漫创 / DirectorAI / 智剧通

模板 ㉗:AI 译配 & 出海本地化速查(环节 ⑨ 发行 · 多语种 🆕)

配合 附I(源自腾讯云 9 语种流水线 + 小云雀出海实操)。适用:成片要出海/多语种发行

【七步译配流水线(单价口径)】
  ① 去字幕无痕 3 元/分钟 → 干净母版
  ② ASR 识别 0.03 元/分钟
  ③ 大模型翻译 0.20(首语)+0.05×8(附加) 元/分钟
  ④ OCR 提取并翻译 0.80 元/分钟(画面内招牌/聊天/合同)
  ⑤ AI 配音:高情感克隆 9 / 音色 ID 0.5 / 克隆 25 元/音色一次性
  ⑥ 字幕压制 0.063 元/分钟
  ⑦ 智能审核 0.08 元/分钟(分区合规:中东严控亲密/欧美暴力分级/东南亚宗教)

【成本口径】100 集×9 语种 ≈2433 元(90 集成品)→ 单集≈2.7 元(降至人工 1/10)
【48h 流程】0-6h 擦除+ASR+OCR → 6-18h 翻译+克隆 → 18-36h 配音 → 36-44h 压制+审核 → 44-48h QC

【音画同步三层(防“嘴闭音未停”)】
  ☐ 偏差 5-20% → TTS 语速参数调整
  ☐ 偏差 20-40% → 约束改写台词
  ☐ 偏差 ≥40% → 混合策略

【本土化再生产(非翻译搬运)】
  ☐ 剧本语境重构(本土编辑改写不合当地文化的桥段)
  ☐ 镜头画面重制(欧美面孔/美式场景/当地风格)——直接从剧本生本土化素材
  ☐ 多语种情绪配音(避免“翻译腔”)
  ☐ 转绘三参数:风格 / 比例(竖屏 9:16 适配 TikTok·Reels)/ 目标地区

【ROI】① 配音分层:S 级钩子集高情感克隆 + 长尾集音色 ID
         ② 音色 ID 库入库复用(省 25 元/音色克隆)
         ③ “擦除+OCR+翻译”打包母版工厂 → 先干净母版再按平台二次烧字幕

模板 ㉘:爆款钩子 · 封面 · 标题速查(环节 ①②⑧⑨ · 首屏运营 🆕)

配合 ①.2 与 9.7(源自塔猴十大钩子公式 + 小云雀连载观察,素材 27)。适用:定开场钩子 / 做封面标题 / 多集连载。

【黄金3秒双机制·自检】
  ☐ 视觉补偿:前3秒是否有“现实拍不出”的画面(奇观/废墟/极致美学)?
  ☐ 预期管理:3秒内是否抛出待解决的矛盾(死里逃生?认知颠覆?)?
  ☐ 音效先行:重音弹起/心跳突停/古风杀伐声是否早于画面撞进大脑?

【十大钩子公式(题材×冲突)】
  1 视觉奇观+身份反差  2 仙宫审判+极致欺压  3 规则怪谈+生存惊悚
  4 降维打击+爽点先行  5 时空错位+文明碰撞  6 悬念留白+颠覆认知
  7 末日绝境+终极抉择  8 宿命之问+跨越轮回  9 血染红妆+浴火重生
  10 刑场归来+身份置换

【AI 生成钩子提示词(填剧本主题 + 公式类型 → 出 5 个钩子)】
  你是年产出千万级爆款AI短剧主编。基于【剧本主题=__】【公式类型=__】创作5个
  黄金3秒开局钩子,每个须给:①视觉分镜描述(光影/色彩/主体动作,便于生图)
  ②扎心台词(≤25字,带刺/带悬念/强情绪压抑)③留存解析(为何产生“视觉重力”不舍划走)

【避坑 3 条】
  ☐ 钩子为“视觉奇观”→ 务必高精度生图(古装女频的丝绸/珠宝质感=女性代入关键)
  ☐ 音效先行(不能只靠画面)
  ☐ 切忌文不对题(钩子≠后续内容 → 高跳出)

【封面(点击率入口)】
  ☐ 复用开场3秒最强一帧(不另起炉灶)
  ☐ 主体居中/三分法,人脸情绪特写优先;竖屏留文字安全区
  ☐ 主文案 ≤8字,强对比色+描边
  ☐ 封面文字与内容一致;连载用统一模板/角标
  ☐ 叠加 AI 生成/辅助标注(见 2.3 / 附F)

【标题公式】悬念 + 情绪 + 身份(同 8.1)

【追更/连载运营】
  ☐ 单集结尾留钩子、中段张力层层加码
  ☐ 跨集:角色一致 / 世界观延续 / 多人并行 / 成片接续可剪
  ☐ 沉淀两样资产:审美判断 + 可逐季开发的角色/世界观库

模板 ㉙:零代码编排 & Pipeline 速查(环节 ⑥⑦ · 智能体/自动化 🆕)

配合 6.19 / 7.5 与 附J(源自 Dify+ComfyUI 零代码 + 腾讯云视频 Pipeline,素材 28)。适用:想用智能体/工作流把工具串成自动化生产线。

【分层心智】
  编排层(大脑)= Dify / n8n:剧本生成·分镜拆解·多 Agent 协作·JSON 结构化·循环批量
  执行层(双手)= ComfyUI:出图·图生视频·配音(IP-Adapter + ControlNet 锁角色)
  粘合协议 = MCP(统一 AI 服务调用)  合成 = FFmpeg

【Dify + ComfyUI 四步】
  ☐ ComfyUI 工作流 → Save (API Format) 导出 JSON
  ☐ Dify Marketplace 装 ComfyUI Plugin
  ☐ Dify Tools → ComfyUI 填 服务器 URL
  ☐ 添加「ComfyUI Workflow」节点:传 JSON + 变量(prompt/seed)

【多 Agent 分工】编剧 Agent(②) → 导演 Agent(⑥) → 提示词优化 Agent(③④)

【四种 Pipeline 选型】
  MoneyPrinterTurbo        ★    15min   个人/零基础(主题→成片)
  narrator-ai-cli + Skill  ★★   30min   Agent 集成(40+ 原子接口)
  n8n + ComfyUI + MCP      ★★★  1-2h    团队/可复用可视化模板
  编排层 + 漫剧 Skill     ★★   30min   批量漫剧/解说

【n8n 节点串法】Webhook → 调 LLM 出文案 → Code 解析分镜 → 调 ComfyUI API 出图/视频 → FFmpeg 合成 → 回传

【提效/避坑】
  ☐ 角色一致性:编排层建「角色知识库」(参考图+固定描述+LoRA)并引用
  ☐ 显存:FP8/GGUF 量化(12G 可 1080P);OOM → 降分辨率/减批量
  ☐ FFmpeg 找不到 → 加 PATH / 绝对路径;素材 API 空 → 换源+兜底
  ☐ 低配路线:云端编排 + RunPod 租卡跑 ComfyUI

模板 ㉚:开源工程管线速查(环节 ③④⑥⑦⑧ · 自建管线 🆕)

配合 ③.6.2 与 附G(源自 某厂算法工程师《AI 漫剧全流程制作实战》,素材 30)。适用:想脱离一站式平台 / ComfyUI 图形界面,用 diffusers 自建可复现工程管线(A100 每天 10 条)。

【整条管线】主题 →[LLM]结构化分镜JSON →[LLM]SD正负提示词+ControlNet
  →[一致性]LoRA+IP-Adapter →[关键帧]SDXL+ControlNet(OpenPose/Depth) 4~6帧/场景
  →[动态]AnimateDiff v3 16帧 →[音频]Edge TTS →[口型]Wav2Lip+GFPGAN →[合成]MoviePy+FFmpeg

【双 LLM 分工】
  LLM-1(GPT-4/Qwen-72B):故事大纲+分场 → 固定 JSON
      字段 scene_id/location/characters/visual_desc/dialogue[{speaker,text}]/duration_sec
  LLM-2(Mistral-7B):visual_desc → SDXL 正/负提示词
  ⚠️ 强调「只描述静态画面」,动态交给 AnimateDiff(否则 LLM 输出「镜头移动」等非视觉词)

【LoRA 训练 Kohya_ss】20 张/角色(不同角度表情)· lr=1e-4 cosine · warmup100 · batch2 · epoch10
  · network_dim32/alpha16 · loss ~800 步趋稳(≈0.12) · ≈96MB
  ⚠️ 服饰单一易过拟合 → 混入不同背景 + lr 降至 5e-5

【一致性三板斧】
  ☐ 每场景内所有关键帧同一 seed(不同场景不同 seed)
  ☐ 新颖场景首帧用上一场景末帧作 ControlNet 姿势引导(防跳跃)
  ☐ IP-Adapter 权重动态:表情变化大时 0.8→0.5(让 prompt 主导)

【AnimateDiff v3 调参】num_frames16 · context_length16 · context_overlap4 · fps8→24 · motion_scale1.0
  对话特写 0.6~0.8(防五官扭曲)· 全景走动 1.2~1.5+Depth(防背景漂移)· 闪烁→guidance6.0+overlap6
  运动只用 zoom in/out + pan left/right(旋转易崩)

【音频/口型】Edge TTS 中文情感=style('sad'),每角色固定 voice,pydub 剪首尾静音
  Wav2Lip 预处理:retinaface 检测+直方图均衡;GFPGAN 仅增强人脸区域
  ⚠️ 侧脸/遮挡效果差 → 仅正面说话特写做口型,远景/背对省略

【合成】moviepy 分段合成 + FFmpeg concat;crossfadein(0.5);中文字体必装否则乱码

【性能】A100 单场景:LLM3s+关键帧25s+AnimateDiff60s+TTS/口型20s+合成5s → 10场景≈18min
  AnimateDiff 16帧≈14GB 显存;出图后 empty_cache();多任务 CUDA_VISIBLE_DEVICES 隔离

【错误修复表】衣服颜色突变→IP-Adapter 0.6+颜色约束 | 视频闪烁→overlap6+scale0.8
  | 口型滞后→统一 FPS24/音频16000 | 音画不同步→用 audio.duration 截视频

二、制作自检清单(每步必过)

⓿ 台词分幕

  • [ ] 原文 100% 保留,无遗漏/截断/改写
  • [ ] 台词与旁白正确区分
  • [ ] 单条 ≤50 字,拆分符合同一角色
  • [ ] 情绪/强度均来自给定列表;旁白=平静/中等
  • [ ] 输出为合法 JSON 数组

①② 改文 / 转剧本

  • [ ] 具备爆款四要素(开头钩子 / 高潮 / 反转 / 爽点)
  • [ ] 开场 3 秒钩子(黄金3秒双机制:视觉补偿 + 预期管理;公式见 ①.2)
  • [ ] 勾子避坑:拒绝视觉廉价感 / 音效先行 / 文不对题
  • [ ] 开篇 3 秒有强钩子(冲突/绝境/反转/悬念)
  • [ ] 爽点密度达标(80字小爽点 / 200字大爽点)
  • [ ] 段尾留钩;章尾留终极钩子
  • [ ] 单章 800-1000 字;合规无违禁
  • [ ] 场景已拆到「场次→镜头」粒度
  • [ ] 漫剧长度设定(①.1 可选):填了整部集数/时长 → 正文按此体量规划分集与卡点;留空则自由发挥
  • [ ] 黄金公式(模板⑰):3 秒钩子;每集有「画面事件」;对话 ≤3 轮/集;每转折点有视觉符号
  • [ ] 合规前置(2.3 / 模板⑲):无极端复仇/拜金/封建迷信/魔改经典/未授权肖像声音;已定备案层级与资质

③ 人物 & 道具

  • [ ] 每个角色四风格提示词齐全且核心描述一致
  • [ ] 五官具体(脸型/眼型/眉形/鼻型/唇形均有)
  • [ ] 含至少 2 个带风格前缀的美学词汇
  • [ ] 人类角色眼睛为自然色系(GPT版可异色)
  • [ ] 敏感词自查通过;服装 ≥4 种材质;禁"宽腰封"
  • [ ] 角色设定卡已建(含标志物 + 禁止项)
  • [ ] 角色标准像已录入主体库/数字资产库,后续镜头强制参考(③.7)
  • [ ] 一致性路线已选(③.6.1):快速风格化 --cref/--cw|动作复杂 IP-Adapter FaceID+ControlNet|百集连载 LoRA
  • [ ] 视觉契约已建:视觉身份证 + 权重控制(锁发型/瞳色/服饰)+ 批量前预览验收

③.5 表情矩阵

  • [ ] 5×2 十宫格,纯白背景
  • [ ] 同一张脸,仅表情变化
  • [ ] 编号 01~10 + 小字标注
  • [ ] 整体 16:9(每格正方形)

③.5.1 夸张表情(搞笑/名场面)

  • [ ] 角色基底描述逐字复制,只改表情段(防崩脸)
  • [ ] 五官分项写(眼/眉/嘴/脸颊),无「很生气」类模糊情绪词
  • [ ] 按情绪选对漫画符号(震惊→感叹号/震动线;愤怒→火焰/青筋…)
  • [ ] 风格后缀固定(特写 + 8K + 国风插画 + 夸张漫画表现)
  • [ ] 负面提示词已加(畸变/多指/水印)

③.5.2 写实表情/微表情(正剧/情感戏)

  • [ ] 一镜一主情绪;表情戏用近景/特写
  • [ ] 5 要素齐(眼神/眉毛/嘴角/身体反应/剧情状态)
  • [ ] 微表情用五层架构;肌肉写量化幅度(3mm/18%/0.35s)
  • [ ] 情绪递进拆镜,不突然爆炸

④ 三视图

  • [ ] 顺序正确:面部 → 全身像(面部为参考)→ 三视图
  • [ ] 三视/头像/细节三区齐全,同一角色一致
  • [ ] 横版白底、不裁切、无文字/水印/UI

⑤ 场景

  • [ ] 画面中无人(无人纯场景)
  • [ ] 固定开头正确;场景命名四字以上
  • [ ] 视角为宏大/仰视/深远之一(禁微距)
  • [ ] 两套格式都输出(专业设定表 + GPT版指令词)
  • [ ] 氛围 7 要素(5.4):地点具体/光源方向/天气参与叙事/至少1个细节锚点/情绪目的明确

⑥ 分镜

  • [ ] 六维一致性全过(人物/时空/物品/动作/台词/敏感)
  • [ ] 中文引号;video_prompt ≤500 字
  • [ ] 视频提示词含角色映射 + 衔接前置指令
  • [ ] 景别以近景/特写为主(空间/换场/动作尺度镜除外
  • [ ] 台词时段标注"镜头稳定,不推拉"
  • [ ] 分镜数 = 文案条目数
  • [ ] 动作戏(6.11):每个 Shot = 一动作 + 一结果 + 一摄影任务;因果链完整;受力可见;中段有战术变化
  • [ ] 运镜(6.12):写清“摄影机真实移动”;推拉区分真 Dolly / 假变焦;参数变化有目的
  • [ ] 智能分镜(6.10b):按情绪/关系选镜头角度(如愤怒=特写+仰视);动态分镜预览在进入视频生成前完成
  • [ ] 动作表演(6.14):一镜一主动作;5 段齐(起始/触发/过程/结束/情绪);手部动作有戏
  • [ ] 运镜即用(6.15):一镜一主运镜;运镜跟人物动作走;景别任务明确
  • [ ] 质感(6.16):质感词服务题材;一条一主质感;写画面结构不写形容词
  • [ ] 多集工程(6.17):分镜用标准化字段表(13 列);资产库四类(角色/场景/风格/提示词)齐备;逐镜质检清单过(变脸/服装/跳变/畸形/情绪)
  • [ ] 卡点排查/返工(6.18):每镜有「信息增量」;连续 3 次方向不对先查剧本/分镜;返工每轮只改一个变量(模板㉓)
  • [ ] 编排/自动化(6.19 / 7.5):批量生产时是否有编排层(Dify/n8n)串起 ③④⑥⑦;角色知识库是否被引用;显存是否量化(模板㉙)

⑦⑧ 视频 / 剪辑

  • [ ] 单帧/首尾帧;不用多帧/中间帧
  • [ ] 首尾帧写了过渡效果
  • [ ] 尾帧静止已补单帧视频衔接
  • [ ] 音效音乐衔接丰富过渡
  • [ ] 口型与台词同步
  • [ ] 方言配音:查 7.1 方言词典;禁播音腔/舞台腔;不混相邻地区口音
  • [ ] 声音一致性(7.2):每角色有声纹锚点(3-5s);对白标注角色名+@音频N+语气;闭眼区分度过
  • [ ] 配音情绪(7.3):标点是遥控器(……/——/()/[] 用对);!≤3个;单段对白≤15s;有情绪变化不一调到底
  • [ ] 转场/字幕(8.2/8.3):跨镜过渡三法(首尾帧补间/运镜驱动/元素关联,默认硬切);冲突 2-3s、抒情 4-6s;爆点 0.5s 定格;字幕黑体+白字黑描边(模板㉔)
  • [ ] 声音/画幅(8.4/8.5):爆点处音乐骤停(BGM 硬切+咚、固定镜头);配乐 3-5 音符动机+每 30s 情绪曲线+动态 30/50/10;三层混音对白>配乐>音效、人声 -16 LUFS;竖屏/横屏一套素材多用(安全区构图,模板㉕)
  • [ ] 成片导出规格(8.1):MP4 / 1080×1920 竖屏 / 30fps / 码率 8000-10000 kbps
  • [ ] 上线合规(模板⑲):已备案(分级)+ 持证;AI 标注(纯AI/AI辅助分开);内容红线自检;版权存证
  • [ ] 批量容错(7.4):多集批处理 + 断点续传(已完成镜头跳过)+ 失败重试记录;节奏基准单集≤ 3min、每镜 3-8s
  • [ ] 本地/开源选项(附G/附H):预算/隐私敏感可走本地链(Ollama+ComfyUI+LTX+FFmpeg,8G 显存,免 API);要二次开发参考 waoowaoo 等开源项目
  • [ ] 发行变现(⑨ / 模板㉒):平台与受众匹配;免费 IP 已授权;备案+持证+AI 标注;3 秒钩子+每 30 秒反转;算力/投流预算核算

三、景别 / 视角 / 运镜 速查表

景别(按距离由远到近)

景别 用途
远景 重氛围环境,弱化主体
全景 主体全貌 + 核心环境
中景 动作 + 局部环境
近景 局部细节,强化近距离感
特写 极小局部,情绪冲击
微距 微观极致放大

视角

平拍 / 仰拍 / 俯拍 / 第一人称 / 第三人称 / 微俯 / 微仰 / 鸟瞰(无透视)/ 虫眼 / 侧拍 / 斜侧拍

运镜

基础 6 种:推镜 / 拉镜 / 摇镜 / 移镜 / 跟拍 / 固定 创意组合:镜头穿梭机 / 环绕 / 升降 / 甩镜 / 变焦 / 晃动 / 滑轨

🔗 进阶用 6.12 五变量运镜系统(光圈×焦距×物距×对焦×摄影机运动);动作戏用 6.11 的 CAM01–CAM20 运镜库

情绪 & 强度(台词分幕用)

情绪:高兴 / 生气 / 伤心 / 害怕 / 厌恶 / 低落 / 惊喜 / 平静 强度:微弱 / 稍弱 / 中等 / 较强 / 强烈


四、时长估算公式(分镜用)

类型 公式/时长
台词(正常语速) 字数÷8+1 秒
台词(争吵/急促) 字数÷10+1 秒
台词(深情/遗言) 字数÷5+1 秒
VO 旁白 字数÷7+1 秒
微动作/常规动作 2 秒
复杂连续动作 4 秒
强烈情绪反应 3 秒
环境/空镜/静物 2 秒
慢动作特效 3-4 秒

同时含台词+动作取较大值;单分镜 ≤12s。


五、视觉连续性五大铁律(分镜用)

  1. 台词具象化 — 涉及具体过去事件必须插闪回;禁只拍说话大头
  2. 潜台词外化 — 抽象情绪转具体肢体动作("焦急"→"手指抠衣角,指甲发白")
  3. 动作零脑补 — 严格忠实原著,动作跳跃须补过渡,禁瞬移
  4. 视点锁定 — 除剧本明确外禁主动切场景
  5. 关键信息特写 — 关键道具必须独立特写

六、禁止词速查(提示词自查)

身体裸露类:深V、低胸、领口大开、露乳、沟、性感暴露、裸露、半裸 身材过度描述:超模身材、大长腿、巨乳、翘臀、蜜桃臀 材质暗示:网衣、链式衣饰、蛛网衣、镂空衣 过度写实:毛孔可见、真实毛孔、汗毛、血管可见 台词/画面违禁:血腥暴力类 / 裸露低俗类 / 色情暗示类 / 封建迷信 / 危害公序良俗 / 敏感宗教政治


⬇️ 以下为 GitHub 研究精华汇总(R1~R10,可直接取用)

来源:Toonflow(15.7k★)、ai-comic-studio、openframe、LuxReal short-drama-skills 等。


七、故事骨架模板(前置环节)

# {作品名} - 故事骨架

## 故事核(一句话)
【主角内在冲突 + 核心心理级爽点(优势/归属/秩序 三选一)】

## 隐线(人物弧)
【初始状态 → 关键变故 → 性格转变 → 最终状态】

## 人物小传(大三角核心角色,≤4人)
### {主角名}
- 身份:姓名/外貌/职业/与主角关系/正反/作用
- 特征:性格/能力/行为习惯/家庭背景/标志动作或物件
- 境遇:开场处境/目标/动机
- 行动:动机驱动下的核心行动
- 结局:因行动达成的终点方向
- 【主角额外】代入感五要素 / 反差两面 / 金手指规则与边界 / 形态法则

## 三幕结构
### 第1幕:{标题}(第X-Y章 → 集A-B)
【核心问题 + 幕末转折】

## 分集决策(每集一行)
### 集{N}:{集标题}
【本集=情节承接+冲突升级+价值转变+下集勾连】

## 全局删减决策记录
【优先删除:拖沓铺垫/重复/载体不支持/弱支线】

## 付费卡点设计(按 N 比例)
| 位置 | 比例 | 设计 |
|---|---|---|
| 首次 | ≈10% | 核心矛盾升级 |
| 二次 | ≈30% | 生死危机/秘密将揭 |
| 中期 | ≈50% | 目标达成时大反转 |
| 后期 | ≈70% | 前期伏笔展开 |
| 收尾 | ≈90% | 圆满结局 |

## 股价级反转登记表(全剧约3个,标预埋集/揭晓集)
1. 【预期误导反转 / 人设颠覆反转(仅配角)/ 动机置换反转】

骨架自检红线

  • [ ] 大三角成立;单线型(无多线并行)
  • [ ] 前 10% 完成「一秒入坑→目标明确→多方施压→首次卡点」
  • [ ] 付费点按 10/30/50/70/90% 分布
  • [ ] 情绪波浪上升,无连续 3 集同一强度
  • [ ] 股价级反转 ≈3 个,预埋集早于揭晓集
  • [ ] 矛盾达 3-4 级(两个好人因不同选择走向不同命运)
  • [ ] 金手指新颖独一无二、有约束、非洗稿(市面>10次别用)
  • [ ] 前 10 集 ≈10 个可剪 30 秒爆点

八、改编策略清单(环节 ②)

8 大核心要点

  1. 强画面感(拍不出来的换表达)
  2. 台词精简(每句服务剧情/人物)
  3. 节奏极致快
  4. 只沿主线(砍支线)
  5. 降低理解成本
  6. 情绪大于一切
  7. 开篇给足期待感
  8. 展示不要告诉(动作是因、对话是果)

三条死路:模仿(换汤不换药)/ 抄袭桥段 / 洗稿 类型创新三方向:元素创新(年龄/性别/背景/视角反转)/ 类型融合 / 情节创新

删减优先级

  • 优先删:拖沓铺垫 / 低密度重复 / 载体不支持 / 弱支线
  • 优先留:核心情绪点 / 关系拉扯 / 付费点前铺垫链 / 身份反差与信息差 / 高光打脸
  • 替代:蒙太奇压缩 / 台词带过 / 完全删除

九、剧本创作规范(环节 ②)

三大情绪要点(每集至少1个):爆点 / 虐点 / 爽点

  • 爽点公式 = 装 + 打脸 + 震惊 + 收获

三大密度(都不能低)

  • 情绪密度:前3秒强钩子 → 30-40秒小爆发 → 结尾10秒悬念卡断
  • 信息密度(快准新无):快=前10秒交代主角/危机/冲突;准=高效潜台词;新=必给新信息;无=无价值台词全删
  • 情节密度(三硬标准):因果锚定 + 冲突驱动 + 价值转变
  • 黄金单集公式 = 情节承接 + 冲突升级 + 价值转变 + 下集勾连

节奏 3-15-45:3秒情绪冲击 / 15秒剧情变化 / 45秒强期待 / 结尾反转钩子

开篇 8 规则:冲突即时性 / 信息量密集 / 信息差 / 铺垫≤3集 / 关系拉扯感 / 每集必反转 / 压情绪 / 明确目标

  • 三坑必避:①介绍人物铺背景 ②一群人开会 ③慢悠悠写景扯前情

单集钩子级反转三式(≤1个):道具伏笔反转 / 情绪回弹反转 / 镜头错位反转

台词规范(要展示不要告诉):单句≤20字;单角色单次≤50字;高效潜台词但不晦涩 新手五大硬伤:情绪描写过多 / 小说化描写 / 心理描写过多 / 台词冗长 / 描述性动作过多


十、导演规划模板(②之后、⑥之前)

【导演规划】只拆分不创作(唯一例外:场间过渡);不规划光影/色调/配乐

## 分场汇总表
| 场次 | 场景名 | 台词条数 | 台词字数 | 情绪浓度(0-10) | 情绪基调(含X→Y) |
|---|---|---|---|---|---|
| Sc1 | 地点·概况 | 3 | 86 | 2 | 独自等待·静默压抑 |

## 逐场注意事项
- Sc1:
  - 情感砸点:……
  - 一致性锚点:……
  - 空间距离:……
  - 环境音:……
  - 易错提示:……

## 场间过渡(仅列确需增补的;不必要则硬切)
| 场间 | 过渡方式 | 说明 |
|---|---|---|
| Sc1→Sc2 | 动作衔接/空镜/淡入淡出 | …… |

规则:一个场 = 同一时空一段连续戏;场次须全覆盖剧本;台词只计数不预算时长。


十一、分镜帧描述五要素(环节 ⑥)

① 景别/视角+取景范围;② 角色位置姿态;③ 主光完整叙述句;④ 环境/道具可见细节;⑤ 情绪解剖词——背景锚定词
  • ①取景范围:用「不可见」标注框外,防模型自动推近 例:中景偏全景平视,取景膝盖以上至头顶上方少许枝叶(脚底地面与树冠深处不入画)
  • ③主光必须完整叙述句,禁只写短词 例:左侧柔和晨光均匀铺洒,暖黄底色轻染地面,角色身形半受光,面部轮廓微亮
  • ⑤背景锚定词:从场景描述摘取原文关键词,同场景连续镜头完全一致
  • 首尾帧禁用动词(会渲染动态模糊):走向/转身/迈步/抬手/张嘴/挥手/冲/跑/跳

motionScript 时间轴格式

Xs-Ys: [动作描述,运镜] [角色B:动作链]
  • 每段 [] 包裹,顺序即叙事顺序; 分隔连续动作
  • 结尾加 | 朝向:角色名+方位词(正面面朝镜头/3-4侧面朝右/3-4侧面朝左/正侧面朝右/正侧面朝左/背对镜头)
  • 每段 2-4 秒,求和须等于镜头时长
  • 触发-反应铁律:外部触发先给短促反应拍

cameraDirection 格式

起幅[景别] → 运动方式+速度 → 落幅[景别],目的:[揭示/跟随/强调什么]

承接上镜段(同场内非首组才写)

承接上镜:上镜定格于【角色】立于【位置】、面朝【方位】,刚【动作收尾终态】——本镜由此姿态延续

十二、分镜审核红线(环节 ⑥ 完成后必过)

四条绝对红线(违反任一=严重问题)

  • R1 资产引用合法:引用 ID 必须存在;可辨识角色须引用对应资产;每片段须引用场景资产
  • R2 剧本忠实:所有台词与剧本一字不差;不遗漏场次;不新增情节
  • R3 具象可感:禁「开心/悲伤/烘托气氛」等抽象词;声音具体到声源
  • R4 父子资产选择:衍生状态(破损/染血/夜景/激活态)必须用衍生 ID

高频严重项(必检)

  • [ ] 禁光影色调:任何字段不出现 光/影/逆光/侧光/色温/明暗/色调/暖冷
  • [ ] 音效禁配乐:仅环境音+动作音,禁 BGM/配乐/音乐
  • [ ] 人物外观不进提示词:画面描述不写服装/发型/长相
  • [ ] 片段时长:每片段 ≤15s;含台词镜 ≥字数÷4+1s;无台词镜 ≤6s
  • [ ] 长台词拆镜:单镜台词/VO >20字须拆,按语义停顿切
  • [ ] 景别视角错开:无连续 3 镜以上同景别

评分:A 可直接用(0严重,≤2中等)/ B 小修 / C 较大修改 / D 重做(≥3严重)


十三、资产体系与一致性(环节 ③④)

资产类型role(角色)/ scene(场景)/ prop(道具)

L0-L6 服化妆造分层

内容
L0 底模(不修改)
L1 妆容(基础妆/轻妆/正式妆,按线索决策)
L2 发型造型 + 发饰
L3 中衣/内搭
L4 外衣/主服
L5 配饰
L6 鞋履

六铁律:面容不变 / 姿态不变 / 逐层可控 / 风格统一 / 质感不降 / 纯服化范畴

衍生资产:同一角色多套造型共享身份(图生图,以底模为参考) 图像资产标注:提示词正文用 @图N 替代名称,绑定参考图 道具铁律:纯静物陈列,禁人物/手部/肢体,不得处于被持有/佩戴状态

四视图规范(人物):人像特写 / 正视图 / 侧视图 / 后视图

  • 背景中性灰 #E8E8E8;自然站立禁姿态变化;仅面部微表情;画面比例 4:1 或 3:1

十四、画风基因与标签库(环节 ③④⑤)

按画风锁定「第一锚点」

画风 核心基因
写实/赛璐璐/国风 面容即灵魂
90年代复古日系 线条即灵魂(避免数字化锐利边缘)
2D 扁平设计 轮廓即灵魂(无阴影渐变)
3D 黏土定格 黏土肌理为魂
真人实拍 面容即灵魂(毛孔级渲染)

画风标签通用公式

[一级画风] + [渲染方式] + [光影] + [色调] + [质感/细节]

常用画风标签(多参模式,可直接复制)

  • 2D 都市言情:mature urban romance anime, cel-shaded, cinematic lighting, cool tones, dramatic low-key shadows, clean line art
  • 2D 复古日系:90s Japanese anime, hand-drawn cel animation, soft warm tones, nostalgic aesthetic
  • 2D 扁平:2D flat design, geometric shapes, solid color blocks, minimal shadows, clean lines
  • 3D 黏土:stop-motion claymation, clay texture, finger imprints, warm tones, soft bokeh
  • 真人现代都市:live-action urban cinema, real human actors photography, cinematic color science, film grain texture, non-CGI non-rendered
  • 真人写实:modern urban drama, photorealistic, cinematic, natural lighting, ultra-fine detail
  • 3D 国风传统:Chinese traditional 3D render, PBR materials, volumetric lighting, oriental aesthetic
  • 2D 国风:Chinese style anime, cel-shaded, neo-chic oriental aesthetic, vivid colors, detailed brushwork
  • 3D 二次元渲染:3D anime render, cel-shaded 3D, cinematic lighting, warm tones, high-detail textures, clear outlines
  • 真人古风:Chinese period drama, photorealistic, cinematic, high contrast, ultra-fine detail
  • 3D 国风赛博:Chinese traditional 3D render, PBR materials, ..., cyberpunk fusion, neon glow atmosphere

首尾帧模式在末尾加 , shallow depth of field

场景变体:景别(大全景→特写)/ 时段(清晨/正午/黄昏/夜间月光/夜间灯火)/ 天候(晴/阴/薄雾/细雨/飞雪),建筑布局材质保持不变

季节色调:春青绿淡粉 / 夏碧绿蔚蓝 / 秋橙黄棕红 / 冬素白冷蓝


十五、连贯性检查与时长预算(环节 ⑥)

七律视觉连续性

  1. 动作连续 2. 景别递进 3. 视轴守恒(180°铁律) 4. 朝向逻辑 5. 信息控制(不提供新信息不切镜) 6. 节拍密度(2-3s≥1拍 / 4-6s≥2拍 / 7-9s≥3拍 / 10s+≥4拍) 7. 头尾安全区

集级色温弧(全集重写前先定):冷→暖 / 暖→冷 / 冷→暖→冷 / 中性→极端→收回

每镜三问:单一视觉概念 / 核心反差对 / 主动排除

信息密度原则:不提供新信息不切镜;非叙事镜头(空镜/过渡)总时长 ≤20%

时长预算:目标总时长 ×0.9 为硬下限;典型 ≥ 目标÷9(平均每镜9s)

  • 时长地板:对话/情绪 ≥10s;环境 ≥9s;动作 ≥8s
  • 先输出 <!-- PLAN: 场景1=Ns(Xshots) | ... | Total=Ns(Xshots) -->

每场景硬性扩展:对话≥2镜 / 新地点≥3镜 / 情绪拍≥2镜 / 打斗≥4镜 换场首镜:必须全景/大全景(禁特写开场) 情感收束镜头:情绪顶点后接 1 个「呼吸镜头」(≥中景,允许超6s只有环境动态)

动作合规替换

刀刺入身体 刀刃弧线向前→人物重心后倒
鲜血飞溅 画面切到远景剪影
打倒/击杀 人物重心倒地→画面定格

十六、结构化提取提示词(②③环节)

提取角色

你是专业剧本分析师。请从剧本中提取关键角色并给出简要角色卡。
只返回严格 JSON:
{"characters":[{"name":"","gender":"","age":"","personality":"","appearance":"","background":""}]}
不要输出 Markdown 代码块。未知信息请保守推断并保持简洁。
剧本:\n{{script}}

提取场景

你是专业剧本场景规划师。请从剧本中提取关键场景。
"场景"指同一主要地点和时间段内的连续片段。不要把剧情事件/动作节拍当作独立场景。
场景标题应描述场景单元/地点(如"警局审讯室"),不要写成事件句(如"发生争吵")。
只返回严格 JSON:
{"scenes":[{"title":"","location":"","time":"","mood":"","description":"","shot_notes":""}]}

提取分镜

你是专业分镜规划师。请基于剧本生成可执行的镜头列表。
优先细粒度拆分:将每个场景拆成更多有意义的动作节拍,而不是合并为长镜头。
连续性必须很强:若剧本未明确跳切,相邻镜头应表现为同一动作过程中的连续时刻。
只返回严格 JSON:
{"shots":[{"title":"","scene_ref":"","character_refs":[],"prop_refs":[],"costume_refs":[],
"shot_size":"","camera_angle":"","camera_move":"","duration_sec":3,"action":"","dialogue":""}]}
duration_sec 通常在 1-5 秒之间。

十七、剧情节奏速查(写剧本时对照)

类型节奏框架(按总集数 N 比例)

  • 甜宠:契约绑定 → 误会拉扯 → 秘密曝光(10%) → 情感破冰 → 危机爆发(30%) → 撒糖打脸 → 新危机(60%) → 情感确认 → 圆满
  • 虐恋:前期误会伤害(1-20%) → 男主悔悟(21-40%) → 追妻受阻(41-70%) → 和解(71-100%)
  • 战神:隐藏身份受辱(1-30%) → 身份曝光打脸(31-60%) → 解决危机(61-90%) → 登顶(91-100%)
  • 重生:前世被害(1集) → 改写命运(2-30%) → 信息差逆袭(31-70%) → 复仇圆满(71-100%)
  • 萌宝:带娃逆袭(1-20%) → 男主发现孩子(21-50%) → 联手反击(51-80%) → 团圆(81-100%)

情绪基调占比

  • 甜宠:甜60% + 微虐30% + 惊喜10%
  • 复仇:压抑40% + 爽感50% + 解气10%
  • 重生逆袭:爽感50% + 期待30% + 温暖20%
  • 家庭伦理:共情40% + 委屈30% + 和解30%

矛盾四级阶梯(爆款须达 3-4 级)

  1. 基本(弱)→ 2. 强化(二选一困境)→ 3. 高级(两个好人因不同选择走向不同命运)→ 4. 升级(招致不可回头后果)

十八、深度内容位置索引

想深入某一块,去对应研究文档:

主题 文档
GitHub 项目调研总览 03_GitHub研究/R1_调研总览.md
七律/帧描述/motionScript/时长预算 03_GitHub研究/R2_生产级规范_ai-comic-studio与openframe.md
分镜表三级结构/审核红线 R1~R4 03_GitHub研究/R3_Toonflow_分镜表与审核.md
剧本创作/3-15-45/关键帧驱动 03_GitHub研究/R4_Toonflow_剧本创作与BigBanana.md
故事骨架/付费点/股价级反转 03_GitHub研究/R5_Toonflow_故事骨架与付费点.md
三层 Agent 架构/资产体系/11 画风 03_GitHub研究/R6_Toonflow_Agent架构与资产体系.md
L0-L6 分层/四视图规范 03_GitHub研究/R7_Toonflow_人物衍生与四视图.md
场景/道具五原则/画风基因 03_GitHub研究/R8_Toonflow_场景道具与画风基因.md
画风标签库/场景变体 03_GitHub研究/R9_Toonflow_画风标签库与场景变体.md
导演规划/改编 8 要点 03_GitHub研究/R10_Toonflow_导演规划与改编策略.md

调研时间:2026-09-19 目的:检索 GitHub 上排名靠前/主流的漫剧生成项目,提取可补充、可优化现有流程的做法。


一、调研到的关键项目

项目 定位 亮点 协议
neilalexanderlee/ai-comic-studio 开源漫剧全自动流水线(剧本→分镜→首尾帧→视频→合成) 分镜督导批量重写(七律视觉连续性审核)、三层决策首尾帧视频提示词直出(零 LLM 费用)、镜头衔接自动传尾帧、角色四视图 Apache-2.0
murongg/openframe AI 漫剧创作工作台(Web+桌面) 一站式流程、人物关系图谱、结构化提取、导出 FCPXML/EDL AGPL-3.0
sorker/ai-shotlive AI 短剧/漫剧生产平台 「小说→剧本→分镜→资产→关键帧→成片」工业化工作流、多模型
YvonneMovingon/short-drama-skills LuxReal 平台实战验证的短剧 Skill 合集 通用叙事拆解(分镜拆分/时长估算/长台词切分)、按剧情连贯拆分副本、情绪刻画、动态描述、4 种润色
wzY-toRitchie/ai-comic-script-generator Agent Skill:小说→AI 漫画分镜 4.5 步工作流、角色设定卡(固定不变区)、标准母图、神秘角色视觉方案 MIT
freestylefly/canghe-skills (manga-drama) 基于 Seedance 的漫剧生成技能 主角识别、5 种分镜类型、图生视频、脚本 JSON 格式
Dapeng960208/AI-Comic-Generator Gemini 驱动的漫画生成 角色一致性(图生图参考 + 合并去重)、上下文感知分镜
zhagons/AiCartooPrompt 漫剧分镜提示词大全 多风格分类(日系/韩系/国漫/3D 等)、负面提示词
RobinaMirbahar/Comic-Studio-Ai 多 Agent 漫画生成 Character Memory System(角色档案注入每格提示词)、气泡自动生成

二、对现有流程的补强建议(按环节)

⓿ 台词分幕 —— 建议增加

  • 情绪曲线标注:在分幕时同时标出情绪高点(爽点/爆点)与低点(悬念/紧张)—— 来自 ai-comic-script-generator Step1。
  • 现有流程已有「情绪 + 强度」,可再加一层全局情绪曲线便于后续分镜节奏控制。

① 选本改文 —— 建议增加

  • 情绪曲线提取:ai-comic-script-generator 的 Step1 输出「核心冲突 + 人物列表 + 场景列表 + 情绪曲线」,可作为改动稿的附加产物。

② 转剧本 —— 建议增加

  • 钩子/爽点标注:每个场景显式标注「钩子/爽点」(ai-comic-script-generator Step2)。
  • 前 3 秒强钩子:剧本层面就要求前 3 秒有视觉冲击/悬念/反转。
  • 现有《二、小说转剧本指令词》已很完整,可与之合并。

③ 人物 & 道具 —— 建议增加(重要)

  • 角色设定卡「固定不变区」(ai-comic-script-generator Step4):
    • 角色名 / 性别年龄 / 身高体型 / 气质词 3 个 / 发型 / 五官特征(≤3)/ 肤色 / 标志物(必须有 1 个) / 主穿搭 / 主色系 / 禁止出现项
    • 固定角色描述(每次必带,逐字复制粘贴到每个镜头 prompt)
    • 固定画风后缀(每次必追加)
    • 提示词模板 = 固定角色描述 + [表情/动作/场景] + 固定画风后缀
  • 标准母图(定妆照):生成 3-5 张,选最满意 1 张作为 Master Reference,后续所有镜头以它作参考(MJ --cref / ComfyUI IP-Adapter)。
  • 合并去重:手动合并重复角色(如「马管家」与「老马」)—— 来自 Dapeng960208。
  • Character Memory System:角色档案注入每一格提示词 —— 来自 Comic-Studio-Ai。
  • 神秘角色视觉方案:声音出场用暗色剪影 + 红光点;分屏用模糊暗影轮廓;固定视觉元素(如黑暗背景 + 红色数字)。

④ 三视图 —— 建议增加

  • 角色四视图(ai-comic-studio):正面 / 四分之三 / 侧面 / 背面 —— 比三视图多一个 3/4 视角,对后续一致性更友好。
  • 现有三视图(正面/左侧/背面 + 头像 + 细节)已很完整,可考虑加入 3/4 视角。

⑤ 场景 —— 可保持

  • 现有两套体系已很完整。

⑥ 分镜/镜头提示词 —— 建议大幅补强(最有价值)

来自 LuxReal short-drama-skills 的「通用叙事拆解」,建议并入:

A. 全局节奏控制(最高优先级)

  • 信息密度原则:不提供新信息就不切镜 —— 新镜头必须含新情节推进/新环境细节/新情绪强度;否则允许同景别同机位延续。
  • 非叙事镜头总量控制:单 beat 内空镜/过渡镜头总时长占比 ≤20%,超出优先砍空镜。

B. 分镜拆分原则

  • 叙事与动作类:复杂动作三段式(动机→执行→结果)、空间转场切镜、时间跳跃切镜、人物关系变化切镜、同框超 2 人必须拆散
  • 情绪与表演类:情绪突变切特写情绪渐变靠景别递进不切镜对话视线乒乓(说话者→聆听者→说话者,关键反应镜头比说话更重要)。
  • 视听语言类:J-cut(下镜声音提前)、L-cut(当前声音延后)、VFX 独占镜头、节拍控制(紧张用短镜,抒情用长镜)。
  • 静态画面强制拆分:单镜头停留 ≤6s;台词超 6s 当场拆子镜头。
  • 长台词切分规则(预估 >8s):零删减 + 有节奏;切分锚点=话题转折→情绪变化→逻辑层级→自然气口;7 种视听手法(T1 正面/T2 反应/T3 道具特写/T4 闪回/T5 景别递进/T6 动作伴随/T7 VO 切换),T1 ≤60%、T2 不可连超 1 次。

C. 视觉转化五大铁律

  1. 台词具象化 — 涉及具体过去事件必须插闪回;禁只拍说话大头
  2. 潜台词外化 — 抽象情绪转具体肢体动作("焦急"→"手指抠衣角,指甲发白")
  3. 动作零脑补 — 严格忠实原著体态,动作跳跃须补过渡,禁瞬移
  4. 视点锁定 — 除剧本明确外禁主动切场景;画外音时聚焦屋内听者反应
  5. 关键信息特写 — 关键道具必须独立特写,禁淹没在全景里

D. 视觉描述结构化(四维度)

  • 【镜头与构图】景别 + 运镜 + 视角
  • 【主体描述】禁"同上/紧接着/他她";同一角色动作表情道具合并为连贯长句,用逗号,禁分号
  • 【光影/氛围】只写对剧情有必要的光影
  • 【画面背景】仅首镜或方向大变化时填,约 8 字

E. 分镜时长估算(实用公式)

类型 公式/时长
台词(正常语速) 字数÷8+1 秒
台词(争吵/急促) 字数÷10+1 秒
台词(深情/遗言) 字数÷5+1 秒
VO 旁白 字数÷7+1 秒
微动作/常规动作 2 秒
复杂连续动作 4 秒
强烈情绪反应 3 秒
环境/空镜/静物 2 秒
慢动作特效 3-4 秒

同时含台词+动作取较大值;单分镜 ≤12s

F. Clips→Shots 聚合(分集/长剧本,来自 skill 04)

  • 叙事与人物关联聚合、场景空间一致性(室内外/地点/时间跳变必切)、动作连贯性(同一动作链聚合)、情绪视线一致性(正反打可合并)
  • 全局主动合并:相邻片段总时长 ≤15s 且连贯即可合并
  • 合并争夺处理 + 防孤立机制

⑦ 视频生成 —— 建议补强

  • 首尾帧三层决策策略(ai-comic-studio):确定性规则 → LLM 语义判断 → 安全兜底,自动决定每镜生成「首帧+尾帧」还是「仅首帧」。
  • 镜头衔接自动传尾帧:上一镜尾帧自动作为下一镜首帧,保证画面连贯。
  • 视频提示词直出(零 LLM 费用):基于 startFrameDesc / motionScript / cameraDirection 直接拼装,不再调用 LLM。
  • 分镜督导批量重写:全集一次性视觉连续性审核,批量重写首尾帧描述 + 动作脚本,保证跨镜场景词一致。
  • 现有《制作注意事项》已提到单帧/首尾帧,可补充「三层决策」与「自动传尾帧」。

⑧ 剪辑 —— 建议补强

  • 导出 FCPXML/EDL(openframe):可接入 Premiere / 达芬奇,比纯剪映更专业。
  • 镜头衔接自动传尾帧 到剪辑阶段。

三、建议新增的全局机制

  1. 角色档案(Character Bible):集中管理所有角色的固定描述 + 标志物 + 禁止项,全流程引用。
  2. 视觉连续性审核:全集分镜一次性过审,批量重写保证跨镜一致。
  3. 情绪曲线管理:从剧本到成片贯穿的情绪节奏图谱。
  4. 时长预算表:用公式估算每个镜头时长,控制总时长与节奏。
  5. 参考素材库:Master Reference(定妆照)+ 场景参考图 + 道具参考图,统一管理。

四、参考链接

  • https://github.com/neilalexanderlee/ai-comic-studio
  • https://github.com/murongg/openframe
  • https://github.com/sorker/ai-shotlive
  • https://github.com/YvonneMovingon/short-drama-skills
  • https://github.com/wzY-toRitchie/ai-comic-script-generator
  • https://github.com/freestylefly/canghe-skills
  • https://github.com/Dapeng960208/AI-Comic-Generator
  • https://github.com/RobinaMirbahar/Comic-Studio-Ai
  • https://github.com/zhagons/AiCartooPrompt.html

深入扒取了 GitHub 主流漫剧项目的实际生产级提示词源码,可直接借鉴/整合。 主要来源:neilalexanderlee/ai-comic-studio(S级分镜/分镜督导)、murongg/openframe(提取/生成提示词) 挖掘时间:2026-09-19


一、七律视觉连续性规范(分镜督导核心)⭐

来源:ai-comic-studio storyboard-supervision.ts 用途:LLM 一次读入整集分镜,按"S级标准"批量重写视觉字段,保证跨镜一致性。

1.1 集级色温弧(全集开始前先做 Q0)

扫描全集,确定本集整体色温走向,统摄所有镜头的主光叙述:

弧线类型 故事形态 色温方向
冷→暖 情感接近型(逐渐亲密/战后和解) 铺垫偏冷中性,情绪峰值偏暖
暖→冷 情感离散型(背叛/分离/失去) 铺垫偏暖,决裂瞬间切冷调蓝
冷→暖→冷 希望破灭型(虐剧高潮集) 暖色出现在中段的短暂希望处
中性→极端→收回 战斗/揭秘集 战前中性,顶峰极冷或极暖,收势回中性

规则:同一「场景」内相邻镜头的色温允许在 2-3 个步骤内渐变(宏观统一,微观随情绪漂移)。

1.2 每镜三问(Q1-Q3,内部推理)

  • Q1 单一视觉概念:这个镜头视觉上只关于一件事——是什么?(不是剧情翻译,是视觉 IDEA)
  • Q2 核心反差对:画面里什么和什么形成对比?(静止主体vs动态背景/平静角色vs混乱环境/前景秘密vs中景无知)
  • Q3 主动排除:明确不拍什么?这个排除本身是叙事选择吗?

1.3 七律(核心铁律)

  1. 动作连续 — 新分镜起始动作承接上一镜结束状态
  2. 景别递进 — 情绪渐变靠景别靠近,不切镜
  3. 视轴守恒(180°铁律) — 同场景所有镜头必须在假想轴线同侧拍摄;A 在左 B 在右则全集保持,越轴会导致"人物瞬移"。合法越轴=插入正面中性镜头或用角色移动重建轴线
  4. 朝向逻辑 — 反打镜头朝向互补(A 看右 → 反打 B 看左)
  5. 信息控制 — 不提供新信息不切镜
  6. 节拍密度 — 2~3s≥1拍、4~6s≥2拍、7~9s≥3拍、10s+≥4拍
  7. 头尾安全区 — 首尾帧描述的安全边界

1.4 帧描述五要素(缺一不可,用全角分号「;」分隔)

① 景别/视角 + 取景范围;② 角色位置姿态;③ 主光完整叙述句;④ 环境/道具可见细节;⑤ 情绪解剖词——背景锚定词

① 景别/视角 + 取景范围(用"不可见"标注框外,防止模型自动推近):

  • 「中景偏全景平视,取景膝盖以上至头顶上方少许枝叶(脚底地面与树冠深处不入画)」
  • 「特写仰拍,仅面部从下巴到额发入画(颈部及以下不可见)」

③ 主光必须是完整叙述句(禁只写光源短词,否则模型渲染硬打光光柱):

  • ✅「左侧柔和晨光均匀铺洒,暖黄底色轻染地面,角色身形半受光,面部轮廓微亮」
  • ❌「橙红侧光」「冷调月光」

⑤ 背景锚定词:必须从场景描述字段摘取原文关键词,禁改写/翻译/自创;同场景连续镜头必须完全一致(防场景漂移)。

首帧/尾帧禁用动词(会让模型渲染动态模糊):

走向 / 转身 / 迈步 / 抬手 / 张嘴 / 伸出 / 挥 / 推 / 拉 / 扑 / 冲 / 跑 / 跳 / 飞出 / 倒地 / 正在 / 已经 / 随即

替换写法(动作→起始时的空间定格):

  • 「迈步走向门」→「立于门槛内侧,右脚已提起半步,重心微微前倾」
  • 「挥剑斩下」→「剑已举至头顶,剑尖斜朝下,双臂肌肉可见隆起」

1.5 motionScript 时间轴格式

  • 每段用 [] 包裹;多角色用多个 []顺序即叙事顺序
  • 分隔同一角色连续动作步骤
  • 结尾必须加 | 朝向:角色名+方位词
  • 朝向词库:正面面朝镜头 / 3/4侧面朝右 / 3/4侧面朝左 / 正侧面朝右 / 正侧面朝左 / 背对镜头
  • 每段 2-4 秒,求和须精确等于镜头时长
  • 触发-反应铁律:由画面外事件(声音/光变)引发的动作,第一段必须是短促反应定格,不得把触发与展开动作压进同一拍
  • 台词/发声顺序是铁律[] 顺序必须严格对应角色开口先后

生理微细节(情绪反应时必须写入)

  • 吃惊 →「眉头骤然皱起→肩膀随抽气微微一收紧」
  • 悲伤 →「喉结上下轻动→肩线向内塌落→呼吸变浅而沉」
  • 愤怒压制 →「下颌角收紧→手背青筋一绷→呼气缓慢有力」

物理音效提示(可选)[] 末尾加括号注明物理声源(脚步/布料/金属/呼吸),禁写 BGM/配乐

1.6 cameraDirection 格式(必须含叙事目的)

起幅[景别] → 运动方式+速度 → 落幅[景别],目的:[揭示/跟随/强调什么]
  • ✅「中景固定 → 缓慢dolly in推近 → 特写,目的:强调角色眼神变化」
  • ❌「缓慢推近」(缺叙事目的,不合规)
  • 运镜速度须匹配情绪功能:追逐/惊吓/爆发用快速;沉思/收束用缓慢。全集清一色"缓慢"= 节奏失衡

1.7 换场首镜 & 情感收束镜头

  • 换场首镜:景别必须是全景/大全景/中远景(禁以特写开场);cameraDirection 目的须含"建立空间"
  • 情感收束镜头(呼吸镜头):上一镜含情绪顶点词(爆发/崩溃/告别/表白/死亡/揭秘/背叛),则当前镜须是呼吸镜头——景别 ≥中景,允许超 6s 只有环境动态。同一情绪顶点只触发其后紧邻 1 个镜头,不可连续 2 个

二、动作/战斗场景描写规范(合规替代)

❌ 禁止写法 ✅ 替换写法
右肘击碎士兵手腕 右肘向前击出→对方手臂后撤失衡
刀刺入身体 刀刃弧线向前→人物重心后倒
鲜血飞溅 画面切到远景剪影
打倒/击杀/消灭 人物重心倒地→画面定格
骨折/脱臼/断裂 关节角度突变→手部松开

核心原则:描述动作轨迹和画面构成,结果用空间/姿态变化代替。

动画战斗物理词汇(动漫风格打斗专用)

  • 刀剑挥出:「刃面沿斜轴弧切——留下6条银白速度线,向消散端渐细」
  • 高速位移:「身体向左疾掠——留下2-3条半透明残影(由实到虚)」
  • 出拳:「右拳向前直冲——前端气流涡旋积聚,接触点炸散为放射状尾迹」
  • 双刃对撞:「接触点蓝白电光弧线向两侧飞射,持续0.5s后消散」

三、剧本结构化提取提示词(openframe 生产版)⭐

3.1 提取角色(extractCharactersFromScript)

你是专业剧本分析师。请从剧本中提取关键角色并给出简要角色卡。
年龄必须为以下枚举之一:{{characterAgeCanonical}}。
角色字段(name/personality/appearance/background)必须使用简体中文。
只返回严格 JSON:
{"characters":[{"name":"","gender":"","age":"","personality":"","appearance":"","background":""}]}
不要输出 Markdown 代码块。未知信息请保守推断并保持简洁。

3.2 提取场景(extractScenesFromScript)

你是专业剧本场景规划师。请从剧本中提取关键场景。
"场景"指同一主要地点和时间段内的连续片段。
不要把剧情事件/动作节拍当作独立场景。
若同一地点和时间连续发生多个事件,应合并为一个场景。
场景标题应描述场景单元/地点,不要写成事件句。
错误示例(事件级):"发生争吵"、"发现线索"
正确示例(场景级):"警局审讯室"、"夜晚天台"
只返回严格 JSON:
{"scenes":[{"title":"","location":"","time":"","mood":"","description":"","shot_notes":""}]}

3.3 提取道具(extractPropsFromScript)

你是专业美术置景/道具设计师。请从剧本中提取关键道具。
只返回严格 JSON:{"props":[{"name":"","category":"","description":""}]}
除非明确作为实体物件出现,否则不要把人物或场景写入道具列表。

3.4 提取人物关系(extractCharacterRelationsFromScript)

你是专业人物关系分析师。请从剧本中提取项目级人物关系。
优先更新已有关系,其次再新增。关系角色 ID 必须只来自给定角色列表。
strength 必须是 1-5 整数,5 表示关系/冲突最强。
relation_type 示例:family、ally、friend、rival、enemy、mentor、subordinate、lover、business、mystery。
只返回严格 JSON:
{"relations":[{"source_ref":"","target_ref":"","relation_type":"","strength":3,"notes":"","evidence":""}]}

3.5 提取分镜(extractShotsFromScript)⭐ 核心

你是专业分镜规划师。请基于剧本生成可执行的镜头列表。
在忠于剧本的前提下,尽可能提高镜头数量。
优先细粒度拆分:将每个场景拆成更多有意义的动作节拍,而不是合并为长镜头。
若不确定该少还是该多,优先输出更多镜头。
从头到尾完整覆盖剧本,避免跳过转场与中间动作。
镜头序列必须连贯,前后镜头衔接自然。
保持相邻镜头的连续性:方向、视线、站位、动作推进。
只有在叙事确实推进时才切换场景。
连续性必须很强:若剧本未明确跳切,相邻镜头应表现为同一动作过程中的连续时刻。
动作描述要具体且具状态延续,必要时继承上一镜头的重要道具/姿态/位置信息。
每个镜头必须包含 scene_ref、character_refs、prop_refs、costume_refs,且只能使用提供的 ID。
只返回严格 JSON:
{"shots":[{"title":"","scene_ref":"","character_refs":[],"prop_refs":[],"costume_refs":[],
"shot_size":"","camera_angle":"","camera_move":"","duration_sec":3,"action":"","dialogue":""}]}
duration_sec 通常在 1-5 秒之间,除非剧本明确要求更长/更短。

四、时长预算与镜头扩展(S级分镜核心)⭐

来源:ai-comic-studio shot-split.ts

4.1 时长预算规则

  • 硬性下限:目标总时长 × 0.9(低于即失败)
  • 软上限:目标 × 1.2
  • 最少镜头数:≥ (0.9×目标) ÷ 单镜上限
  • 典型目标:≥ 目标÷9(平均每镜 9 秒)
  • 时长地板:对话/情绪拍 ≥10s;环境/氛围 ≥9s;动作/转场 ≥8s

4.2 必须先输出规划注释

<!-- PLAN: 开场建立=30s(3shots) | 双人对话=45s(4shots) | 追逐=50s(5shots) | 结尾=30s(3shots) | Total=155s(15shots) -->

4.3 每场景硬性扩展规则

场景类型 最少镜头
对话场景 说话者镜 + 聆听者反应镜(≥2)
新地点揭示 建立全景 + 2 个角色/动作镜(≥3)
情绪拍 面部特写 + 环境/反应镜(≥2)
打斗 远景接近 + 接触 + 反应 + 后果(≥4)
地点转场 移动/过渡镜(≥1)
群像/氛围 广角建立 + 细节镜(≥2)

4.4 可自由插入的镜头类型(增加时长不注水)

  • 反应镜:听者微反应(屏息/手收紧/目光移开)9-12s
  • 角色拍:内在冲突外化(迟疑/矛盾手势)9-12s
  • 环境细节:预示或对比情感的世界元素 9-14s
  • 平行动作:另一角色同时做什么 9-12s
  • 过渡镜:角色移动,步态承载潜台词 8-11s

五、三视图结构(openframe 生产版)

角色三视图(characterTurnaround):

生成一张可用于制作的动漫角色三视图设定图。
项目类别/项目风格/角色名/性别/年龄/性格/外观/背景
要求:
- 必须输出同一角色的三视图整身图:正面、侧面、背面
- 只出现该角色,不要额外人物
- 三个视角保持身份一致与服装细节一致
- 仅动漫风格,禁止写实真人脸
- 背景干净、清晰,无文字覆盖

场景三视图(sceneTurnaround):

输出一张 16:9 场景图,且包含同一环境的三种视角:主广角、侧角度、反打角度
重点表现环境设计与空间布局,并保证三视图连续一致
仅环境:禁止人物、肢体、群演和人物剪影

道具三视图:正面/侧面/背面,几何结构/材质/配色/关键细节一致,仅道具本体无人物。

换装任务(costumeSwap):以参考角色图作身份锚点,只改服装不改身份,输出正/侧/背三视图整身。


六、镜头生成提示词模板(openframe 生产版)

镜头关键帧(shotImage):

为该镜头生成故事板关键帧。
项目类别/项目风格/镜头标题/景别/机位角度/镜头运动/动作/
场景标题/地点/时间/氛围/角色/道具/服装/
上一镜头上下文/下一镜头上下文
要求:
- 匹配指定景别、镜头语言与动作
- 与相邻镜头保持视觉连续
- 禁止字幕、台词条、水印

首尾帧(productionFrame):

为该镜头生成{{首帧/尾帧}}。
时序方向:首帧早于中帧,尾帧晚于中帧
严格遵守镜头运动方向
保持角色/道具身份稳定

七、艺术风格色彩盘(示例:都市言情二次元)

来源:ai-comic-studio art-styles/anime_2d/prefix.md,可作为"风格基因"模板

风格基因:一级风格 / 二级风格 / 情感基调 / 质感锚词(赛璐璐上色、清晰线条、戏剧化低调光影)

色彩层级

  • L1 硬约束(高):仅锁角色识别核心(肤色/发色/主服底色)
  • L2 软约束(中):场景色/配饰/点缀优先参考色盘,可微调
  • L3 例外机制(低):节庆/回忆/高潮戏可临时突破,但保留冷暖逻辑

情绪色盘(导演对齐版):每个情绪场景绑定「主色+辅色+光效与对比建议+画面关键词」。

情绪 → 面容/眼神词映射表(10 种情绪,各含面容词/眼神词/微表情)—— 可直接用于分镜的情绪具象化。


八、可整合进本项目流程的清单

来源 内容 建议整合位置
ai-comic-studio 七律视觉连续性 ⑥ 分镜(新增)
ai-comic-studio 帧描述五要素 ⑥ 分镜(新增)
ai-comic-studio motionScript 时间轴格式 ⑥ 分镜(增强)
ai-comic-studio cameraDirection 含叙事目的 ⑥ 分镜(增强)
ai-comic-studio 换场首镜 / 呼吸镜头规则 ⑥ 分镜(新增)
ai-comic-studio 动作合规替换表 ⑥ 分镜(新增)
ai-comic-studio 时长预算 + 规划注释 ⑥ 分镜(增强)
ai-comic-studio 每场景扩展规则 + 可插入镜头类型 ⑥ 分镜(新增)
openframe 剧本结构化提取(角色/场景/道具/关系/分镜 JSON) ②③ 转剧本/提角(新增)
openframe 三视图生产版模板 ④ 三视图(增强)
openframe 镜头关键帧/首尾帧模板 ⑦ 视频(增强)
openframe 情绪→面容/眼神词映射 ③ 人物 / ⑥ 分镜(新增)

九、参考链接(源码路径)

  • ai-comic-studio 分镜督导:src/lib/ai/prompts/storyboard-supervision.ts
  • ai-comic-studio 分镜拆分:src/lib/ai/prompts/shot-split.ts
  • ai-comic-studio 艺术风格:src/lib/ai/prompts/art-styles/*/
  • openframe 提取提示词:packages/prompts/src/locales/zh/prompt_overrides.ts
  • openframe 生成提示词:packages/prompts/src/generation_prompts.ts
  • 仓库:https://github.com/neilalexanderlee/ai-comic-studio | https://github.com/murongg/openframe

来源:HBAI-Ltd/Toonflow-app(15.7k stars,开源 AI 短剧一站式工具) 这是当前 GitHub 上 star 数最高的漫剧/短剧项目,其 prompt 体系被 ai-comic-studio 等项目对标引用。 挖掘时间:2026-09-19


一、分镜表结构(新格式)⭐

Toonflow 的分镜表是「场头 → 片段 → 镜表」三级结构:

## 场N:场景名 | 参演角色:角色A、角色B、…

### 片段一(约10s)
**引用资产名称**:[苏晚卿, 凌玄, 青云令, 大殿]
**引用资产ID**:[101, 100, 202, 300]
| 序号 | 画面描述 | 时长 | 景别 | 运镜 | 台词 | 音效 |
|------|------|------|------|------|------|------|
| 1 | 西瓜筐被一脚踢飞腾空,筐内西瓜飞溅而出… | 5 | 近景 | 缓推 |  | 音效:西瓜筐翻滚撞地声… |
| 2 | 林刚抬手食指直逼林志强眉心,下巴绷紧… | 5 | 近景 | 缓推 | 林刚暴怒说:『…』 | 音效:手指划风声… |

关键设计

  • 场头承载场景信息(场景名 + 参演角色),不在每镜重复
  • 资产引用在片段级(引用资产名称/ID 两行),不在每镜
  • 镜表无「朝向」「空间关系」「角色动作」独立列,一律并入「画面描述」
  • 每镜固定 7 列:序号 / 画面描述 / 时长 / 景别 / 运镜 / 台词 / 音效

二、核心信条与铁律(分镜)⭐

铁律优先级(冲突时按此顺序)

台词零删改 > 出场人物完整 > 只描述动作状态 > 长台词/长VO拆镜规则

  1. 片段 ≤15 秒,台词超载则拆多片段
  2. 长台词/长VO 强制拆镜:>20 字必须拆多个连续镜头,每镜换视角/景别,按语义停顿点切,不平均切;跨镜可切到听者反应镜(画面是听者,声音继续是说话人);若语义不可切必须单镜,则用表情微妙变化/肢体持续演进/运镜缓慢推动填满时间,禁单镜固定
  3. 台词零删改:所有引号内台词、VO、系统播报、面板文字必须 100% 逐字搬运,禁合并/精简/省略
  4. 台词时间:按 4 字/秒计算,按情绪语气分配,不平均
  5. 在场人物不能消失:剧本没写"XX离开"则 XX 还在场,必须每镜有视觉痕迹(背景/局部/反应镜/纵深虚焦剪影/前景遮挡/环境音留痕)
  6. 群演不抢戏:群演仅以微动作服务当前戏核情绪,不给群演单独配台词
  7. 人物外观交给图片资产:服装/发型/长相不进分镜提示词
  8. 画面描述只写:谁做了什么动作、姿态、表情、当下状态变化(汗湿/泪痕/衣衫凌乱/青筋暴起)
  9. 声音只写两类:环境音 + 音效。禁 BGM/配乐/音乐
  10. VO 音画同步:VO 一律按普通台词处理,画面照常描写动作,文字 100% 原样写在末尾;面板/屏幕/短信文字须逐行点亮+滴答音效,关键数值单独高亮一拍

三、片段间过渡与连贯性设计(消灭跳跃感)⭐

维度 原则 ❌ 错误 ✅ 正确
动作的桥梁 前片段结尾是动作"起始态",后片段首镜是"进行时/完成时",禁冻结跳转 A结尾"他握紧剑柄" → B开头"他拔剑冲上前" A结尾"手猛地握住剑柄,指节泛白" → B开头"利剑锵一声出鞘,映出他扭曲的脸"
情绪的接力 前片段结尾用反应镜/眼神/微表情为下片段铺垫 A结尾"她说:你走吧" → B开头"他转身离开" A结尾"特写她紧抿的嘴角和泛红的眼眶" → B开头"他看着强忍泪水的脸,喉结滚动,最终转身"
空间与视线链接 用空镜/视线引导/声音元素建空间联系 室内争吵 → 直接切次日街市 争吵后人物愤怒看向窗外 → 接暴雨敲窗空镜(雨声延续0.5s)→ 叠化次日街市大全景
台词与动作黏合 音画跨片段同步,前片段末尾声音由后片段首镜承接 A结尾"咚的一声闷响" → B开头"特写青花瓷碗还在微微打转"

四、分镜审核红线(R1~R4)⭐

违反任一红线 → 自动判定为严重问题,无视审核维度。

R1 资产引用合法

  • 引用资产 ID 必须存在(无虚构、无索引越界)
  • 画面可辨识角色若 assets 已有对应资产,必须引用其 ID(含背影/肢体局部/虚化身影)
  • 每条分镜必须引用所处场景的 scene 资产 ID
  • 同一父资产在同一分镜禁主/衍生同存

R2 剧本忠实

  • 所有台词与剧本一字不差(禁改写/省略/意译)
  • 不遗漏场次和关键事件;不新增剧本外情节

R3 具象可感

  • 情绪/声音/动作必须具体可感知
  • 禁用「开心/悲伤/烘托气氛/自然声」等抽象笼统词
  • 声音具体到声源;动作为连续物理动作链

R4 父子资产选择正确

  • 衍生状态(破损/染血/夜景/激活态)匹配时必须用衍生 ID

五、分镜审核维度表(可直接复用)

审核项 严重程度 标准
资产 ID 有效 严重 所有引用 ID 在 assets 中存在
可见角色关联完整 严重 可辨识角色必须出现在引用资产 + 场头参演角色
场景资产关联 严重 每片段含所处场景 scene 资产 ID
父子资产选择正确 严重 衍生状态用衍生 ID,不主/衍生同存
台词完整性 严重 所有台词 100% 逐字出现、标明来源人
剧本覆盖度与顺序 严重 场次/事件无遗漏,顺序与剧本一致
不可拍摄内容已转译 严重 心理/旁白/抽象交代已转译为可见物象或 OS/VO
禁光影色调 严重 任何字段不出现 光/影/逆光/侧光/色温/明暗/色调/暖色/冷色 等词(特殊光照走场景衍生)
音效禁配乐 严重 音效列仅环境音+动作音,禁 BGM/配乐/音乐
人物外观不进提示词 严重 画面描述不写服装/发型/长相,只写动作/姿态/表情/状态变化
具象表达 严重 无抽象笼统词
片段时长合理 严重 每片段 ≤15s;含台词镜 ≥字数÷4+停顿+1s;无台词镜 ≤6s
长台词拆镜 中等 单镜台词/VO >20 字须拆多镜,换视角/景别,按语义停顿切
VO 音画同步 中等 VO 原文写入台词,画面照常描写;面板文字逐行点亮+滴答音效
在场人物不消失 中等 未离场角色每镜须有视觉痕迹
群演不抢戏 中等 群演仅微动作服务戏核,不单独配台词
连贯优先/拆分粒度 中等 可连戏的相邻剧情已合并,未切无谓碎镜
场头格式完整 中等 场头含场次+场景名+参演角色(按出场顺序)
景别/运镜填写 中等 每镜景别、运镜列均填写
景别视角错开 轻微 相邻镜景别/视角错开,无连续 3 镜以上同景别

评分标准

评分 严重问题 中等问题
A 可直接使用 0 ≤2
B 小修后可用 0 ≤5
C 需较大修改 1-2 不限
D 建议重做 ≥3 不限

六、分镜提示词技法(通用基础)⭐

最高优先级:分镜表内容忠实性

提示词生成是格式转换,不是创意写作。分镜表是提示词的唯一内容来源

  • 画面描述是主干,风格/画质/光影词是辅助装饰;token 冲突时画面描述优先
  • 画面描述完整保留:所有视觉元素不得遗漏
  • 语义等价转换:只改表达形式,不改语义
  • 禁止创意发散:不添加分镜表未提及的元素,不重新诠释氛围
  • 逐字段回溯校验:画面描述/场景/景别/角色动作/情绪/光影 → 逐条比对,校验不通过 = 提示词无效

首帧识别原则(分镜图 = 视频首帧参考):

画面描述类型 处理方式
静态瞬间(停步仰望/侧头冷笑) 直接按描述生成,不做动作改写
连续动作过程(走过长廊/挥剑斩下) 取动作起始瞬间的凝固态
镜头运动(缓推至中景) 起始端景别作为首帧构图
过渡效果(黑场淡入) 保留描述但标注为开场状态

❌ 常见错误:把所有动作都改写成"即将发生"的预备态,导致语义稀释

景别词库(双模式)

景别 模式B英文(Nanobanana) 模式A中文(Seedream)
大远景 extreme wide shot, establishing shot 大远景构图,环境全貌
远景/全景 wide shot, full body 全身入镜,人景比例协调
中景 medium shot, knee shot 中景构图,膝盖以上入镜
近景 medium close-up, upper body 近景构图,上半身入镜,背景虚化
半身 half body shot, bust shot 半身构图,腰部以上,浅景深
特写 close-up, face focus 特写构图,面部/细节放大
大特写 extreme close-up, macro detail 大特写,极度局部
过肩镜 over the shoulder shot 过肩构图,前景后背虚化

复合景别("远景→中景")取箭头左侧起始景别

内容映射规则:运镜/台词/音效不进提示词;情绪从映射表取面容/眼神词;光影氛围独立成段写入。


七、可整合清单

Toonflow 内容 建议整合位置
分镜表三级结构(场头/片段/镜表) ⑥ 分镜(新增格式模板)
核心信条与铁律 10 条 ⑥ 分镜(新增)
片段间过渡四原则 ⑥ 分镜(新增)
审核红线 R1~R4 + 维度表 + 评分 新增「分镜审核」环节
分镜提示词忠实性 + 首帧识别 ⑥ 分镜(增强)
景别词库双模式 工具箱(新增)

八、参考

  • 仓库:https://github.com/HBAI-Ltd/Toonflow-app
  • 关键文件:
    • data/skills/production_execution_storyboard_table.md(分镜表)
    • data/skills/production_agent_supervision.md(审核)
    • data/skills/production_skills/storyboard_prompt_techniques.md(提示词技法)
    • data/skills/script_agent_supervision.mdscript_execution_script.mdscript_execution_skeleton.md(剧本 Agent)

接续 06_Toonflow深度挖掘_工业级规范.md,本篇聚焦剧本创作规范(Toonflow 剧本 Agent)与工业化工作流理念(BigBanana)。 挖掘时间:2026-09-19


一、剧本创作 · 三大情绪要点(每集必含至少 1 个)⭐

要点 定义 作用
爆点 令人震惊/骇人听闻/惊羡的事件 快速入戏
虐点 让人心痛、难以释怀的事件 唤起怜悯,强化代入
爽点 让人兴奋的"高光时刻" 提升留存

爽点公式:爽点 = 装 + 打脸 + 震惊 + 收获

  • 装(隐藏身份被欺辱)→ 打脸(剧情急转弯)→ 震惊(围观群众态度反转)→ 收获(地位提升)

虐点逻辑:关系越紧密虐感越强;先给极致幸福再夺走。

  • 经典:始终牢记的人忘了自己 / 永远说不出口的爱 / 无人知晓的巨大牺牲 / 至死未解的误会

爆点类型:经典款(替身/穿书炮灰/救赎);反套路(双向替身/伪装拆穿/离婚反杀/全员重生/明虐暗宠/以牙还牙)


二、三大密度(单集自检总标尺)⭐

写完本集逐项自检,三项都不能"低"

情绪密度(让观众愿意看)

  • 单部剧一条核心情绪主线,无关支线全砍
  • 卡死单集情绪节点:前 3 秒强情绪钩子(最高情绪点前置);中间 30-40 秒第一个小爆发;结尾 10 秒拉满悬念卡断
  • 把情绪写进动作而非台词
  • 纪律:≠ 全程嘶吼狗血,要张弛有度

信息密度(让观众看得懂)口诀「快准新无

  • :第一集前 10 秒交代"主角是谁/什么危机/核心冲突"
  • :高效潜台词,一句话同时推进剧情+塑造人物+传递冲突
  • :单集必给新信息(新身份/新底牌/新阴谋/新反转/新关系)
  • :每句话必须满足"推进剧情/塑造人物/制造钩子/激发情绪"之一,否则删

情节密度(让观众追下去)三硬标准(缺一即流水账)

  • 因果锚定:上一情节的果是本事件的因
  • 冲突驱动:包含核心冲突的动态变化(升级或反转)
  • 价值转变:主角核心处境/方向发生不可逆改变
  • 黄金单集公式:本集 = 情节承接 + 冲突升级 + 价值转变 + 下集勾连

三、节奏 3-15-45(秒级预期管理)⭐

  • 3 秒内一个情绪冲击
  • 15 秒一个剧情变化
  • 45 秒一个强期待 —— 且在强期待里给主角留出做抉择的时空(人物刻画在此完成)
  • 结尾用反转钩子卡死

案例(妹妹被绑架):3秒绑匪喊撕票 → 15秒妹妹喊"哥别给钱" → 45秒限12点前50万 → 结尾反转(主角不凑钱去拼命)


四、情绪表达四通道 & 铺设技巧

四通道:① 行动(撕扯/狂奔/握拳/颤抖的手)② 语言(痛斥/语无伦次/泣不成声)③ 环境(悲伤=阴雨/昏暗;紧张=急促脚步/闪烁灯光;甜蜜=夕阳/暖光)④ 独白(OS 主角视角 / VO 第三方视角)

铺设技巧

  1. 先压后爆,制造反差:压得越狠反弹越爽
  2. 信息差强化期待:观众知道角色不知道(心急如焚)/ 角色知道观众不知道(期待打脸)/ 都不知道但观众知道(心疼又着急)
  3. 单集情绪公式:1 核心情绪 + 1 辅助情绪 + 1 结尾钩子(同集不超 2 个核心情绪)
  4. 拉扯:压弹簧到谷底 → 来回晃(先给"危机解除"的错误预期,在观众放松瞬间再致命一击)

五、开篇 8 大创作规则 ⭐

总原则:开篇即绝境、开篇即高潮——2 秒防划走、5 秒勾住人。 三坑必避:① 上来介绍人物/铺背景/讲世界观 ② 一群人开会 ③ 慢悠悠写景扯前情

  1. 冲突即时性:第一行就入危机(谋杀/逃跑/被虐待/难产/逃婚/被陷害)
  2. 信息量密集:对话快速交代前因后果、人物关系、背景
  3. 营造信息差:主角/配角/反派信息不对等
  4. 铺垫不拖沓:最多 3 集见效
  5. 关系有拉扯感:复杂羁绊(爱恨交织)
  6. 情节必反转:每集至少 1 个
  7. 压情绪:第 1 集开始极致打压主角,到第一个付费点前才给反击信号
  8. 明确目标:第 1 集设主角大目标,拆分为 5-10 集可实现的小目标

六、钩子与反转(服务完播与付费)⭐

单集钩子级反转三式(单集反转尽量 ≤1 个):

  1. 道具伏笔反转(契诃夫之枪):固化道具常规用途认知 → 颠覆真相
  2. 情绪回弹反转:拉满预期 → 踩碎 → 极致回弹 + 卡结尾钩子
  3. 镜头错位反转(最易上手):给 100% 真实的局部镜头误导 → 卡钩子 → 下集全景揭晓

两准则:① 画面必须 100% 真实,绝不造假 ② 不能连续使用

悬念 = 信息差三配置

  • 观众知道、角色不知道(技术悬念,最能打)
  • 观众不知道、角色知道(反转武器)
  • 双方都知道部分(长剧适用)

七、台词创作规范 ⭐

总原则:要展示,不要告诉 ① 避免"自爆家门式台词" ② 动作 > 台词 ③ 拒绝废话凑剧情

  1. 精准戳点:针对角色软肋设计(骂穷人没钱不痛,骂他儿子会继续穷才激怒)
  2. 贴合性格:自检法=遮挡名字仍能判断说话人
  3. 高效潜台词:但不要晦涩,意思要一遍就懂
  4. 接地气说人话:禁半文半白
  5. 摒弃无效台词
  6. 台词节制:单句 ≤20 字;单个角色单次 ≤50 字
  7. 开篇台词:聚焦主情绪、主矛盾

画面感五招:写场景(时间地点光影情绪)、写细节(不用形容词)、写动作(动作是因、对话是果)、写镜头(只在四节点标:开场钩子/爽点/情绪爆发/悬念揭晓)、写视听术语(剪影/叠化)

新手五大硬伤(一眼被毙):① 演员情绪描写过多 ② 小说化描写 ③ 心理描写过多 ④ 台词太长啰嗦 ⑤ 描述性动作过多


八、剧本输出格式(可套用)⭐

<scriptItem name="{作品名} EP{NN}:{集标题}">
# {作品名} EP{NN}:{集标题}
# 目标时长:{单集时长}分钟 ≈ {台词字数}字台词
# 平台:{平台规格} | 风格:{风格标签} | 节拍:{节拍概要}

---

## 剧情梗概
{主要冲突、关键转折、情感弧线,200-300字}

---

1-1 {场景名} 日/内
人物:{人物1} {人物2} 众{身份}若干

△{场景环境、布景的详细描述}
△{人物动作、表情、语气的具体描写}
{人物名1}:{对话内容}
{人物名2}:{对话内容}
△{后续动作场景描述}

OS({人物名},{情绪}):{内心独白或旁白}

---
</scriptItem>

格式要点

  • 场景标题:{场号} {场景名} {时间}/{光线}(时间=日/夜/晨/午/晚;光线=内/外)
  • 场景描述以 开头,写"人怎么干"
  • 台词:{人物名}:{台词}
  • OS(画外音)/ V.S.(旁白)
  • 场景间用 --- 分隔
  • 转场标注[硬切] [淡入] [闪白] [闪黑] [叠化]

时长控制:台词按 150 字/分钟;每场景段落 20-60 秒;纯画面段落 ≤15 秒

剧本自查清单:三大密度无"低";满足 3-15-45;黄金单集公式四要素齐;单集反转 ≤1;台词"展示不要告诉";竖屏构图无横向全景


九、BigBanana 工业化工作流理念 ⭐

来源:shuyu-labs/BigBanana-AI-Director(2.2k stars) 核心:"Script-to-Asset-to-Keyframe" 工业化工作流,抛弃"抽卡式"生成。

关键帧驱动(Keyframe-Driven)

  1. 先画后动:先生成精准的起始帧(Start)和结束帧(End)
  2. 插值生成:在两帧之间生成平滑视频过渡(Veo)
  3. 资产约束:所有画面生成受"角色定妆照"+"场景概念图"强约束,杜绝人物变形

四阶段工作流

  • Project Hub:项目中心 + 全局资产库
  • 世界观测算先:角色/场景/道具资源 + 地图/区域/地点/音乐风格锚点(持续注入后续生成)
  • Phase 01 叙事规划:结构化剧本生成(自动拆解角色/场景/道具/镜头)+ 全自动计划预审
  • Phase 02 一致性资产:角色定妆参考图 + 衣橱系统维护多套造型的一致身份;场景/道具资产化
  • Phase 03 镜头制作:导演工作台 + 镜头九宫格 + 镜头与帧
  • Phase 04 成片交付:CutOS 剪辑 + 成片导出

可借鉴点

  • 世界观测算先:单集制作前先沉淀世界观锚点(地图/区域/地点/音乐风格)
  • 衣橱系统:多套造型共享同一角色身份
  • 计划预审:正式批量生成前给出全自动方案,可逐镜头决定"九宫格分镜"还是"首尾帧"

十、可整合进本项目的清单

内容 来源 建议整合位置
三大情绪要点(爆点/虐点/爽点) Toonflow ② 转剧本(新增)
三大密度 + 黄金单集公式 Toonflow ② 转剧本(新增)
节奏 3-15-45 Toonflow ② 转剧本(新增)
开篇 8 大规则 + 三坑必避 Toonflow ② 转剧本(新增)
单集钩子级反转三式 Toonflow ② 转剧本(新增)
台词规范 + 画面感五招 + 五大硬伤 Toonflow ② 转剧本(新增)
剧本输出格式(scriptItem/△/OS/转场) Toonflow ② 转剧本(新增模板)
世界观测算先 + 衣橱系统 + 计划预审 BigBanana 流程总览(新增)

十一、参考

  • Toonflow 剧本 Agent:data/skills/script_execution_script.mdscript_agent_supervision.mdscript_execution_skeleton.md
  • BigBanana:https://github.com/shuyu-labs/BigBanana-AI-Director
  • Toonflow:https://github.com/HBAI-Ltd/Toonflow-app

接续 06/07,本篇聚焦故事骨架搭建付费点设计(Toonflow 骨架 Agent + 监督层红线)。 这是"爆款短剧能否卖出"的结构层地基。挖掘时间:2026-09-19


一、底层原则(先理解再用招式)

  1. 短剧 = 投放变现的即时情绪产品,情绪先行:长剧剧情先行,短剧情绪先行。骨架的每个选择都回到"能不能让观众停留/追下去/付费"。
  2. 三大密度 = 骨架级总标尺:情绪密度(愿意看)/ 信息密度(看得懂)/ 情节密度(追下去)。
  3. 预期管理是留人核心:建立预期 → 打破预期 → 埋下新预期。设计任何结构点先问:观众现在处于哪一步?

二、核心结构逻辑 ⭐

大三角嵌套小三角

  • 大三角:3 个核心角色/势力构成全剧主矛盾,贯穿始终
  • 小三角:围绕主角的次要矛盾,解决一个再进入下一个
  • 主流结构 = 单线型(短剧面向下沉市场,多线并行易被退稿)

矛盾 ≠ 冲突(骨架必须先钉死「欲望—阻碍」)

  • 矛盾 = 内在、静态的"想要但得不到"
  • 冲突 = 外在、动态的"为解决矛盾与对手对抗的行为"
  • 新手通病:只堆冲突(吵架打斗)不强化矛盾 → 戏是空的

矛盾四级阶梯(爆款须达 3-4 级)

  1. 基本矛盾:欲望 vs 阻碍成立但太弱(口渴,水在敌人手里)
  2. 强化矛盾:强欲望 + 强阻碍 + 不可调和 + 二选一困境
  3. 高级矛盾两个好人因不同选择走向不同命运(没有绝对好坏人)
  4. 矛盾升级:主角的行动招致更严重、不可回头的后果

金句:最好的矛盾不是好人打坏人,而是两个好人因不同选择走向不同命运


三、心理级爽点与金手指原创性 ⭐

心理级爽点三种(骨架须锁定核心 1 种):

  • 优势/金手指:主角独有能力
  • 归属:团结合作/共同目标/家国情怀
  • 秩序:用逻辑推进还原真相
  • 生理级爽点(性/暴力)易踩审核红线,慎用

金手指原创性 = 能否售出的关键

  • 必须新颖独一无二;同质化金手指 = 卖不出去
  • 反洗稿:市面已出现 >10 次就别用;可借结构骨架但设定必须升级
  • 金手指要有约束(避免"无敌外挂")

四、人物小传(把大三角写成可演的人,≤4 人)

五要素(每角色必填):

  • 身份:姓名、外貌、职业、与主角关系、正/反面、作用
  • 特征:性格、能力、行为习惯、家庭背景、标志动作或物件(记忆点)
  • 境遇:开场处境、目标、动机
  • 行动:动机驱动下的核心行动
  • 结局:因行动达成的终点方向

主角额外四项

  • 代入感五要素:贴近普通人 / 无责受难(责任≈0,多 1% 责任少约 10% 共情)/ 穷而不脏 / 共情保护 / 反差感
  • 反差两面:表面 vs 内里 + 触发条件
  • 金手指规则与边界:能做什么 / 绝对不能做什么(边界最关键) / 释放代价
  • 形态法则:男频「隐刚义柔」/ 女频「敢爱敢狠」

说话风格 + 出场

  • 句式偏好 + 2-3 个全剧复用口头禅 + 反差状态口吻变化
  • 出场七技至少一种:局部特写/动作登场/配角衬托/声音登场/场景反差/道具登场/氛围铺垫

铁规矩:反派必须有合理动机;小传只写主线相关信息。


五、前10集黄金结构 ⭐

集数 核心任务
第1-2集 快速引入主角,直接抛强冲突(契约绑定/意外变故),"一秒入坑"
第3-4集 明确主角核心行动目标,埋伏笔
第5-8集 引入多方配角,多角度施压
开篇段末 "假付费点"(目标近在咫尺却落空)+ 首个正式卡点

一卡三招(缺一被毙)

  1. 三集定生死:第 1 集写清主角性格/困境/目标/动机四要素 + 敲定类型
  2. 十集定全篇:一卡是全剧定调(虐/爽/燃)
  3. 卡点要卡住:第 10 集结尾强钩子且卡在主线上

开篇即绝境(2 秒防划走、5 秒勾住):

  • 三样东西直击人心:极端困境 / 身份反差 / 情感暴击
  • 三天坑必避:① 介绍人物/铺背景/讲世界观 ② 一群人开会 ③ 慢悠悠写景扯前情
  • 正反例:❌"真千金第一次被接回豪门,紧张自卑打量别墅" vs ✅"真千金一进门甩假千金一耳光,砸烂行李箱'这家有它没我'"

投放视角:前 10 集凑出 ≈10 个可剪 30 秒投流素材的爆点;付费冲动前置到前 3 集


六、付费点(卡点)设置规范 ⭐

按总集数 N 比例计算(四舍五入):

位置 比例 设计要求
≈10% 首次卡点 核心矛盾升级(秘密即将曝光)
≈30% 二次卡点 生死危机、秘密将揭露,强烈情感冲击
≈50% 中期卡点 阶段性目标达成时迎重大反转
≈70% 后期卡点 前期悬念伏笔逐渐展开,引入大翻转
≈90% 收尾卡点 克服困难、揭露阴谋、圆满结局(必保爽剧收尾)

付费点 5 大标准:选择关键瞬间 / 设置根本性改变 / 调动好奇心 / 善用高燃场景 / 关注爱情拉扯

付费点核心特征:场面宏大、事态紧急、围观群众多(宴会/认亲/发布会/婚礼)

假付费点:可多次设置,让观众误以为目标即将达成实则受阻

4 类核心付费点写法:身份差(通用)/ 感情错位(女频)/ 人物命运巨变 / 环境剧变(末世)

卡点设计三步(错误写法=结尾戛然而止吊胃口):

  1. 先把观众爽透:把前几集憋的情绪一次性彻底释放(投屏证据+全行业通报+反派跪地求饶)
  2. 顺主线拉高预期:明确告诉观众"刚才只是开胃菜",扣死主线
  3. 卡准核心钩子:结尾钩子必须绑定核心主线(不看下集不知如何发展)

铁律:卡点必须卡在主线上,脱离主线再炸也没用。


七、热门类型节奏框架(按总集数 N 比例)

  • 甜宠:契约绑定 → 误会拉扯 → 秘密曝光(10%) → 情感破冰 → 危机爆发(30%) → 撒糖打脸 → 新危机(60%) → 情感确认 → 圆满
  • 虐恋(追妻火葬场):前期误会伤害(1-20%) → 男主悔悟(21-40%) → 追妻受阻(41-70%) → 和解(71-100%)
  • 萌宝:带娃逆袭(1-20%) → 男主发现孩子(21-50%) → 联手反击(51-80%) → 团圆(81-100%)
  • 战神:隐藏身份受辱(1-30%) → 身份曝光打脸(31-60%) → 解决危机(61-90%) → 登顶(91-100%)
  • 重生:前世被害(1集) → 改写命运(2-30%) → 信息差逆袭(31-70%) → 复仇圆满(71-100%)

八、全局情绪布局

阶段 集数范围 核心情绪 作用
铺垫 1-10% 压抑+愤怒 拉仇恨,期待反击
试探 11-30% 紧张+小爽 缓解压抑,给甜头
转折 31-50% 震惊+焦虑 制造波澜,提升期待
爆发 51-70% 爽感+解气 情绪高潮
收尾 71-100% 温暖+圆满 正面印象

各类型情绪基调占比

  • 甜宠:甜60% + 微虐30% + 惊喜10%
  • 复仇:压抑40% + 爽感50% + 解气10%
  • 重生逆袭:爽感50% + 期待30% + 温暖20%
  • 家庭伦理:共情40% + 委屈30% + 和解30%

拉扯(段级,弹簧节奏):定爽点终点 → 压弹簧到谷底 → 来回晃弹簧 ≥3 次(先给"危机解除"的错误预期,在放松瞬间致命一击)。


九、全剧股价级反转设计(第一阶,决定能否爆款)⭐

必须在骨架阶段 100% 定死,不能写一半临时加。全剧 ≈3 个

三式(都是"三步走")

  1. 预期误导反转(铺垫误导 → 预埋细节 → 反转揭晓):用思维定式引导出"合理的错误结论",反转后所有线索严丝合缝
  2. 人设颠覆反转(贴死标签 → 暗埋反差细节 → 揭真实人设):只能用在配角,绝不动主角核心底色
  3. 动机置换反转(固化表层动机 → 预埋双轨细节 → 置换核心动机):同一行为同时适配表层/深层两个动机

铁规矩

  • 全剧反转 ≈3 个(多了审美疲劳)
  • 空降结局硬凹反转 = 耍流氓,观众骂烂尾
  • 给观众的画面必须 100% 真实,绝不造假骗人

十、骨架输出结构(可套用)

# {作品名} - 故事骨架
## 故事核(一句话)
## 隐线(人物弧)
## 人物小传          ← 大三角核心角色,≤4人
## 三幕结构
## 分集决策          ← 模式A逐集展开(≤20集) / 模式B总览表+指定集展开(>20集)
## 全局删减决策记录
## 付费卡点设计
## 股价级反转登记表   ← 全剧约3个反转,标注预埋集与揭晓集

十一、骨架审核红线(监督层)⭐

骨架质量红线(14 项,节选)

  • 大三角成立;单线型(多线并行→严重)
  • 故事核 + 隐线清晰
  • 前 10% 完成"一秒入坑→目标明确→多方施压→首次卡点"
  • 付费点按 ≈10%/30%/50%/70%/90% 分布
  • 情绪波浪上升,无连续 3 集同一强度
  • 集末钩子类型多样化,"永不圆满收尾"
  • 股价级反转 ≈3 个,预埋集早于揭晓集,三式合规
  • 矛盾达高级/升级级别
  • 金手指新颖独一无二、非同质化
  • 前 10 集 ≈10 个可剪 30 秒爆点

短剧通用红线(9 条)

  1. 连续 3 集以上无情绪爆点
  2. 多线并行叙事(必须单线型)
  3. 第 1 集无强冲突/强情绪
  4. 出现"市长""县长"等现实官职称谓
  5. 大段旁白解说世界观
  6. 金手指同质化
  7. 无明确股价级反转或反转空降硬凹
  8. 开篇踩三天坑
  9. 大三角只堆吵架、无底层欲望—阻碍的真矛盾

十二、可整合清单

内容 建议整合位置
底层原则三条 新增「故事骨架」环节(①之前)
大三角/矛盾四级阶梯 骨架环节
心理级爽点 + 金手指原创性 骨架环节
人物小传(五要素 + 主角四项 + 出场七技) 骨架环节 / ③ 人物
前10集黄金结构 + 一卡三招 骨架环节
付费点规范(比例/5标准/4写法/卡点三步) 骨架环节
类型节奏框架 5 类 骨架环节
全局情绪布局 + 拉扯 骨架环节
股价级反转三式 骨架环节
骨架输出结构 + 审核红线 骨架环节 / 审核

⚠️ 重要提示:本项目原流程从「① 选本改文」起步,Toonflow 的完整链路其实在「选本」之前还有一层 「故事骨架搭建」(原著→骨架→分集→剧本)。建议在流程中新增「前置:故事骨架」环节,作为长篇/系列化漫剧的起点。


十三、参考

  • Toonflow 骨架 Agent:data/skills/script_execution_skeleton.md
  • Toonflow 剧本监督:data/skills/script_agent_supervision.md
  • 仓库:https://github.com/HBAI-Ltd/Toonflow-app

接续 06/07/08,本篇聚焦 Toonflow 的多 Agent 编排架构资产体系艺术风格约束手册视频提示词生成。 挖掘时间:2026-09-19


一、三层 Agent 编排架构 ⭐

Toonflow 采用 决策层 → 执行层 → 监督层 三层架构:

决策层 Agent(唯一对接用户)
  ├─ 需求分析 → 任务拆解 → 调度执行层 → 质量管控 → 记忆检索
  ├─ 派发 ⭢ 执行层(6 阶段)
  └─ 派发 ⭢ 监督层(审核产出物)

核心原则

  • 决策层不执行具体任务,不读工作区数据,不直接操作资产
  • 决策层不做执行层的判断,执行层返回什么结论就基于该结论决策
  • 执行层/监督层只接收决策层派发的指令

对漫剧制作的启示:把"人 + AI 工具"的协作也按此分层——

  • 决策层 = 你(把控方向、做取舍)
  • 执行层 = 各个提示词 Agent(跑具体生成)
  • 监督层 = 审核 Agent(查一致性/合规/忠实度)

二、六阶段制作流水线 ⭐

阶段1 导演规划 → 阶段2 衍生资产分析 → 阶段3 衍生资产生成(可选)
→ 阶段4 构建分镜表 → 阶段5 分镜面板写入 → 阶段6 分镜图生成
阶段 内容 审核
1 导演规划 制定导演拍摄计划(分场汇总表/逐场注意事项/场间过渡) 不需要
2 衍生资产分析 逐条分析并写入衍生资产(破损/染血/夜景等) 不需要
3 衍生资产生成 为衍生资产出图(异步) 不需要
4 构建分镜表 剧本拆分为结构化分镜表 需要 → 自动派发监督层
5 分镜面板写入 写入视频描述/提示词 不需要
6 分镜图生成 出分镜图(异步) 不需要

关键机制

  • 资产约束:阶段 4/5/6 只能使用资产库中已存在的资产
  • 缺资产不审核:基础资产为流程外输入,无任何阶段可新增
  • 导演规划只给情绪与注意事项,不提供镜头 —— 景别/运镜/画面/镜头数由分镜阶段自行设计
  • 用户确认卡点:阶段 2 分析结果必须展示给用户确认,不可自动进入阶段 3

三、资产体系(Asset System)⭐

资产类型role(角色)/ scene(场景)/ prop(道具)

父子资产结构(衍生资产)

  • 主资产:角色/场景/道具的基础形态
  • 衍生资产:同一主体的状态变体(破损/染血/夜景/激活态/换装等)
  • 引用规则:衍生状态匹配剧情时必须用衍生 ID;同一分镜内禁主/衍生同存

分镜表资产引用(片段级):

**引用资产名称**:[苏晚卿, 凌玄, 青云令, 大殿]
**引用资产ID**:[101, 100, 202, 300]

图像资产标注规则(提示词正文):

  • associateAssetsIds 引用顺序标注 @图N 为xx{类型}
  • 提示词正文中所有涉及该角色/场景/道具的位置,必须用 @图N 替代名称,建立参考图与画面的直接绑定

衣橱系统(BigBanana 同款思路):多套造型共享同一角色身份。


四、艺术风格约束手册(art_skills)⭐

Toonflow 内置 11 种画风,每种都有完整的 art_prompt/ 约束手册:

2D_90s_japanese_anime        2D_chinese_guofeng      2D_flat_design
2D_mature_urban_romance      3D_anime_render         3D_chinese_traditional
3D_clay_stopmotion           3D_guofeng_cyber        realpeople_ancient_chinese
realpeople_modern_city       realpeople_urban_modern

每种画风的约束手册结构(以 2D_mature_urban_romance 为例):

  • art_character.md — 人物基础形象约束(面容/肤感/体型)
  • art_character_derivative.md — 人物衍生(换装/状态)
  • art_prop.md — 道具
  • 以及场景/风格基因/色彩盘等

人物基础形象约束要点

项目 女性 男性
肤色 冷白皮、白皙通透 白皙透亮带健康感
光泽 柔和光感(非哑光非油光) 清爽自然光泽
头身比 6.5-7.5 头身 7-8 头身
肩颈 纤细肩线、锁骨清晰 宽肩窄腰

核心原则:面容即灵魂(五官是唯一锚点);四视图一致气质从角色描述提炼(不再固定五官参数,由角色描述驱动 AI 生成,保证差异化)。

本项目的对应关系:你的《四、S级三视图指令词》≈ Toonflow 的 art_character;《三、S级人物指令词》的四种风格 ≈ Toonflow 的 art_prompt 体系。可借鉴其"按画风分包约束手册"的组织方式


五、视频提示词生成(12 字段解析)⭐

videoDesc 结构(分镜面板写入的核心字段,顿号分隔 12 字段):

画面描述、场景、关联资产名称、时长、景别、运镜、角色动作、情绪、光影氛围、台词、音效、关联资产ID

两种生成模式

① 纯文本多参模式(流程 A)

  • 仅写入视频描述与资产绑定,不生成提示词、不出分镜图
  • 以表内「组」为写入单位,track 顺序累加
  • 适用于:直接用现成图/视频素材

② 首尾帧模式(流程 C)

  • 完整生成 prompt 与分镜图,每条分镜独立一组
  • 含人物连贯性预分析、@图N 标注、六项忠实性校验
  • 适用于:需要精细控制画面一致性的场景

人物空间位置与朝向预分析(首尾帧模式第 2 步):

  • 画面位置分配:从"空间关系"列提取(左前/中前/右前/左中/中中/右中/左后/中后/右后)
  • 朝向提取:从"朝向"列提取
  • 建立基准表角色A → 左前,面朝右 / 角色B → 右后,面朝左同场景内锁定不变
  • 变化标记:转身/走位在对应行标记变更点

视频提示词模型模式modelPrompt/video/):

  • universalFirstAndLastFrameMode.md — 通用首尾帧模式
  • universalMulti-parameterMode.md — 通用多参模式
  • seedance2Multi-parameterMode.md — 即梦/Seedance 多参
  • wan2.6Single-imageFirstFrameMode.md — 万相首帧模式

六、分镜面板写入的"承接上镜"机制 ⭐

解决跨片段连贯性,值得借鉴。

承接上镜段(仅同场内、非该场第一组才写): 以同场上一组末行为依据,通读其「画面描述」与「角色动作」,推导出上镜结尾应被本镜承接的画面,综合为一句过渡,至少覆盖:

  1. 画面/场景定格状态 — 上镜结束瞬间的画面(角色与关键道具的位置、姿态、正在进行的交互)
  2. 角色最后动作 — 动作收尾后的形态(定格时的终态,不是动作起始)
  3. 位置与朝向 — 角色方位与面向

示例:

承接上镜:上镜定格于角色A 立于书房窗前、左前位、面朝右,
刚将信纸放回桌面、右手收回胸前——本镜由此姿态与机位延续

铁律:不得跨「场」承接(硬切换场不写承接)。


七、导演规划(阶段1)的内容结构

导演规划输出三节(只给情绪与注意事项,不给镜头):

  1. 分场汇总表场景名 / 情绪浓度 / 情绪基调(含 X→Y)
  2. 逐场注意事项情感砸点 / 一致性锚点 / 空间距离 / 易错提示
  3. 场间过渡过渡方式 / 说明

分镜阶段以此对齐:情感砸点→给到位的景别/运镜;一致性锚点→跨镜画面连续;空间距离→站位与景别。


八、可整合清单

内容 建议整合位置
三层 Agent 架构(决策/执行/监督) 流程总览(人机协作模型)
六阶段流水线 流程总览(可与现有 ⓿~⑧ 合并)
资产体系(role/scene/prop + 父子衍生) 新增「资产管理」节
图像资产 @图N 标注规则 ⑥ 分镜 / ⑦ 视频
按画风分包的约束手册 ④ 三视图 / ③ 人物(组织方式)
videoDesc 12 字段 ⑥ 分镜(可作分镜表字段标准)
承接上镜机制 ⑥ 分镜(新增)
导演规划三节结构 ⑥ 分镜前(新增「导演规划」环节)
视频模型模式(首尾帧/多参) ⑦ 视频生成

九、参考

  • 决策层:data/skills/production_agent_decision.mdscript_agent_decision.md
  • 执行层:data/skills/production_execution_storyboard_table.mdstoryboard_panel.mdstoryboard_gen.md
  • 监督层:production_agent_supervision.mdscript_agent_supervision.md
  • 艺术风格:data/skills/art_skills/*/art_prompt/*.md(11 种画风)
  • 视频模型:data/modelPrompt/video/*.md
  • 仓库:https://github.com/HBAI-Ltd/Toonflow-app

接续 09,本篇聚焦 人物衍生资产(服化妆造)的分层体系四视图设定图规范——这是保证跨镜人物一致性的关键。 挖掘时间:2026-09-19


一、叠加原则(衍生资产六铁律)⭐

  1. 面容不变 — 叠加后五官必须与底模完全一致,禁止面容偏移
  2. 姿态不变 — 保持底模自然站立姿态,禁止任何姿态/动作/体态变化
  3. 逐层可控 — 每层独立描述,便于按层替换(换装不换妆)
  4. 风格统一 — 所有服化元素服从同一美学体系
  5. 质感不降 — 叠加后质感标准不低于底模
  6. 纯服化范畴 — 仅叠加妆容/发型/服饰/配饰/鞋履,禁止引入道具、场景、环境、动作

二、叠加层级 L0-L6 ⭐

层级 内容 说明
L0 底模 基础形象底模,不修改
L1 妆容(决策层) 先分析线索,再决策「基础妆/轻妆/正式妆」强度
L2 发型造型 发髻/束发/编发 + 发饰
L3 中衣/内搭 替换白色基础中衣
L4 外衣/主服 差异化服装(衬衫/外套/连衣裙/套装)
L5 配饰 首饰/手表/眼镜/包袋
L6 鞋履 高跟鞋/短靴/乐福鞋/运动鞋,与服装完整配套

范畴边界:人物衍生仅含 L0-L6(服化妆造)。

  • 道具(手机/书本/雨伞)→ 属道具资产
  • 场景环境(室内外/天气)→ 属场景资产
  • 姿态动作(行走/回眸)→ 属其他范畴

三、妆容决策(L1)⭐

关键:角色底模虽为素颜,但衍生资产默认进入妆造流程——根据线索在「基础妆/轻妆/正式妆」之间决策强度,而不是保持素颜

L1 线索分析四步

步骤 处理 决策
S1 提取面部状态词、情绪词、强度词 妆容需求摘要
S2 过滤非妆容线索(道具/场景/动作/姿态不作依据) 防误判
S3 匹配妆容风格矩阵 基础妆/轻妆/正式妆
S4 生成 L1 提示词 只输出结论

线索到妆容映射

线索类型 典型线索 L1 决策
无面部强调 仅服饰/发型变化 基础妆
轻微面部线索 柔和/含笑/睫毛轻颤 轻妆(极淡)
明确病弱线索 面色苍白/唇色极淡/眼下微红 病弱妆(轻妆)
明确仪式线索 盛装/典礼/正式场合 正式妆(受控)

判定原则:所有衍生资产都要有妆造;道具/场景/姿态变化不得单独抬高妆容强度


四、四视图设定图规范 ⭐

位置 视图 角度 景别 要求 提示词
左一 人像特写 正面平视 面部至锁骨 面部占 60%+ portrait closeupface detail
左二 正视图 正面 0° 全身立像 面对镜头 front viewheight mark
右二 侧视图 右侧 90° 全身立像 纯侧面轮廓 side viewprofile
右一 后视图 后方 180° 全身立像 后脑发饰/背部服饰 back viewrear view

画面规范

  • 布局:同一画面从左至右并排四视图
  • 背景:纯净中性灰 #E8E8E8
  • 站姿:自然站立、双脚平行微分、双臂自然下垂(禁止姿态变化
  • 表情:符合妆容风格的微表情,仅限面部,不涉及肢体
  • 光线:均匀柔光,前方主光 + 双侧补光,无硬阴影
  • 一致性:面容/妆容/发型/发饰/服饰/配饰/鞋履完全一致
  • 画面比例:建议 4:1 或 3:1

⚠️ 注意:这是四视图(含人像特写),比常见三视图多一个"人像特写"位。


五、衍生资产提示词模板 ⭐

以角色基础形象图为底图,img2img叠加服化妆造,
二次元{性别}角色四视图设定图,赛璐璐上色,现代都市风格,强对比度,极致细节,8K,超保真
character design sheet,character turnaround,
保持基础形象面容不变,{整体气质},
【L1·妆容】根据用户线索决策:{基础妆/轻妆/正式妆};使用 {妆容风格},肌肤柔光,{眉妆},{眼妆},{唇妆},
【L2·发型】{造型类型},发丝层次分明,{发饰描述},
【L3+L4·服饰】{主色}{款式},{材质},{装饰工艺},按角色身份与场景差异化搭配,避免所有人服装同款同色,衣服质感清晰,纹理超清晰,
【L5·配饰】{头饰},{耳饰},{手表},{包袋},
【L6·鞋履】{鞋型},{鞋面材质},{鞋跟/鞋底描述},与服装风格一致,
同一画面左至右并排:人像特写+正视图+侧视图+后视图,
自然站立,纯净中性灰背景,均匀柔光,无硬阴影,
四视图一致性,面容细腻渲染,发丝细腻渲染,纹理细节超清晰
图中不要有任何文字

输出格式约束(严格):

  • 仅输出提示词文本,不输出任何其他内容
  • 禁止输出:速查表/分层构建方案/视觉约束表/禁止事项表/衍生方案等一切非提示词内容
  • 禁场景:不输出场景/环境/天气/背景叙事
  • 禁道具:不输出手机/书本/雨伞等手持物
  • 禁姿态变化:不改变底模姿态,不输出行走/回眸/举手等
  • 直接输出可用提示词代码块,无需标题/表格/解释

六、对本项目的映射与建议

Toonflow 概念 你的现有内容 建议
L0-L6 分层叠加 《四、S级三视图指令词》 引入分层思路:把"妆容/发型/中衣/外衣/配饰/鞋履"拆成独立层,便于换装复用
衍生资产(换装) 新增:同一角色多套造型,共享身份
妆容决策流程 新增:底模素颜 → 按剧情线索决策妆容强度
四视图(含人像特写) 三视图 考虑加人像特写位(你的三视图已有 6 张头像区,功能等价)
img2img 叠加 提示词直出 建议:衍生资产用图生图(以底模为参考)保证一致性

七、参考

  • data/skills/art_skills/*/art_prompt/art_character_derivative.md(人物衍生)
  • data/skills/art_skills/*/art_prompt/art_character.md(人物基础)
  • data/skills/production_execution_storyboard_gen.md(分镜图生成)
  • 仓库:https://github.com/HBAI-Ltd/Toonflow-app

接续 10,本篇覆盖 Toonflow 场景约束手册道具约束手册 与 **11 种画风的"风格基因"**对照。 挖掘时间:2026-09-19


一、场景约束手册(art_scene)⭐

场景美学五原则

  1. 空间叙事 — 场景承载情绪与叙事功能,不是纯背景板
  2. 层次纵深 — 所有场景必须具备前/中/后景,杜绝扁平
  3. 质感至上 — 现代材质纹理超清晰(玻璃/金属/木材/布料/墙面)
  4. 风格为锚 — 所有画面以指定画风为标准
  5. 戏剧化低调光影 — 光影服务情绪

季节色调映射

季节 主色调 辅色调 提示词
青绿 + 淡粉 浅蓝、鹅黄 春意青翠、樱花粉嫩
碧绿 + 蔚蓝 天青、雪白 夏木葱郁、蓝天如洗
橙黄 + 棕红 赭石、金黄 秋叶金黄、枫红似火
素白 + 冷蓝 灰白、淡蓝 冬日清冷、雪花皑皑

室内场景空间规范

维度 约束
风格 现代都市家居/办公室/咖啡厅/公寓
材质 玻璃/金属/木材/布艺
色调 低饱和冷色调为主、暖色点缀
纵深 前/中/后景层次
光照 自然光/人造光、光影层次分明
镜头感 电影级构图、浅景深虚化、film grain
瑕疵感 现代使用痕迹、生活气息

二、道具约束手册(art_prop)⭐

道具设计五原则

  1. 功能可读 — 用途一目了然,造型服务功能
  2. 质感极致 — 材质纹理清晰(金属/塑料/木材/玻璃/布料)
  3. 风格统一 — 符合世界观,无违和元素
  4. 尺度明确 — 通过参照物暗示真实尺寸
  5. 纯道具独立展示画面中只能出现道具本身,严禁人物/手部/肢体;不得处于被持有/佩戴状态,必须静物陈列

四类道具美学约束

类别 类型 材质 光泽
办公用品 笔/笔记本/文件夹/眼镜 金属/塑料/皮革/纸张 哑光/微光/金属反光
饮品器具 咖啡杯/玻璃杯/保温杯 玻璃/陶瓷/金属 玻璃反光/陶瓷釉光
个人物品 手机/手表/眼镜/钥匙 金属/玻璃/皮革 玻璃反光/金属质感
生活器物 书卷/装饰画/香薰/台灯 木材/玻璃/金属/布料 木纹清晰/玻璃通透

多角度设定图(道具四宫格):正面图 / 侧面图 / 背面图 / 细节特写


三、四视图体系(人物/道具/场景通用)⭐

Toonflow 用**统一的"四视图设定图"**规范所有资产:

人物四视图:人像特写 / 正视图 / 侧视图 / 后视图 道具四视图:正面 / 侧面 / 背面 / 细节特写 场景三视图:主广角 / 侧角度 / 反打角度

通用呈现规范:纯净中性灰背景、均匀柔光、无硬阴影、各视图保持一致、图中无文字。


四、11 种画风的"风格基因"对照 ⭐

每种画风都有一句**"X 即灵魂"**的核心基因 + 专属表现手法:

画风 核心基因 表现手法
2D 现代都市言情 面容即灵魂 赛璐璐上色、清晰线条、戏剧化低调光影
2D 90年代复古日系 线条即灵魂 手绘流畅线条,避免数字化锐利边缘
2D 扁平设计 轮廓即灵魂 扁平色块分层,无阴影渐变,靠色块对比
2D 国风 面容即灵魂 古典东方美学
3D 二次元渲染 面容即灵魂 次世代建模
3D 国风赛博 四视图标准 3D超精致建模,无表情正对镜头超特写
3D 黏土定格 黏土肌理为魂 手工捏塑痕迹、手指压痕清晰
3D 国风传统 传统国风 3D
真人 古风 面容即灵魂 毛孔级精细渲染
真人 现代都市 面容即灵魂 写实摄影质感

关键洞察:不同画风的"灵魂锚点"不同——

  • 写实/赛璐璐 → 面容
  • 复古日系 → 线条
  • 扁平风 → 轮廓
  • 黏土定格 → 肌理

这提示我们:写提示词时,要按画风锁定不同的"第一锚点",不能千篇一律强调五官。


五、各画风的一致性策略差异

画风 面容约束方式 特殊要求
2D 现代都市 由角色描述驱动 AI 生成五官(不预设 保证人物间外观差异化
3D 建模 需"20 字避开同模描述" 防止不同提示出现同一张脸 无表情、正对镜头、超特写
真人古风 毛孔级精细渲染 冷艳含情
黏土定格 简化造型底模 治愈氛围、柔和圆润

六、对本项目的映射与建议

Toonflow 概念 你的现有内容 建议
场景五原则(层次纵深/空间叙事) 《五、S级场景指令词》 你已强调"前中后景三层",与之一致 ✅
季节色调映射 可补充:按季节选色调
道具五原则(纯道具独立展示) 人物指令词里的道具部分 强化:"道具必须是静物陈列,禁人物/手部"
统一四视图体系 三视图 可统一:人物/道具/场景都用"多视图设定"
画风"灵魂锚点"差异 四种提示词风格 重要补充:按画风锁定不同第一锚点

七、参考

  • data/skills/art_skills/*/art_prompt/art_scene.md(场景)
  • data/skills/art_skills/*/art_prompt/art_prop.md(道具)
  • data/skills/art_skills/*/art_prompt/art_character.md(人物,11 种画风)
  • 仓库:https://github.com/HBAI-Ltd/Toonflow-app

接续 11,本篇覆盖 11 种画风的视频提示词标签库(可直接复制)与 场景衍生变体规范。 挖掘时间:2026-09-19


一、画风标签库(可直接复制)⭐

生成视频/图片提示词时,按画风注入对应标签。三种模式:通用多参(英文)/ 通用首尾帧(英文)/ Seedance 2.0(中文)。

1. 2D 成熟都市言情

  • 多参(英)mature urban romance anime, cel-shaded, cinematic lighting, cool tones, dramatic low-key shadows, clean line art
  • 首尾帧(英)mature urban romance anime, cel-shaded, cinematic lighting, cool tones, dramatic low-key shadows, clean line art, shallow depth of field
  • Seedance(中)2D成熟都市言情动画,2D赛璐璐上色,电影级光影,冷色调,戏剧化低调光影,清晰线条

2. 2D 90年代复古日系

  • 多参(英)90s Japanese anime, hand-drawn cel animation, soft warm tones, cinematic, clean line art, nostalgic aesthetic
  • 首尾帧(英)... , shallow depth of field
  • Seedance(中)90年代日式动画,手绘赛璐璐,柔和暖调,电影风格,清晰线条,怀旧质感

3. 2D 扁平设计

  • 多参(英)2D flat design, geometric shapes, solid color blocks, minimal shadows, clean lines, modern aesthetic
  • 首尾帧(英)... , shallow depth of field
  • Seedance(中)2D扁平风格,几何造型,纯色色块,无阴影,简洁线条,现代简约

4. 3D 黏土定格

  • 多参(英)stop-motion claymation, clay texture, finger imprints, warm tones, soft bokeh, whimsical 3D cartoon
  • 首尾帧(英)... , shallow depth of field
  • Seedance(中)定格动画黏土风格,黏土肌理,手指压痕,暖色调,柔和浅景深,奇幻3D卡通

5. 真人 现代都市

  • 多参(英)live-action urban cinema, real human actors photography, contemporary Chinese urban setting, cinematic color science, natural light and practical lighting, shallow depth of field, handheld camera breathing, smooth Steadicam movement, film grain texture, motion blur for video, cinematic frame rate, non-CGI non-rendered
  • 首尾帧(英)live-action urban cinema, real human actors photography, contemporary Chinese urban setting, cinematic color science, natural light and practical lighting, rack focus, focal plane locking, shallow depth of field, cinematic bokeh, film grain texture, non-CGI non-rendered
  • Seedance(中)真人都市电影摄影,真人实拍质感,当代中国都市,电影级色彩科学,自然光与实用光源调度,浅景深,手持呼吸感或稳定器流动,电影颗粒质感,视频动态优化,非CG非渲染

6. 真人 都市写实

  • 多参(英)modern urban drama, photorealistic, cinematic, natural lighting, ultra-fine detail
  • Seedance(中)都市写实摄影,电影风格,自然光照,极致细节

7. 3D 国风传统

  • 多参(英)Chinese traditional 3D render, PBR materials, volumetric lighting, oriental aesthetic, elegant and grand, cinematic
  • Seedance(中)国风3D渲染,PBR材质,体积光,东方美学,典雅大气,电影风格

其余画风(2D 国风 / 3D 二次元渲染 / 3D 国风赛博 / 真人古风)

同结构,按"一级风格 + 渲染方式 + 光影 + 色调 + 质感"组合。


二、场景衍生变体规范 ⭐

衍生五原则:空间一致 / 景别驱动 / 时段切换 / 天候变化 / 风格为锚

2.1 景别变体

景别 范围 叙事功能
大全景 场景全貌 + 周围环境 建立空间感、定位
全景 场景完整呈现 展示空间结构
中景 场景局部 聚焦功能区
近景 场景细部 材质/氛围道具特写
特写 极局部细节 材质纹理/关键道具

衍生规则:景别变化时,建筑外观/布局/材质/色调保持不变,只变视角/裁切/景深。

2.2 时段变体

时段 视觉特征 提示词
清晨 冷白光调、薄雾感 晨光微熹、清晨薄雾
正午 明亮、阴影短、色彩鲜明 正午阳光、光线明亮
黄昏 金色调、长影、天空渐变 暮色金辉、golden hour
夜间(月光) 冷蓝色调、幽静清冷 月光清辉、moonlight
夜间(灯火) 暖黄点缀、明暗对比 灯火阑珊、灯光氛围

2.3 天候变体

天候 视觉特征 提示词
晴天 明亮、阴影清晰 晴空万里、阳光明媚
阴天 光线均匀、无硬影 阴天柔光、overcast
薄雾 能见度降低、空气朦胧 薄雾弥漫、雾气缭绕
细雨 水珠、湿润反光、雨丝 细雨如丝、雨幕轻纱
飞雪 白色覆盖、雪花飘落 飞雪纷纷、银装素裹

三、风格标签的通用结构(可迁移到你的流程)

从 Toonflow 的画风标签可提炼出一个通用公式

[一级画风] + [渲染方式] + [光影] + [色调] + [质感/细节]

示例拆解(都市言情二次元):

  • 一级画风:mature urban romance anime
  • 渲染方式:cel-shaded
  • 光影:cinematic lighting, dramatic low-key shadows
  • 色调:cool tones
  • 质感:clean line art

应用到你的四种提示词风格:为你常用的画风也建立固定标签串,避免每次手写。


四、对本项目的映射与建议

Toonflow 你的现有内容 建议
画风标签库(可复制) 四种风格提示词 建立你的画风标签串(固定复用)
场景衍生(时段/天候) 《场景设定》有天气特效 对齐:把时段/天候拆成独立变体
景别变体衍生 《景别》文档 整合:景别变化保持空间一致
三模式标签(多参/首尾帧/Seedance) 2-15秒版提及 3D 动漫 可补充:按模式给不同标签

五、参考

  • data/skills/art_skills/*/art_prompt/art_storyboard_video.md(画风标签,11 种)
  • data/skills/art_skills/*/art_prompt/art_scene_derivative.md(场景衍生)
  • data/skills/art_skills/*/art_prompt/art_prop_derivative.md(道具衍生)
  • 仓库:https://github.com/HBAI-Ltd/Toonflow-app

接续 12,本篇覆盖 导演规划(阶段1)的完整方法论改编策略的 8 大要点。 挖掘时间:2026-09-19


一、导演规划(阶段1)⭐

位置:在「构建分镜表」之前,把剧本转化为拍摄计划。 核心原则:只拆分、不创作(唯一例外是「场间过渡」);不规划光影/色调/配乐

1.1 分场原则

  • 一个场 = 同一时空下一段连续戏:以地点变更 / 时间跳变 / 戏剧单元收束为切点
  • 剧本已有场标 → 直接沿用(原著保真)
  • 剧本无场标 → 按时空切(地点或时间明显切换处另起一场)
  • 场次须全覆盖剧本,按顺序编号 Sc1、Sc2…

1.2 台词统计口径

  • 逐场统计:台词条数(对白/独白/画外音/旁白,按句或对话轮计)+ 台词总字数
  • 只忠实计数,不预算时长/镜头数(供下游按语速换算节奏)
  • 无台词场记 0 条 / 0 字

1.3 情绪分析口径

  • 逐场给 情绪浓度 0~10 + 一句话情绪基调
  • 有推进则标 X→Y(如"试探→破防")
  • 不凭空拔高

1.4 场间过渡设计(唯一允许"创作"的环节)

  • 先判断是否必要,不必要不增补(同一时空连续推进 → 直接硬切)
  • 需要时依前场收束/后场开场情绪 + 时空关系,凭经验判断最顺衔接:
    • 动作衔接过渡(承上启下的连接动作)
    • 空镜过渡(跨时空/需缓冲时,插入具体空镜)
    • 淡入淡出/叠化(大跨度或大段落收束)
  • 增补剧本未写的连接性过场内容,但仅限此环节

1.5 逐场注意事项(留给下游)

  • 关键情感砸点:该场最该被拍出的瞬间(具象描述)
  • 视觉一致性锚点:跨场需沿用的面貌/服装/道具/空间关系
  • 空间与距离:站位/朝向/距离感
  • 环境音提示:1~2 个可感知核心环境音(具体声源,不规划配乐)
  • 易错提示:台词密集/多人同框/动作复杂等难点

1.6 输出结构

分场汇总表:| 场次 | 场景名 | 台词条数 | 台词字数 | 情绪浓度 | 情绪基调(含 X→Y)|
逐场注意事项:Sc1:情感砸点/一致性锚点/空间距离/环境音/易错提示
场间过渡:| 场间 | 过渡方式 | 说明 |

二、改编策略(8 大核心要点)⭐

  1. 强画面感(可拍摄性) — 拍不出来就换表达方式
  2. 台词精简(高信息密度) — 每句服务剧情推进或人物塑造
  3. 节奏极致快 — 可适当牺牲细微逻辑,优先保证节奏
  4. 只沿主线展开 — 砍支线,仅保留核心人设与高光时刻
  5. 降低理解成本 — 漏看部分不影响整体理解
  6. 情绪大于一切 — 逻辑与情绪冲突时优先情绪张力
  7. 开篇给足期待感 — 第 1 集呈现激烈高情绪场景
  8. 展示不要告诉 — 把叙述/心理描写转成可拍的动作与画面(动作是因、对话是果)

三、类型创新与原创性 ⭐

三条死路(剧本卖不出去通常死在这):

  • 模仿:换汤不换药
  • 抄袭桥段:照搬公共桥段(认亲胎记、三巴掌)
  • 洗稿:父亲改母亲、豪宅改公寓,内核全抄

判定标准:我设计的金手指/桥段/反转,市面出现 >10 次就别用。允许借结构骨架,但桥段/台词/设定必须升级。

类型创新三大方向

  1. 元素创新(最易落地):年龄反转 / 性别反转 / 背景反转 / 视角反转
  2. 类型融合:团宠+鉴宝、萌宝+重生+寻亲
  3. 情节创新(最考验功力):如宫斗避开"下毒推水",改用"心理操控"式陷害

四、矛盾强化(把原著矛盾抬到爆款级别)⭐

  • 矛盾 ≠ 冲突:改编不要只把原著情节转成吵架打斗,要先强化底层矛盾
  • 沿矛盾四级阶梯升级:基本 → 强化(二选一困境)→ 高级(两个好人因不同选择走向不同命运)→ 升级(招致不可回头后果)
  • 目标:把原著矛盾抬到 3-4 级

五、各类型情绪基调映射(改编时锁定)

类型 核心情绪基调 占比参考
甜宠 甜 > 微虐 > 惊喜 甜60% + 微虐30% + 惊喜10%
复仇 压抑 > 爽感 > 解气 压抑40% + 爽感50% + 解气10%
重生逆袭 爽感 > 期待 > 温暖 爽感50% + 期待30% + 温暖20%
家庭伦理 共情 > 委屈 > 和解 共情40% + 委屈30% + 和解30%

关键:基调一旦确定不要中途大幅更改(甜宠突然加"全家惨死"会让观众弃剧)。


六、人物弧光保留原则

  1. 人物弧光:初始状态 → 关键变故 → 性格转变 → 最终状态(转变须有锚点)
  2. 行动塑造:不同性格角色面对同一困境反应须有差异
  3. 设定记忆点:专属口音 / 下意识动作 / 特殊怪癖 / 独门技能
  4. 人物推动剧情:是"人物引导剧情"而非"把人物套入预设剧情"

七、删减决策优先级 ⭐

优先删除:拖沓铺垫 / 低密度重复内容 / 载体不支持(大段心理、复杂世界观)/ 弱支线 优先保留:核心情绪点 / 关系拉扯 / 付费点前的情绪铺垫链 / 身份反差与信息差 / 高光打脸与反转 替代方案:蒙太奇压缩 / 台词带过 / 完全删除


八、可整合清单

内容 建议整合位置
导演规划(分场/台词统计/情绪浓度/场间过渡/逐场注意事项) 新增「导演规划」环节(② 剧本之后、⑥ 分镜之前)
改编 8 大要点 ② 小说转剧本(增强)
类型创新三方向 + 三条死路 ② 小说转剧本(新增)
矛盾强化四级 【前置】故事骨架(已有,可交叉引用)
情绪基调映射 ② / 骨架(已有)
人物弧光四原则 【前置】骨架(已有)
删减决策优先级 ② 小说转剧本(新增)

九、参考

  • data/skills/production_execution_director_plan.md(导演规划)
  • data/skills/script_execution_adaptation.md(改编策略)
  • data/skills/art_skills/*/art_prompt/art_prop_derivative.md(道具衍生状态)
  • 仓库:https://github.com/HBAI-Ltd/Toonflow-app