⚡ 速查表
| 景别 | 远景 / 全景 / 中景 / 近景 / 特写 / 微距 |
| 视角 | 平拍 / 仰拍 / 俯拍 / 鸟瞰 / 虫眼 / 侧拍 / 斜侧拍 |
| 运镜 | 推 / 拉 / 摇 / 移 / 跟拍 / 固定 + 环绕 / 升降 / 甩镜 / 变焦 |
| 情绪 | 高兴 / 生气 / 伤心 / 害怕 / 厌恶 / 低落 / 惊喜 / 平静 |
| 时长公式 | 台词=字数÷8+1s(争吵÷10,深情÷5);VO=字数÷7+1s;单镜≤12s |
| 付费点 | 按总集数 N:10% / 30% / 50% / 70% / 90% 处设卡点 |
| 分镜铁律 | 每镜写清 起点 → 唯一动作 → 终点(参考 zenstory-ai/drama-skills) |
🧭 推荐路线(对齐 GitHub 五文档模型)
默认:骨架(可选) → 改文 → 剧本 → 资产/场景 → 分镜审核 → 视频 → 剪映。交付物可整理为 剧本.md / 视觉设定.md / 图片提示词.md / 分镜.md / 视频提示词.md。
起点A:故事骨架(可选)
与起点B是二选一入口,不是先后步骤。长篇/系列化建议做:先搭好大三角、付费点、反转,后面才不散。短篇/单集可跳过。
+ 漫剧长度设定(可选)
你是资深短剧编剧。请根据以下内容搭建【故事骨架】。
请输出:
## 故事核(一句话)
【主角内在冲突 + 核心心理级爽点(优势/归属/秩序 三选一)】
## 隐线(人物弧)
【初始状态 → 关键变故 → 性格转变 → 最终状态】
## 人物小传(大三角核心角色 ≤4人)
每个角色:身份/特征/境遇/行动/结局
## 三幕结构 / 分集决策 / 付费卡点(10%-90%) / 股价级反转登记(约3个)
【硬性要求】主线单线型;矛盾须达3-4级;金手指新颖唯一有约束。
原著内容:
{漫剧长度设定}
{原著内容}
📐 进阶规范(来自 GitHub 研究,点击展开)
矛盾四级阶梯(爆款须达 3-4 级)
1. 基本(欲望vs阻碍太弱)→ 2. 强化(二选一困境)→ 3. 高级(两个好人因不同选择走向不同命运)→ 4. 升级(招致不可回头后果)心理级爽点(三选一)
优势/金手指 · 归属(团结家国)· 秩序(逻辑还原真相)股价级反转三式(全剧约3个)
① 预期误导 ② 人设颠覆(仅用于配角,绝不动主角底色)③ 动机置换前 10 集黄金结构
三集定生死(第1集写清性格/困境/目标/动机)→ 十集定全篇 → 卡点卡主线;开篇即绝境(极端困境/身份反差/情感暴击)类型节奏框架
甜宠:契约绑定→误会拉扯→秘密曝光(10%)→破冰→危机(30%)→撒糖→新危机(60%)→圆满战神:隐藏身份受辱(1-30%)→身份曝光打脸(31-60%)→解决危机(61-90%)→登顶
重生:前世被害→改写命运(2-30%)→信息差逆袭(31-70%)→复仇圆满
起点B:选本 / 爆款改文
与起点A是二选一入口。改成抖音爆款文案:开篇3秒炸场、爽点拉满、段段留钩。做完直接进入 ② 小说转剧本。
+ 漫剧长度设定(可选)
请将以下原文小说,严格按照抖音短视频黄金3秒推流逻辑、全网爆款网文标准,全程合规改编。
开篇3秒抛出极致冲突/绝境/反转/悬念,无铺垫;每80字1个小爽点、每200字1个大爽点;
段段留钩;无血腥/暴力/色情/低俗。单章800-1000字,短句为主。
{漫剧长度设定}
原文:
{原文小说}
+ 漫剧长度设定(可选)
帮我拆解这本小说的内容逻辑,包含四个维度:爆款开头、高潮、反转、爽点,
并总结这几本小说逻辑的共同点。然后根据以上爆款逻辑,生成一篇同类型小说1000字。
{漫剧长度设定}
原文:
{原文小说}
📐 进阶规范(来自 GitHub 研究,点击展开)
三大情绪要点(每集至少1个)
爆点(震惊事件)· 虐点(心痛事件)· 爽点(高光时刻)爽点公式 = 装 + 打脸 + 震惊 + 收获
三大密度(都不能低)
情绪密度(前3秒钩子→30-40秒小爆发→结尾10秒悬念)· 信息密度快准新无· 情节密度(因果锚定+冲突驱动+价值转变)开篇 8 规则
冲突即时性 / 信息量密集 / 信息差 / 铺垫≤3集 / 关系拉扯 / 每集必反转 / 压情绪 / 明确目标三坑必避
① 上来介绍人物铺背景 ② 一群人开会 ③ 慢悠悠写景扯前情钩子级反转三式(单集≤1个)
道具伏笔 / 情绪回弹 / 镜头错位(画面必须 100% 真实)小说转剧本
按爆款标准转成漫剧剧本:开篇即绝境、三大密度、3-15-45 节奏。
请将以下原文,按抖音3秒推流逻辑改编成漫剧剧本。
【格式】
1-1 场景名 日/内
人物:角色1 角色2
△场景环境、布景的详细描述
△人物动作、表情、语气的具体描写
角色1:台词内容
角色2:台词内容
△后续动作场景描述
OS(角色名,情绪):内心独白
---(场景之间用 --- 分隔)
【硬性要求】
- 每集500-800字须覆盖爆点/虐点/爽点至少一个
- 节奏 3-15-45:3秒情绪冲击 / 15秒剧情变化 / 45秒强期待 / 结尾反转钩子
- 单句台词≤20字,单角色单次台词≤50字
- 开篇即绝境,避三坑(介绍人物/开会/写景)
- 展示不要告诉:动作>台词,无自爆家门式台词
原文:
{原文}
📐 进阶规范(来自 GitHub 研究,点击展开)
情绪 → 面容/眼神词映射(供分镜引用)
| 情绪 | 面容词 | 眼神词 |
|---|---|---|
| 心动 | 面色微红,神情微怔 | 眼神含情,目光流连 |
| 悲伤 | 面容沉静,神情哀戚 | 眼眶微红,眼神低垂 |
| 愤怒 | 眉眼凌厉,神情冷峻 | 目光如刀,眼神强势 |
| 坚定 | 神情肃然,面容沉着 | 眼神坚定,目光清冽 |
| 惊讶 | 神情微愣,面色微变 | 眼神放大,目光骤聚 |
| 冷漠 | 面容清冷,神情漠然 | 眼神空远,目光冰凉 |
台词分幕
【辅助】把剧本/文案拆成「角色+台词+情绪」的结构化 JSON,为后面所有环节打底。
你的任务是将给定小说内容划分为角色和内容,并输出为结构化JSON结果。
台词识别规则:
1. 完整保留原文,不得遗漏/删改/省略任何字句
2. 提取带引号(“”)、破折号(——)、感叹号(!)、冒号(:)等标记的台词;
双引号内容提取后将双引号改成‘’。其余均为旁白
3. 角色在已知列表则直接使用;否则根据上下文合理判断
4. 相邻同角色台词可合并,但单条不超过50字(标点也算)
5. 超50字按语义完整性拆分,每条不超过50字,确保原文不缺失
6. 以35-50字为一个对话提取限制
7. 确保原文没有漏,不出现原文截断
8. 拆分的对话必须是同一角色说的
旁白识别规则:
1. 所有非台词的叙述性内容(心理/环境/动作/场景过渡)均标记为"旁白"
2. 保留原文所有文字,不得遗漏/删改
3. 相邻旁白可合并,单条不超过50字
4. 超50字按语义拆分,不超过50字
5. 同一角色说的
6. 确保原文没有漏、不截断
情绪与强度:
1. 根据上下文语境、语气及场景变化识别情绪与强度
2. 必须严格从 possible_emotions 与 possible_strengths 中选择
3. "旁白"统一为:情绪"平静",强度"中等"
4. 情绪识别不得改写原文,仅用于标注
输出格式:严格 json 数组,每条含 role_name / text_content / emotion_name / strength_name
输入:
可能包含的角色列表:<possible_characters>【角色1, 角色2, 旁白, ...】</possible_characters>
可能包含的情绪列表:<possible_emotions>高兴, 生气, 伤心, 害怕, 厌恶, 低落, 惊喜, 平静</possible_emotions>
可能包含的情绪强弱列表:<possible_strengths>微弱, 稍弱, 中等, 较强, 强烈</possible_strengths>
小说内容:
{原文小说}
📐 进阶规范(来自 GitHub 研究,点击展开)
黄金单集公式
本集 = 情节承接 + 冲突升级 + 价值转变 + 下集勾连改编 8 大要点
强画面感 / 台词精简 / 节奏极致快 / 只沿主线 / 降低理解成本 / 情绪大于一切 / 开篇给足期待 / 展示不要告诉删减优先级
优先删:拖沓铺垫 / 低密度重复 / 载体不支持 / 弱支线优先留:核心情绪点 / 关系拉扯 / 付费点前铺垫链 / 身份反差 / 高光打脸
情绪表达四通道
行动 / 语言 / 环境 / 独白(OS 主角视角 · VO 第三方视角)信息差三配置
观众知角色不知(急死)· 角色知观众不知(反转武器)· 都知道部分(长剧)人物 & 道具提示词
为每个角色生成四种风格提示词 + 道具。这一步产出「角色信息库」,⑥ 分镜要用。
你是一位顶级的3D/写实角色概念设计师,专精于为即梦等AI绘画平台生成
电影级、高质感、极繁美学的3D人物与道具。严格遵守平台敏感词规则。
【任务】当用户提供小说后:
第一步:提取所有人物角色(姓名、性别、大致年龄、外貌特征【须具体到脸型/眼型/眉形/鼻型/唇形】、穿着风格、气质性格、标志物品)
第二步:提取高频道具(武器/法器/首饰/书信等)
第三步:为每个角色生成四种风格版本提示词
第四步:为每个高频道具生成一套道具提示词(1:1,正面居中,纯白背景)
【风格自适应】根据题材自动选择:修仙/武侠/宫廷→国风;现代都市→现代;
科幻→科幻;西幻→西幻;民国→民国;悬疑→现代+暗黑;混合→融合。
禁止默认国风。
【四种风格】
- 3D渲染风格:正面全身站立,UE5/次世代PBR/光线追踪/8K,纯白背景
- 真人实拍风格:全身站立,超高清摄影/8K/电影级柔光
- GPT A版风格:半身特写(截到腰部),国漫3D顶级渲染,可用增强描述
- GPT B版风格:全景站立,短词骨架80-120字,纯唯美,瞳色自由
【颜色规则】人类角色眼睛仅自然色系;非人/神明可用异色瞳(须有设定依据)。
【安全】禁用敏感词(深V/低胸/裸露/超模身材等);服装至少4种高级材质混搭;
立体剪裁,禁"宽腰封""勒紧";神态统一中性平和。
小说内容:
{剧本}
输出格式:每个角色或道具单独一段,用 "## ■ 名称" 作为该段标题,下一行写内容。
示例:
## ■ 男主
男,30岁,身材高挑,浓眉,沉稳。[分别列出四种风格提示词]
## ■ 帅印
道具:帅印,方形,金质。[列出道具提示词]
请严格按此格式逐个输出全部角色与道具。
请为以下角色建立角色设定卡:
角色信息:{角色描述}
【角色设定卡 - 固定不变区】
角色名:
性别/年龄段:
身高体型:
气质关键词(3个):
发型(长度+类型+颜色):
五官特征(最多3个):
皮肤色调:
标志物(必须有1个):
主穿搭:
主色系:
禁止出现项:
【固定角色描述 - 每次必带】
(英文,每个镜头的Prompt中一字不差地复制粘贴)
例:A 25-year-old Asian male, short messy black hair, black-framed glasses...
【画风设定 - 固定不变区】
整体画风:
光线风格:
色彩倾向:
【固定画风后缀 - 每次必追加】
例:realistic manga style, cinematic lighting, dramatic composition, 8k
【AI提示词模板】
【固定角色描述】 + [表情/动作/场景] + 【固定画风后缀】
📐 进阶规范(来自 GitHub 研究,点击展开)
L0-L6 服化妆造分层(一致性核心)
L0 底模 · L1 妆容 · L2 发型+发饰 · L3 中衣 · L4 外衣 · L5 配饰 · L6 鞋履六铁律:面容不变 / 姿态不变 / 逐层可控 / 风格统一 / 质感不降 / 纯服化范畴
资产体系
类型:role(角色)/ scene(场景)/ prop(道具)父子资产:主资产 + 衍生资产(破损/染血/夜景/激活态);衍生状态匹配时必须用衍生版
按画风锁「灵魂锚点」
写实/赛璐璐/国风 → 面容;复古日系 → 线条;扁平 → 轮廓;黏土 → 肌理道具铁律
纯静物陈列,禁人物/手部/肢体,不得处于被持有/佩戴状态人物表情矩阵
5×2 十宫格表情板,同一张脸只变表情,用于配音口型参考。
采用极简UI设计风格与影视角色设定卡排版。
整体采用严格的两行五列网格布局(5×2 grid),共10个等分卡片,
每个卡片边界清晰但极简,无厚重边框,仅通过留白区分。
每个卡片内部为同一位人物的面部特写,不露出颈部以下,
保留所有真实面部细节,统一镜头距离与构图比例,
仅变化面部表情(喜怒哀乐愁等各种情绪),保持角色外貌完全一致。
人物居中构图,影棚柔光照明,皮肤质感真实但干净,无夸张阴影。
每个卡片底部居中放置编号标签01至10,标签后写一行小字:"01-微笑/02-愤怒/03-悲伤"。
整体风格参考角色设定表、影视分镜表情板与产品设计UI卡片。
【画幅】最终输出 16:9,由多个正方形表情卡片拼合而成(每格自身正方形)。
角色一致性说明(与参考图一并使用):
{人物参考说明}
按「情绪 → 视觉翻译」公式,为以下角色与情绪生成夸张表情提示词。
【核心铁律】模型不认情绪,只认像素。禁写「他很生气」,必须拆成五官/毛发/符号的具体形态。
【三层拆解】
① 五官层:
眼:瞳孔缩成针尖 / 放大占满眼眶 / 变螺旋蚊香 / 死鱼横线 / 金币符号
眉:倒刺 V 形 / 飞起 / 紧皱川字 / 一高一低
嘴:O 型张大 / 咧到耳根 / 嘴角下垂 / 咬牙 / 喷水喷火
脸颊:涨红 / 发白 / 汗珠挂脸 / 泪流成河
面部:青筋暴起 / 扭曲变形 / 五官被拉扯位移
② 肢体毛发层:炸毛、汗珠、速度线、发丝飞扬
③ 漫画符号特效层:大感叹号(!!)、震动线、速度线、螺旋眼、头顶星星、小鸟绕圈、火焰浓烟、青筋井字、瀑布泪、乌云、星星眼、爱心眼、死鱼眼、黑线乌鸦、灵魂出窍、金币雨、Zzz、雷达耳、咸鱼、鼻尖高光
【情绪分级(按强度递进)】
· 轻情绪(日常/小反转):平静面瘫 / 螺旋眼眩晕 / 震惊飞眼
· 强情绪(搞笑爽剧):炸毛惊恐 / 瀑布泪委屈 / 金币眼贪财
· 极致情绪(名场面):喷火愤怒 / 融化大哭 / 灵魂出窍无语
【夸张度三档调节】轻「略微/微微」修饰五官 | 中「夸张/明显」加大幅度 | 重「极度/完全」突破人体结构 + 漫画符号
【输出结构】
① 固定角色基底(逐字复制、一字不改,防崩脸)
② 分项五官变化(眼 → 眉 → 嘴 → 脸颊 逐项写)
③ 漫画符号特效(按情绪选对符号)
④ 固定风格后缀:特写镜头,8K 细腻皮肤质感,国风插画风格,夸张漫画表现
⑤ 负面提示词:面部变形扭曲(非刻意夸张时)、多余手指、五官错位、模糊、低分辨率、画风不一致、现代物品、文字水印
角色基底 + 情绪:
{角色与情绪}
人物三视图
生成角色设定板。顺序:面部 → 全身像(以面部为参考)→ 三视图。
一张高精度、干净极简的角色设定板/人物三视图参考页,纯白背景,
整体像游戏角色建模设定图,角色turnaround board,排版整齐清晰,
写实高级质感,统一光线、统一人物一致性。
画面左侧为人物全身三视图:正面全身站姿 / 左侧面全身站姿 / 背面全身站姿
(三人必须同一角色,五官发型服装体型完全一致,平视,中性棚拍光,无遮挡)
画面右上区域:6张人物头像/头部视角图(正面/俯视头顶/后脑勺/左侧轮廓/正侧脸/3-4侧脸)
画面右下区域:6张人物局部细节图(上衣面料/下身正面/臀部剪裁/腿部皮肤/眼部/鞋子)
整体风格:极简、专业、写实、统一、干净、高级。
人物设定:
{人物形象描述}
输出要求:横版构图,白底,完整人物,不裁切;不出现多余道具/文字/LOGO/水印/UI元素。
以角色基础形象图为底图,img2img叠加服化妆造,
二次元{性别}角色四视图设定图,赛璐璐上色,强对比度,极致细节,8K,超保真
character design sheet,character turnaround,
保持基础形象面容不变,{整体气质},
【L1·妆容】{妆容};{妆容风格},肌肤柔光,{眉妆},{眼妆},{唇妆},
【L2·发型】{发型},发丝层次分明,{发饰},
【L3+L4·服饰】{主色}{款式},{材质},{装饰工艺},
【L5·配饰】{头饰},{耳饰},{手表},{包袋},
【L6·鞋履】{鞋型},{鞋面材质},{鞋跟},与服装风格一致,
同一画面左至右并排:人像特写+正视图+侧视图+后视图,
自然站立,纯净中性灰背景,均匀柔光,无硬阴影,
四视图一致性,面容细腻渲染,发丝细腻渲染,纹理细节超清晰
图中不要有任何文字
📐 进阶规范(来自 GitHub 研究,点击展开)
四视图规范(比三视图多「人像特写」位)
人像特写 → 正视图 → 侧视图 → 后视图背景纯净中性灰 #E8E8E8 · 自然站立禁姿态变化 · 仅面部微表情 · 画面比例 4:1 或 3:1
衍生资产(换装/状态)
同一角色多套造型共享身份,建议用图生图(以底模为参考)保证一致性妆容决策:底模素颜,但衍生默认进入妆造;按面部线索决定「基础妆/轻妆/正式妆」
场景提示词
生成无人纯场景的电影级场景提示词(双格式输出)。
你将扮演专业场景设定师。根据用户提供的小说段落或场景描述,
优先提取具有广阔空间感、大场面、史诗气质的环境,
为每个地点生成唯美、情绪饱满、诗意光影的电影级场景设定及AI绘画Prompt。
【万能公式】
第一步:定调光影氛围(写光的质感与情绪)
第二步:描绘核心主体与背景(精准名词组合构建空间)
第三步:强调材质与光影互动(光如何"触碰"物体表面)
第四步:锁死渲染与画质后缀(写实场景/UE5/极致细节/8k)
【全局约束】
- 绝对真空匿名:严禁出现人影/人名/衣物/身体部位等暗示人物存在的元素
- 场景命名四字以上带修饰词
- 固定开头:"不能出现其他人,无人纯场景,"
- 四大要素:环境类型/具体时间/空间氛围/视觉主要特征
- 必选视角:宏大的鸟瞰全景 / 低角度仰视 / 平视深远构图(禁用微距特写)
- 唯美高级感:情绪词 + 诗意光影对抗 + 情绪化时间天气 + 动态氛围细节 + 情绪色彩
【输出两套格式(缺一不可)】
格式一:场景提取清单 → 专业场景设定表 → 可复制 Prompt
格式二:GPT版场景指令词(主图 + 4张副图,每张带四字以上括号名称)
风格要求:【默认为东方古典仙侠;可选硬派写实东方幻想/现代都市写实/日常校园清新】
小说内容:
{剧本或场景}
📐 进阶规范(来自 GitHub 研究,点击展开)
场景五原则
空间叙事(场景承载情绪)· 层次纵深(必须前中后景)· 质感至上 · 风格为锚 · 戏剧化低调光影季节色调映射
春 青绿+淡粉 · 夏 碧绿+蔚蓝 · 秋 橙黄+棕红 · 冬 素白+冷蓝场景变体(建筑布局材质不变)
景别:大全景→全景→中景→近景→特写时段:清晨(冷白薄雾)/正午(明亮短影)/黄昏(金色长影)/夜间月光(冷蓝)/夜间灯火(暖黄)
天候:晴/阴(柔光无硬影)/薄雾/细雨/飞雪
导演规划(可选)
把剧本转成「拍摄计划」,为下一步分镜提供节奏依据。短篇可跳过。
你是导演,把剧本转为拍摄计划。只拆分、不创作(唯一例外:场间过渡);不规划光影/色调/配乐。
## 分镜执导要诀(分场与逐场时遵循)
- 判断每场快慢:偏剧情推进(外部冲突/信息)→快而利落;偏情绪关系(内部冲突/心理)→给足镜头停留与停顿
- 拆镜按「变化点」不按句子:关注点转移(交流→试探→施压→失控→沉默)处才拆,不按原文句数
- 人物首出场要立住:先局部后完整/先环境反应后出人/带动作出场,给记忆抓手;重要角色不用普通正面中景一笔带过
- 情绪只写过程不写结论:写手指收紧/话卡住/视线移开等动作与停顿,不写「他很紧张」这类标签
- 环境参与叙事、善用留白;同一信息不重复表达
## 分场汇总表
| 场次 | 场景名 | 台词条数 | 台词字数 | 情绪浓度(0-10) | 情绪基调(含X→Y) |
|---|---|---|---|---|---|
## 逐场注意事项(情感砸点/一致性锚点/空间距离/环境音/易错提示)
## 场间过渡(仅列确需增补的;不必要则硬切)
剧本:
{剧本}
📐 进阶规范(来自 GitHub 研究,点击展开)
导演规划做什么
把剧本转为拍摄计划:分场汇总表 + 逐场注意事项 + 场间过渡。核心原则:只拆分、不创作(唯一例外:场间过渡);不规划光影/色调/配乐。
分场原则
一个场 = 同一时空下一段连续戏;以地点变更/时间跳变/戏剧单元收束为切点;场次须全覆盖剧本。台词统计口径
逐场统计台词条数 + 字数(只计数,不预算时长);无台词场记 0/0。情绪分析
逐场给情绪浓度 0-10 + 一句话基调;有推进标 X→Y(如"试探→破防")。场间过渡(唯一允许创作的环节)
先判断是否必要;必要时用 动作衔接 / 空镜 / 淡入淡出。逐场注意事项(留给下游分镜)
情感砸点 / 视觉一致性锚点 / 空间距离 / 环境音提示 / 易错提示分镜头提示词
按时间轴拆分镜,含六维一致性 + 角色映射 + 衔接前置指令。
根据旁白和对话拆分分镜头。内容以35-50个字以内拆分,单句要完整。
【六维一致性准则】人物一致/时空一致/物品一致/动作连贯/台词合规/敏感过滤
【分镜生成四步法】场景锚定→连续性检查→台词植入→敏感扫描
【时间轴(10秒)】[0-3]核心动作 [3-6]互动反应 [6-8]情绪特写 [8-10]下一镜铺垫
【七律(必守)】①动作连续 ②景别递进 ③视轴守恒(180°) ④朝向逻辑 ⑤信息控制(不提供新信息不切镜) ⑥节拍密度 ⑦头尾安全区
【帧描述五要素(用全角分号分隔)】
①景别/视角+取景范围;②角色位置姿态;③主光完整叙述句;④环境道具细节;⑤情绪解剖词——背景锚定词
- ①取景范围用「不可见」标注框外,防模型推近
- ③主光必须完整叙述句(禁只写「橙红侧光」短词)
- ⑤背景锚定词从场景描述摘原文,同场景连续镜完全一致
- 首/尾帧禁用动词:走向/转身/迈步/抬手/张嘴/挥手/冲/跑/跳
【分镜实战要诀】(让分镜「有戏」而不只是完整)
- 不拍台词拍变化:镜头跟着关注点转移走(交流→试探→施压→失控→沉默),多拍听者反应与停顿,不只拍发言者
- 先抓重音:整场先定 1-2 个最该放大的点(关键台词/态度转折/情绪裂口/线索出现),有轻有重,禁平均铺陈
- 拍情绪过程不拍结论:不写「她很紧张」,写正在发生——手指收紧/话卡住/视线移开/想举又放下/呼吸不稳语气在撑
- 心理转译成画面:心理状态→外在表现→镜头表达,用表情细节/身体动作/环境反应/镜头节奏四层转译
- 善用留白:情绪转折、关系微妙处、重大事件前后故意不拍满,给观众推断空间;剧情镜头要清、信息镜头要准、情绪镜头可留
- 环境参与叙事:环境不是背景,用空房/没碰的水杯/开着的门/吹动的窗帘承接情绪、埋线索、调节奏;可拆成建立/氛围/细节/收束镜头
- 信息分层:分主信息/辅信息/氛围信息;主镜头承载核心戏,补充镜头少量增层次,一镜一主一辅
- 重复克制:同一信息不用两镜重复表达,能一镜说清不拆三镜
【关键要求】
- 全中文输出,禁用英文引号,一律用中文引号
- 图片提示词不映射人物;视频提示词必须有角色标签映射(只写实际出现的角色)
- 视频提示词必须含"衔接前置指令"段落
- 景别多用近景/特写/大特写,不用远景,少用中景(仅限台词/情绪镜;环境建立、换场首镜、动作尺度升级仍用全景/大全景)
- 台词时段镜头固定,不切换、不推拉
- cameraDirection 格式:起幅[景别]→运动方式+速度→落幅[景别],目的:[揭示/跟随/强调]
- video_prompt ≤ 500字符;每项文案生成1个分镜,总数=文案条目数
【输出格式】
有拆分子文案:分镜头N / 原文案 / 子文案 / 分镜头N-1 [时间轴] 场景:...
无拆分:原文案 / 分镜头N [时间轴] 场景:...
风格:动漫风格
角色信息(③产出的角色档案,姓名+固定外貌描述):
{角色信息}
章节文案(粘贴要拆分的内容):
{章节文案}
根据旁白和对话拆分分镜头。内容以35-50个字以内拆分,单句要完整。
【六维一致性准则】人物一致/时空一致/物品一致/动作连贯/台词合规/敏感过滤
【分镜生成四步法】场景锚定→连续性检查→台词植入→敏感扫描
【时间轴(15秒)】[0-4]核心动作 [4-8]互动反应 [8-12]情绪特写 [12-15]下一镜铺垫
【分镜实战要诀】(让分镜「有戏」而不只是完整)
- 不拍台词拍变化:镜头跟着关注点转移走(交流→试探→施压→失控→沉默),多拍听者反应与停顿,不只拍发言者
- 先抓重音:整场先定 1-2 个最该放大的点(关键台词/态度转折/情绪裂口/线索出现),有轻有重,禁平均铺陈
- 拍情绪过程不拍结论:不写「她很紧张」,写正在发生——手指收紧/话卡住/视线移开/想举又放下/呼吸不稳语气在撑
- 心理转译成画面:心理状态→外在表现→镜头表达,用表情细节/身体动作/环境反应/镜头节奏四层转译
- 善用留白:情绪转折、关系微妙处、重大事件前后故意不拍满,给观众推断空间;剧情镜头要清、信息镜头要准、情绪镜头可留
- 环境参与叙事:环境不是背景,用空房/没碰的水杯/开着的门/吹动的窗帘承接情绪、埋线索、调节奏;可拆成建立/氛围/细节/收束镜头
- 信息分层:分主信息/辅信息/氛围信息;主镜头承载核心戏,补充镜头少量增层次,一镜一主一辅
- 重复克制:同一信息不用两镜重复表达,能一镜说清不拆三镜
【关键要求】
- 全中文输出,禁用英文引号,一律用中文引号
- 图片提示词不映射人物;视频提示词必须有角色标签映射
- 视频提示词必须含"衔接前置指令"段落
- 景别多用近景/特写,不用远景,少用中景
- 台词时段镜头固定,不切换、不推拉
【风格】3D动漫风格
【追加】不要背景音乐;在提示词前面加上指定句,加画外音并标注出处。
角色信息(③产出的角色档案):
{角色信息}
章节文案:
{章节文案}
请对照以下红线审核这份分镜表,输出问题清单:
【四条绝对红线(违反任一=严重问题)】
R1 资产引用合法:引用的角色/场景/道具必须存在且正确关联
R2 剧本忠实:所有台词与剧本一字不差;不遗漏场次;不新增情节
R3 具象可感:禁"开心/悲伤/烘托气氛"等抽象词;声音具体到声源
R4 父子资产选择:衍生状态(破损/染血/夜景/激活态)必须用衍生版本
【高频严重项】
- 禁光影色调:任何字段不出现 光/影/逆光/侧光/色温/明暗/色调/暖冷
- 音效禁配乐:仅环境音+动作音,禁 BGM/配乐/音乐
- 人物外观不进提示词:画面描述不写服装/发型/长相
- 片段时长:每片段≤15s;含台词镜≥字数÷4+1s;无台词镜≤6s
- 长台词拆镜:单镜台词/VO>20字须拆,按语义停顿切
- 景别视角错开:无连续3镜以上同景别
【有戏自检(不达标=警示项,非红线)】
- 是否「谁说话就拍谁」机械切换、缺听者反应与停顿?
- 整场是否每镜一样重、找不到 1-2 个重音(关键台词/态度转折/情绪裂口/线索出现)?
- 情绪是否只有结论(难过/开心)而无过程(手指收紧/话卡住/视线移开)?
- 心理活动是否直接贴标签、未转译成动作/环境/节奏?
- 该留白处是否还在拼命解释?
- 环境是否纯背景、未参与叙事(没碰的水杯/开着的门/吹动的窗帘)?
- 同一信息是否被多镜重复表达?
【输出】按 严重程度 | 审核项 | 问题 | 建议方案 的表格列出,最后评分 A/B/C/D。
分镜表:
{分镜表}
按 AI ACTION SCALE V6.0(电影级动作分镜)为以下动作需求设计分镜。
【核心公式】意图→动作→交互→结果→反馈→下一动作(后一动作必须由前一动作的结果推动)
【三条第一原则】
1 动作第一+因果第一:禁 A打→B躲→A硬切下一招
2 分镜第一:任何超过3秒的复杂动作必须先拆 Shot
3 受力必须可见:每次命中/格挡/跌落都要有身体或环境反馈
【一个 Shot 原则】一个主要动作 + 一个主要结果 + 一个主要摄影任务
【六步因果检查】意图 / 动作 / 交互 / 结果 / 反馈 / 下一动作
【默认15秒节奏骨架】
0.0-1.0 冲突已发生 | 1.0-3.0 第一轮攻防 | 3.0-5.5 动作链
5.5-7.5 战术变化 | 7.5-10.5 升级 | 10.5-12.5 关键反击
12.5-14.2 高潮 | 14.2-15.0 确认+CUT
【强制】中段至少一次战术变化(高级战斗优先:优势→破解→反制→再反制);15s以上至少一次优势逆转;高潮只发生一次,结果确认后立即 CUT。
【参考运镜库 CAM01-CAM20】缓慢推进 / 平行跟拍 / 低机位追拍 / 手持晃动 / 快速甩镜 / 环绕 / 终结拉远 …
【输出三层】
① 一句话理解
② 完整时间轴 Shot 分镜(景别/机位/焦距/光圈/物距/运镜/动作/结果/剪辑)
③ 一整段可复制的最终 Prompt(+ AI 生成约束)
动作需求:
{动作需求}
按「五变量运镜系统」为以下场景设计电影级运镜。
【五变量】光圈T值(景深/注意力) × 焦距mm(视野/压缩) × 物距m(真实透视) × 对焦(观众看哪) × 摄影机空间运动(空间关系)
【真运镜 vs 假变焦(最关键)】
- 推进 + 焦距固定 = 真 Dolly In(主体变大,透视真实变化)
- 不动 + 焦距增加 = Zoom In(主体变大,透视基本不变)
- 推进 + 焦距同步增加 = Dolly Zoom(希区柯克变焦)
→ 提示词必须写明「摄影机真实移动」,防止模型当成数字放大
【情绪→参数速查】
高级人物 50-85mm/T1.4-2.8 慢推锁焦 | 史诗宏大 24-35mm/T5.6-11 低机位大景深
压迫恐惧 85-135mm/T2-4 缓靠或 Dolly Zoom | 梦幻爱情 65-85mm/T1.4-2 | 现实主义 35-50mm/T2.8-5.6
【时间轴式运镜设计】
0-25% 建立空间 → 25-60% 引入变化 → 60-85% 加大变化产生转折 → 85-100% 完成视觉落点
【输出字段】运镜核心 / 摄影机运动 / 焦距变化 / 光圈变化 / 物距变化 / 对焦变化 / 空间变化 / 节奏 / 最终Prompt / 负面约束
运镜需求:
{运镜需求}
📐 进阶规范(来自 GitHub 研究,点击展开)
七律视觉连续性(核心铁律)
① 动作连续 ② 景别递进 ③ 视轴守恒(180°铁律) ④ 朝向逻辑 ⑤ 信息控制(不提供新信息不切镜)⑥ 节拍密度(2-3s≥1拍/4-6s≥2拍/7-9s≥3拍/10s+≥4拍)⑦ 头尾安全区帧描述五要素(用全角分号「;」分隔)
①景别/视角+取景范围;②角色位置姿态;③主光完整叙述句;④环境道具细节;⑤情绪解剖词——背景锚定词· ①取景范围用「不可见」标注框外(防模型推近)
· ③主光必须完整叙述句(禁只写「橙红侧光」短词)
· ⑤背景锚定词从场景描述摘原文,同场景连续镜完全一致
· 首尾帧禁用动词:走向/转身/迈步/抬手/张嘴/挥手/冲/跑/跳
motionScript 时间轴格式
Xs-Ys: [动作描述,运镜] [角色B:动作链] · 顺序即叙事顺序 · 开头结尾加 | 朝向:角色名+方位词
cameraDirection 格式
起幅[景别] → 运动方式+速度 → 落幅[景别],目的:[揭示/跟随/强调什么]
承接上镜段(同场景非首组才写)
承接上镜:上镜定格于【角色】立于【位置】面朝【方位】,刚【动作收尾终态】——本镜由此延续
时长预算
目标总时长×0.9 为硬下限;典型 ≥ 目标÷9(平均每镜9s);时长地板:对话/情绪≥10s · 环境≥9s · 动作≥8s;单镜≤12s
特殊镜头
换场首镜必须全景/大全景(禁特写开场)· 情绪顶点后接 1 个「呼吸镜头」(≥中景)动作合规替换
「刀刺入身体」→「刀刃弧线向前→人物重心后倒」;「鲜血飞溅」→「画面切到远景剪影」视频生成
用即梦/可灵出视频。只有单帧/首尾帧两种方法,首尾帧必写过渡效果。
【单帧模式】只上传 1 张首帧图,用以下提示词驱动它动起来。
镜头:{景别}+{运镜}+{核心动作}
时间轴:
0-{X}秒:{动作描述,运镜}
{X}-{Y}秒:{动作描述,运镜}
结尾:{收尾动作/表情}
{全局一致设定}
【要求】
- 主角保持身份一致,不换脸
- 动作通顺连贯,无跳变
- 背景与首帧完全一致,不增删元素
- 输出时长:{时长}秒
- 禁止出现文字/字幕/水印
【参考图】上传:人物图 + 场景图 + 道具图(如有)
【首尾帧模式】上传 2 张图(首帧 + 尾帧),用以下提示词驱动中间过渡。
首帧:{首帧描述}
尾帧:{尾帧描述}
过渡效果:{过渡描述}
{全局一致设定}
【要求】
- 从首帧自然过渡到尾帧,中间不得跳变
- 主角身份/服装/场景保持一致
- 运动方向:{运镜}
- 输出时长:{时长}秒
- 禁止文字/字幕/水印
【参考图】上传:首帧图 + 尾帧图 + 人物图 + 场景图
【视频口型】上传角色图,让角色说出指定台词。
台词:「{台词}」
说话角色:{角色名}
情绪:{情绪},语速:{语速}
【要求】
- 嘴型与台词逐字同步,不说多、不说少
- 面部自然,不做夸张表情
- 镜头稳定,不推拉
- 输出时长按台词长度:{时长}秒
【视频生成 5 条铁律】 1. 只有「单帧」和「首尾帧」两种方法;不用多帧、不用中间帧 2. 首尾帧必须写过渡效果(例:<人物变身>出现一道金光伴随烟雾过渡到尾帧) 3. 视频口型(即梦/可灵):说"XXXXXX" 4. 加入参考:人物图 + 场景图 + 道具图 + 声音参考 5. 机器人爆炸镜头 → 用好的机器人【输入爆炸提示词】直接生成爆炸效果, 而不是先生成一张爆炸效果图再生成视频
按方言配音控制词典,为以下台词生成配音控制要求。
【总控红线】
- 以当地年轻人真实日常口语为基准,优先保证地域听感与清晰度
- 禁止普通话播音腔/新闻腔/广告腔/舞台腔,禁止刻意学方言腔
- 禁止混相邻地区口音(西安≠兰州、成都≠重庆、广州≠港台)
- 方言强度默认「明显能听出地域、但不影响理解」;用户指定「纯方言」再提高
- 年轻人物用现代城市年轻人口吻;台词与人物口型严格同步
- 禁止机械感、字字分离、过度标准化、情绪断层
【执行结构】地区 → 方言 → 核心发音 → 声调 → 节奏 → 语气 → 口语特征 → 执行要求
【参考词典】50 套见 02_素材整理/2026-09-21新增/04_全国50套方言AI配音控制词典.txt
【输出】该地区方言的:核心发音 / 声调 / 节奏 / 语气 / 口语特征 / 执行要求
方言需求(地区/人物年龄/方言强度/台词):
{配音需求}
📐 进阶规范(来自 GitHub 研究,点击展开)
videoDesc 12 字段
画面描述、场景、关联资产名称、时长、景别、运镜、角色动作、情绪、光影氛围、台词、音效、关联资产ID@图N 标注
提示词正文用@图1 @图2 替代角色/场景名称,绑定参考图
画风标签库(可复制,首尾帧模式末尾加 , shallow depth of field)
2D都市言情:mature urban romance anime, cel-shaded, cinematic lighting, cool tones, clean line art2D复古日系:
90s Japanese anime, hand-drawn cel animation, soft warm tones, nostalgic aesthetic2D扁平:
2D flat design, geometric shapes, solid color blocks, minimal shadows3D黏土:
stop-motion claymation, clay texture, finger imprints, soft bokeh真人现代都市:
live-action urban cinema, real human actors photography, film grain texture, non-CGI non-rendered3D国风传统:
Chinese traditional 3D render, PBR materials, volumetric lighting, oriental aesthetic剪映合成
剪映里合成。尾帧静止的解法:补一张尾帧图的单帧视频再衔接。
【尾帧衔接】首尾帧视频播到尾帧会静止。想让尾帧继续动,单独为尾帧再生成一个单帧视频。
上传:尾帧图片
镜头:{景别}+{运镜}+{动作}
0-{X}秒:{动作描述}
结尾:{收尾}
【要求】
- 从尾帧的定格状态开始,自然延续动作
- 主角/场景与尾帧完全一致
- 时长 {时长} 秒;禁止文字/水印
【剪辑 checklist】 1. 首尾帧生成的视频到尾帧会静止。想让尾帧动 → 再生成一个尾帧图片的单帧视频, 然后剪辑里衔接 例:三体中镜头绕老兵旋转一周 → 接瞄准镜单帧视频里的机器人走动 2. 丰富的音效和音乐之间的衔接过渡 3. 镜头衔接顺滑、配音/字幕/BGM 对齐、节奏卡点