# Toffee Family Storyboard

> Toffee Family 分镜头脚本双Agent闭环检验系统。用于 Toffee Family 儿童剧及同类低龄内容的剧本拆分、4–15秒视频生产段设计、对白逐字零删减与慢中快语速核验、场面调度、表演节拍、段内多镜切换、每段4–6格故事板、逐段AI视频提示词、黑白低完成度动画粗草绘制及量化质检，直至评分通过或强制终止。

- Skill: `punyko8/toffee-family-storyboard` (Agent Skill, multi-file: 11 files)
- Install (CLI): `npx skillmds@latest add punyko8/toffee-family-storyboard`
- Raw SKILL.md: https://api.skillmd.com/api/skills/punyko8/toffee-family-storyboard/raw
- Safety review: pending (external: skill-scanner PASS, skillspector PASS)
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: AI & ML
- Author: Punyko8 (https://skillmd.com/u/punyko8)
- Updated: 2026-09-22
- Page: https://skillmd.com/skills/punyko8/toffee-family-storyboard

---


# Toffee Family 分镜头脚本 Skill

> **核心定义**：不是"把文字变成画"，而是基于人类大脑的生理与心理感知硬规律，将脚本的线性叙事意图，转化为一条完全可控的一维观众注意力流与情绪流。

> **一句话快速上手**：先定目标再选镜，跟着大脑走规律。一个镜头一个叙事目标，不等于一个微动作。连续同机位先合并，声音比画更重要，反应永远胜动作。

> **对白硬门禁**：镜头可以合并，对白不可以删减。原剧本中所有对白、旁白、歌唱、群体喊话必须逐字保留；不得缩写、概括、同义改写或用画面替代。

> **对白语速门禁**：普通对白必须填写慢／中／快三档：慢 2.0–2.33、中大于 2.33–2.8、快大于 2.8–3.3 个可发音字/秒。低于 2.0 必须说明停顿原因，高于 3.3 直接打回；对白发声时长与镜头总时长分开计算。

> **生产段硬门禁**：“段”就是一次视频生成任务。每段镜头时长之和必须为 4–15 秒，段号和镜号均按整集连续；所有声音不跨段。分镜表逐行填写“段、段类型”，每段映射 4–6 个静态故事板格，AI 视频提示词按段输出。

> **视觉分镜硬门禁**：具备图像生成能力时，逐镜分镜图是必交物，不得只交分镜表或提示词。绘制前必须读取 [`references/storyboard-visual-style.md`](references/storyboard-visual-style.md)，并把 `assets/storyboard-style/` 中四张图片作为风格参考；只借用线条、表演和构图简化方式，不复制参考图中的角色、场景、构图或配色。角色锚点与逐镜分镜图必须严格使用黑、白和中性灰，并保持明显低完成度动画粗草：少线、断线、重复试探线、概括造型、极简背景；不得出现任何彩色色相、精细材质、完整明暗塑造或成稿级轮廓。

> **导演生产硬门禁**：拆镜前完整读取 [`references/directing-production.md`](references/directing-production.md)，先锁定交付模式并建立场景空间表；对白镜头必须填写表演节拍，输出页面必须建立页面—段号—宫格—镜号—镜内节拍—对白 ID 映射。

> **GitHub 同步硬门禁**：用户确认本 Skill 的任何调整后，先完成本地校验，再把完整 Skill 包机械同步到 `Punyko8/codex-skills` 的 `skills/toffee-family-storyboard/`；只提交 Toffee Family 相关文件和必要分类索引，不覆盖旧版或通用分镜 Skill。未成功推送并报告分支与 commit SHA 前，不得把 Skill 调整标记为完成；仅在认证、权限或网络确实阻塞时报告阻塞。

---

## 一、底层逻辑（第一性原理基石）

### 两个本质的范式转换

| 事物 | 本质 | 核心缺陷 |
|------|------|----------|
| 文学脚本 | 用文字编码的抽象叙事意图 | 依赖读者脑补，观众可自由分配注意力 |
| 分镜头 | 用视觉语言解码的可执行感知指令 | 剥夺观众注意力选择权，强制按导演设计的路径接收信息 |

### 绝对决策优先级（下层服从上层，不可颠倒）

**单一核心叙事目标 > 人类大脑感知硬规律 > 情景戏剧功能与整体节奏 > 人物视角与潜台词 > 制作条件与媒介特性**

---

## 二、双Agent角色与职责边界

### 对白零删减协议（最高优先级）

1. 以用户指定的原始剧本为唯一对白源，按出现顺序建立对白编号清单。
2. 将每句对白原文完整复制到分镜声音栏；保留说话者、语序和句内措辞。镜头合并时，把多句对白按原顺序放入同一声音栏，不得压缩文本。
3. “做减法”只允许删冗余镜头、重复调度和非剧本附加信息，不适用于剧本对白、旁白、歌唱、群体喊话及剧本明确要求的反应。
4. 对白与目标时长冲突时，按以下顺序处理：延长镜头 → 在 4–15 秒内重分段 → 增加生产段或延长成片。只有用户明确把总时长设为不可变硬上限时，才报告冲突并请用户决定；禁止擅自删对白或用超快语速硬塞。
5. 提交前执行逐句机械对账，输出“原剧本对白 → 分镜镜号”映射。覆盖率必须为 100%，且改写数、删句数、错序数均为 0；任一项不为 0，直接打回，不得进入评分通过状态。
6. 普通对白按可发音字数和实际发声时长计算语速，必填慢／中／快档位。使用 `scripts/dialogue_timing_check.py` 机械核验；档位不匹配、无理由低于 2.0 或高于 3.3 的项目必须为 0。

### 🎬 写作者Agent（执行端）

**核心职责**：严格按照"第一性原理分镜决策法7步流程"创作分镜，输出标准化分镜表

**输出要求**：
1. 每个镜头必须标注唯一核心目标
2. 所有元素（景别/角度/运动/时长/声音）必须完整
3. 文字描述必须具体、可执行，无抽象形容词
4. 提交时附带「创作说明」，说明整体叙事逻辑和关键情绪节点
5. 具备图像生成能力时，为每个生产段绘制 4–6 个决定性静态分镜格，并保持角色、空间、屏幕方向和内置线稿风格连续
6. 提交场景空间表、含对白镜头的表演节拍表、页面映射表和逐段 AI 视频提示词
7. 按用户选择的 `shot-card`、`group-sheet` 或 `hybrid` 模式组织视觉交付

### 🧐 质检者Agent（独立端）

**核心职责**：完全独立于写作者，只负责客观评分和提出修改意见，不参与创作

**工作原则**：
1. 只基于"剧本表达意图""观众感知规律""AI生图规范与内置视觉风格"三个客观标准打分
2. 所有扣分必须给出具体原因和可执行的修改建议
3. 不接受任何"艺术感觉""个人风格"类的辩解
4. 严格执行终止条件：总分≥90分 或 修改轮次≥5轮

---

## 三、标准7步操作流程

开始七步流程前，先按 [`references/directing-production.md`](references/directing-production.md) 完成三项前置工作：

1. 锁定故事板交付模式、视觉模式和画幅。
2. 为每个场景建立主轴线、角色屏幕侧、出入口和道具初始状态。
3. 建立对白语速计算口径；数字或英文先展开为实际中文读音。

### 第1步：全局拆解，定情景核心功能

**输入**：完整文学脚本片段
**输出**：1句话情景功能 + 情绪曲线 + 3个以内关键转折点

**操作**：
- 问自己：这个情景唯一的戏剧任务是什么？（建立场景/制造悬念/推动冲突/释放情绪）
- 画出情绪起伏曲线，标记所有"情绪急转弯"的节点
- 所有转折点必须用单独镜头强化，绝对不能合并

### 第2步：选择全局叙事视角

**输出**：明确的视角策略（主观/客观/过肩/上帝）

**核心原则**：
- **悬疑/惊悚/代入感强的场景**：全程主角主观视角为主，绝对禁用"观众知道但主角不知道"的上帝视角
- **客观叙事/群戏场景**：多用平视固定镜头，保持中立
- **潜台词传递**：用过肩镜头切换视角，暗示人物关系
- **儿童剧双人对话**：默认使用儿童眼高、平视、双人中景、固定机位，让关系和动作在同一画面内清楚发生；除非视线信息或权力关系发生变化，不做正反打式过肩切换

完成视角策略后锁定场面调度：记录主轴线、角色屏幕侧、视线、出入口、关键道具位置和状态链。未建立空间关系不得进入拆镜。

### 第3步：拆生产段与镜头，定「单一核心目标」（最关键一步）

**输出**：每个镜头对应唯一的1句话核心目标

**铁律**：一个镜头只能服务一个核心叙事目标，任何与目标无关的信息全部砍掉。一个核心目标可以包含同一机位内顺序发生的多个动作节拍，不要把每个微动作误拆成独立镜头。

这里的“砍掉”仅指镜头与非剧本附加信息；不得砍掉、缩写或改写任何原剧本对白。

- ❌ 错误："展现公寓布局+表现主角疲惫"
- ✅ 正确："让观众感受到主角的极度疲惫"

**合并判定**：相邻镜头若同时满足“同一场景、同一景别、同一角度、同一视线方向、时间连续、核心目标一致”，优先合并为一个连续镜头，并在画面栏按先后顺序调度动作。任一条件变化，或出现新的信息揭示/情绪转折/关键道具，才保留切镜。

拆镜后按一次视频生成任务组织生产段：普通段通常 1–3 镜，快速切镜通常 4–6 镜；段内可以切机位，但同段镜头总时长必须为 4–15 秒。段号、段类型、场景/时间边界、单镜不足 4 秒的后期裁短写法和例外规则全部执行 [`references/directing-production.md`](references/directing-production.md)。

### 第4步：匹配元素，基于感知规律选参数

**输出**：景别 + 角度 + 运动 + 时长的最优组合

**决策对照表**：

| 元素 | 本质作用 | 决策依据 |
|------|----------|----------|
| 景别 | 决定观众与主体的心理距离 | 情绪越强，景别越近；交代环境用全景/远景 |
| 角度 | 决定观众对主体的主观态度 | 仰视=强大/压迫；俯视=弱小/无助；倾斜=不安 |
| 镜头运动 | 引导观众视线移动 | 推=聚焦；拉=揭示；慢摇=悬念积累；固定=客观 |
| 时长 | 分配注意力时间权重 | 1-2s=简单信息；3-5s=情绪反应；5s+=深度代入 |

**儿童剧景别边界**：
- 全景只用于首次交代环境、人物空间关系或重新确认方位；普通动作不要为了“好看”退到全景
- 双人对话优先中景平视固定机位，减少过肩视角来回切换
- 特写只用于必要的情绪峰值、关键线索、关键食物/道具或认知变化；普通台词不滥用特写
- 缓慢节奏的开场环境镜头默认给足约5秒，让低龄观众完成空间识别；后续镜头时长再随信息复杂度调整

含对白、连续动作或关键反应的镜头，在确定时长后必须建立镜内表演节拍：分别标记对白实际发声时码、说话者动作、倾听者反应、画面焦点和声音方式。普通对白必填慢／中／快档位并复核；镜头时长还要另加动作、反应和停顿。

### 第5步：串联节奏，定剪辑点

**输出**：完整的镜头顺序与剪辑时机

**核心规则**：
- 剪辑点永远对齐观众的视线落点或动作峰值
- 情绪转折处用"硬切"，制造突兀感
- 紧张段落：镜头越来越短，景别越来越近
- 情绪释放段落：镜头越来越长，运动越来越慢
- 同景别、同角度、同机位持续发生的剧情不要机械拆碎；若无新的注意力目标，就让动作在一个镜头内完成
- 合并长镜头必须写清动作先后和最终画面状态，避免多名角色同时争夺儿童注意力
- 时间发生跳跃时，只能使用 `时间蒙太奇` 段，并至少组合两类可见时间证据；连续对白不得跨越时间跳跃

### 第6步：设计声音，70%的情绪来自声音

**优先级**：音效 > 静音 > 音乐

**核心技巧**：
- 悬念场景：用"声音的突然消失"代替恐怖音效
- 情绪同步：让观众的心跳与镜头中的心跳声同频
- 绝对禁用：满铺的背景音乐，会毁掉所有悬念
- 所有对白、旁白、画外音、环境声和音效只在所属段内开始并结束；禁止跨段 J-cut、L-cut 和声音桥

### 第7步：无情做减法

**检查清单**：
- 删掉所有不能服务于核心目标的镜头
- 删掉所有多余的环境展示和人物外貌描写
- 删掉所有俗套的面部表情镜头，改用生理反应（后颈、拳头、呼吸）
- 删掉所有不必要的音乐和音效
- 不删、不缩写、不概括、不改写任何原剧本对白；对白不是“冗余信息”

### 儿童剧镜头合并与拆分速查

| 情况 | 处理 | 原因 |
|------|------|------|
| 同景别、同角度、同机位、同一核心目标连续发生 | 合并，并按时间顺序写动作 | 避免碎切，降低低龄观众的认知切换成本 |
| 对话双方保持同一空间关系 | 双人中景平视固定拍摄 | 同时看清说话者、倾听者和道具 |
| 新线索首次出现、情绪明显转折、关键道具揭示 | 单独切镜，可按需要使用近景/特写 | 把唯一注意力交给关键变化 |
| 只是在同一动作中换了人物反应 | 先尝试同框调度；只有反应无法读清时才切 | 反应重要，但不等于必须切镜 |
| 时间跳跃但地点不变 | 加入至少两类时间证据再切 | 防止观众误解为动作立即连续发生 |
| 缓慢开场需要交代环境 | 全景约5秒，运动缓慢并稳定落到叙事入口 | 给儿童足够的空间识别时间 |

**生理反应语义检查**：不要凭印象写身体反应。发现目标、惊喜或兴趣增强时，常用“瞳孔放大、耳朵竖起、身体前倾”；强光、警觉收束或聚焦细节才可能使用“瞳孔收紧”。若反应方向与剧情刺激不一致，必须改正。

---

## 四、核心工具库：大脑感知硬规律速查

### 1. 视觉注意力规律
- 人脸优先 > 运动优先 > 对比度优先 > 中心优先
- 人类会自动忽略暗部信息，把视线集中在亮部

### 2. 时间感知规律
- **0.1-0.3s**：闪回/惊吓，看不清内容
- **1-2s**：快节奏信息传递
- **3-5s**：标准镜头时长，产生初步情绪
- **5s以上**：深度情绪代入与思考

### 3. 情绪传递规律
- 手持抖动 = 不安/混乱/真实
- 慢镜头 = 情绪放大
- 留白 = 无限想象空间
- 反应镜头永远比动作本身更有情绪冲击力

---

## 五、四级量化评分体系（总分100分）

| 检查层级 | 权重 | 核心检查内容 | 合格线 |
|----------|------|-------------|--------|
| 整体分镜检查 | 30分 | 叙事逻辑、情绪曲线、节奏控制、视角一致性 | 24分 |
| 情景分镜检查 | 30分 | 情景戏剧功能、转折点强化、镜头衔接流畅度 | 24分 |
| 单镜头检查 | 30分 | 单一核心目标、元素匹配度、感知规律运用 | 24分 |
| AI生图规范检查 | 10分 | 描述清晰度、无歧义、可生成性、内置风格一致性 | 8分 |

**打回标准**：总分低于90分，或任意层级得分低于该层级合格线，进入下一轮修改
**通过标准**：总分≥90分，且所有层级得分均达到合格线

**前置硬门禁**：量化评分只在对白、生产段、空间、表演、页面映射、视频提示词和视觉门禁全部通过后进行。任一项失败直接打回；总分再高也不得通过。完整门禁见 [`references/directing-production.md`](references/directing-production.md)。

### 1. 整体分镜检查（30分）

| 检查项 | 分值 | 扣分标准 |
|--------|------|----------|
| 叙事逻辑完整性 | 10分 | 缺少关键情节节点，每处扣5分；逻辑断裂，扣10分 |
| 情绪曲线合理性 | 8分 | 情绪起伏不符合剧本意图，扣5分；没有铺垫直接高潮，扣8分 |
| 整体节奏控制 | 7分 | 节奏拖沓或过快，扣4分；没有张弛变化，扣7分 |
| 叙事视角一致性 | 5分 | 视角混乱，随意切换上帝视角，扣5分 |

### 2. 情景分镜检查（30分）

| 检查项 | 分值 | 扣分标准 |
|--------|------|----------|
| 情景核心功能明确 | 10分 | 情景戏剧功能不清晰，扣10分 |
| 关键转折点强化 | 8分 | 情绪转折点没有用单独镜头强化，每处扣4分 |
| 镜头衔接流畅度 | 7分 | 剪辑点不符合视觉习惯，每处扣3分；跳轴，扣7分；时间跳跃缺少可感知证据，扣3分 |
| 信息密度合理 | 5分 | 信息过载或信息不足，扣5分；同机位连续动作被无理由拆碎，每组扣2分 |

### 3. 单镜头检查（30分）

最核心的检查环节，每个镜头单独打分，取平均分

| 检查项 | 分值 | 扣分标准 |
|--------|------|----------|
| 单一核心目标明确 | 12分 | 没有标注核心目标，扣12分；一个镜头有多个目标，扣10分 |
| 元素与目标匹配 | 8分 | 景别/角度/运动/时长选择不能服务于核心目标，每处扣2分 |
| 符合大脑感知规律 | 6分 | 违反视觉注意力/时间感知/情绪传递规律，扣6分 |
| 无多余信息 | 4分 | 包含与核心目标无关的内容，每处扣2分；生理反应方向与剧情刺激相反，扣2分 |

### 4. AI生图规范检查（10分）

| 检查项 | 分值 | 扣分标准 |
|--------|------|----------|
| 描述具体无歧义 | 4分 | 出现"紧张的""悲伤的""美丽的"等抽象形容词，每处扣1分 |
| 包含必要生成元素与风格锚点 | 3分 | 缺少景别/角度/光影/黑白层次或内置线稿风格锚点中的任意一项，每处扣1分 |
| 无AI无法理解的指令 | 2分 | 出现"慢动作""手持抖动"等AI无法直接生成的动态描述，扣2分 |
| 格式统一 | 1分 | 描述格式混乱，扣1分 |

---

## 六、双Agent闭环工作流程

```mermaid
graph TD
 A[输入：文学脚本片段] --> B[写作者Agent：按7步流程创作分镜]
 B --> C[提交：分镜表+导演生产表+逐段视频提示词+创作说明]
 C --> D[质检者Agent：四级检查并打分]
 D --> E{总分≥90且所有层级合格?}
 E -->|是| F[输出：最终分镜表+导演生产表+视觉分镜图+逐段视频提示词]
 E -->|否| G{修改轮次≥5?}
 G -->|是| H[输出：当前最优分镜与生产表+视觉分镜图+未通过说明]
 G -->|否| I[输出：详细修改意见+扣分点]
 I --> B
```

### 每轮修改要求
1. 写作者必须针对质检者提出的每一个扣分点进行修改
2. 提交修改稿时，必须附带「修改说明」，逐条说明修改了什么、为什么修改
3. 质检者优先复查上一轮扣分点，并重新扫描全部前置硬门禁；修改引发的新错误必须记录并打回
4. 涉及段或镜头合并、拆分时，重新核验段号与镜号连续、每段 4–15 秒、时码无空档/重叠、空间状态链、每段 4–6 格和逐段提示词一一对应
5. 每轮修改后重新执行对白逐句对账和语速校验；镜头重排或合并不得改变对白文本、顺序和说话者

---

## 七、系统终止条件

1. **最优终止**：全部前置硬门禁通过、总分≥90分且所有层级达到合格线 → 输出最终分镜表 + 导演生产表 + 视觉分镜图 + AI 生图提示词 + 逐段 AI 视频提示词
2. **强制终止**：修改轮次达到5轮仍未通过 → 输出当前得分最高的分镜表、导演生产表与视觉分镜图 + 未通过说明 + 改进建议
3. **手动终止**：用户可以在任意轮次手动终止流程，选择当前版本作为最终版本

---

## 八、AI 视频与生图提示词转换规则

### 逐段 AI 视频提示词

一段提示词只对应一次视频生成任务。按 [`references/directing-production.md`](references/directing-production.md) 的模板写段总时长、段类型、所含镜号和逐秒切换顺序；提示词内部时码之和必须等于该段镜头时长之和，所有声音在段内闭合。禁止按镜头另拆视频生成任务。

### 内置分镜风格

每次绘制分镜图前，完整读取 [`references/storyboard-visual-style.md`](references/storyboard-visual-style.md)。默认把以下四张图片同时作为风格参考输入；若工具限制参考图数量，至少使用 `reference-02.png` 和 `reference-04.png`：

- `assets/storyboard-style/reference-01.png`
- `assets/storyboard-style/reference-02.png`
- `assets/storyboard-style/reference-03.png`
- `assets/storyboard-style/reference-04.png`

参考图只控制粗草线条、低完成度、简化程度和表演可读性；参考图中若存在米黄、暖灰、黄色或其他色相，必须忽略并转为黑白灰。Toffee Family 角色设定、用户提供的角色参考图、剧本动作与场景连续性拥有更高优先级，但身份锁定不得推动画面精修成角色设定稿。

### 逐格绘制流程

1. 先完成并通过分镜表、时码和对白对账，再开始绘制，避免给仍会合并或拆分的镜头做无效图。
2. 每段按导演生产表映射 4–6 格，每格选择一个决定性瞬间；单镜段的不同格表现镜内连续节拍，不得把多个时间状态拼进同一格。
3. 使用任务开始时锁定的交付模式、视觉模式和画幅；未指定时默认 `group-sheet + gray-rough + 16:9`。
4. 先生成一张严格黑白灰、低完成度的角色粗草锚点，再使用同一角色锚点和四张内置风格参考生成所有镜头；保持物种、服装、体型比例、左右位置和屏幕方向连续。角色设定中的毛色、眼睛与配饰色彩只用于识别身份，画面中必须改用少量松散涂黑、稀疏线纹和留白区分；不得为了锁定身份补画毛发、材质或成稿级五官。
5. 首轮生成后，按镜号逐张检查。只重绘不合格镜头，不得用文字说明代替明显的角色错位、肢体错误或风格漂移。
6. 若当前环境确实没有图像生成能力，才允许退化为完整逐格提示词，并明确标注“视觉分镜图待生成”。

### 标准格式
`[景别], [拍摄角度], [构图与角色位置], [决定性瞬间], [必要环境线索], [光影与黑白层次], [内置分镜风格锚点]`

每格提示词只描述一个可见瞬间，优先选择关键动作完成后的终态。不要把“先做A、再做B、最后做C”的时间过程塞进同一格；动态过程保留在分镜表和逐段视频提示词中。

### 禁止出现
慢动作、手持抖动、推/拉/摇/移、情绪形容词、抽象概念

### 情绪转化为视觉元素

| 情绪 | 视觉转化 |
|------|----------|
| 紧张 | 黑白高对比、局部潦草重线、倾斜构图 |
| 悲伤 | 低对比中性灰、柔和边线、较多留白 |
| 不安 | 轻微重复轮廓、局部断线、重心偏移 |
| 希望 | 大面积白底、稀疏排线、向上或向外展开的构图 |

### 示例

**分镜描述**：大特写，平视，固定，3s，透明玻璃杯的杯口，一缕白色热气在台灯下缓缓升起

**AI生图提示词**：大特写，平视角度，透明玻璃杯用三四根不闭合线概括在画面中央，一缕热气用一根弯线表示，背景只画台灯位置线；纯白纸面，黑色与中性灰动画分镜粗草，少线、断线、重复试探线、局部潦草重线，灯光只用留白表示，不画玻璃材质、反光、纹理和完整阴影，严格黑白灰，无任何彩色、色相或彩色点缀，明显低完成度，不做精修插画

---

## 九、专业分镜师自检清单

全部通过才算合格：

1. ✅ 每个镜头都有且只有一个清晰的核心目标
2. ✅ 所有元素的选择都能追溯到"为了传递什么信息/情绪"
3. ✅ 没有任何一个镜头是"凭感觉"选的
4. ✅ 声音栏的详细程度不低于画面栏
5. ✅ 删掉任何一个镜头，都会导致叙事或情绪断裂
6. ✅ 没有任何多余的信息会分散观众的注意力
7. ✅ 同景别、同角度、同机位、同目标的连续剧情已经合并，没有把微动作机械拆镜
8. ✅ 全景只承担环境/方位交代，特写只承担关键情绪、线索或道具强调
9. ✅ 儿童双人对话优先采用儿童眼高中景固定机位，没有无意义的过肩正反打
10. ✅ 所有时间跳跃都有至少两类可感知证据，生理反应方向与刺激语义一致
11. ✅ 段号使用 `段001` 起的整集连续编号，镜号也整集连续；同段各行重复填写合法段类型
12. ✅ 原剧本对白、旁白、歌唱和群体喊话覆盖率 100%，无删句、缩写、概括、同义改写、错序或错配说话者
13. ✅ 普通对白均填写慢／中／快档位；无档位不匹配、无理由低于 2.0 或高于 3.3 的项目
14. ✅ 场景空间表、场面调度、角色屏幕侧、视线、出入口和道具状态链连续
15. ✅ 含对白和关键反应的镜头具有镜内表演节拍，说话者动作与倾听者反应不同时抢焦点
16. ✅ 每段镜头时长之和均为 4–15 秒；段内单镜可短于 4 秒，独立短镜按 4 秒生成时已在“剪辑点”写明裁后时长和保留动作
17. ✅ 普通段不跨场景；时间蒙太奇具备两类时间证据；纯转场不夹带新剧情；所有声音都不跨段
18. ✅ 每段映射 4–6 格，页面、段号、宫格、镜号、镜内节拍和对白 ID 无遗漏、重复或错序
19. ✅ AI 视频提示词按段输出，一段一次任务，内部切镜顺序、时码和声音边界与分镜表一致
20. ✅ 角色锚点和所有分镜图符合交付与视觉模式，没有彩色色相、参考图角色复制或成稿级精修漂移

---

## 十、常见误区避坑

| 误区 | 真相 |
|------|------|
| 分镜必须画得好 | 分镜的核心是传递信息，火柴人+文字分镜同样有效 |
| 参考风格等于照搬参考图 | 只提取少线、断线、重复试探线、表演优先和背景定位线等粗草语言；忽略参考图配色，角色、场景和构图必须来自当前 Toffee Family 剧本 |
| 黑白线稿等于精细铅笔画 | 错。目标是动画分镜粗草，不是角色设定稿；删掉毛发、材质、装饰、完整阴影和建筑细节，只留下动作、表情、构图与方位 |
| 为了镜头节奏可以压缩对白 | 错。镜头和动作可以合并，对白必须逐字保留；时长不足就延长镜头或成片 |
| 还原剧本会妨碍视觉创作 | 对白与剧本明确动作必须完整保留；画面仍可在不冲突、不加戏的前提下表现潜台词 |
| 上帝视角能让观众了解更多信息 | 未知的恐惧和悬念，永远比全知更有吸引力 |
| 镜头越多越专业 | 能用一个镜头说清楚的事，绝对不用两个 |
| 一个镜头一件事等于一个动作一镜 | “一件事”指一个核心叙事目标；同机位连续动作应合并并按顺序调度 |
| 对话必须靠过肩正反打保持节奏 | 儿童剧优先同框中景，只有视点或关系发生变化才切换 |
| 时间过去了写在文字里就够 | 只在时间蒙太奇段压缩时间，并提供至少两类可见时间证据 |
| 一段等于一个镜头 | 错。一段等于一次 4–15 秒视频生成任务，内部允许多镜切换 |
| 声音桥能让相邻段更顺 | 本流程禁止任何声音跨段；所有对白、旁白、环境声和音效都在本段闭合 |

---

## 十一、输出格式模板

### 分镜表格式

```markdown
## 分镜表

| 段 | 段类型 | 镜号 | 时码 | 景别 | 视角角度 | 镜头运动 | 时长 | 画面内容 | 声音 | 核心目标 | 场面调度 | 连续性锚点 | 道具状态 | 剪辑点 |
|----|--------|------|------|------|---------|---------|------|---------|------|---------|----------|------------|----------|--------|
| 段001 | 单镜连续 | 1 | 00:00-00:04 | 中景 | 儿童眼高平视 | 固定 | 4s | ... | ... | ... | ... | ... | ... | 后期建议保留2.5s，保留抬头到眨眼完成 |
```

场景空间表、镜内表演节拍和页面映射使用 [`references/directing-production.md`](references/directing-production.md) 中的模板，均为必交导演生产表。

### 创作说明格式

```markdown
## 创作说明

**情景功能**：一句话说明情景戏剧任务
**情绪曲线**：描述情绪起伏
**视角策略**：说明视角选择原因
**关键转折点**：标记情绪转折位置
```

### 修改说明格式

```markdown
## 修改说明（第N轮）

| 扣分点 | 原问题 | 修改内容 | 修改原因 |
|--------|--------|---------|---------|
| ... | ... | ... | ... |
```

### 对白对账表格式（必交）

```markdown
## 对白逐句对账

| 对白ID | 原剧本说话者 | 原剧本对白原文 | 可发音字数 | 实际发声时长 | 字/秒 | 语速档位 | 分镜段/镜号 | 核验 |
|--------|--------------|----------------|------------|--------------|-------|----------|-------------|------|
| D001 | ... | ... | ... | ... | ... | 慢/中/快 | 段001/镜1–2 | 逐字一致；档位匹配 |

覆盖率：100%；删句：0；缩写/改写：0；错序：0；错配说话者：0；过快：0；偏慢无理由：0。
```

### AI 视频提示词输出格式

```markdown
## AI 视频提示词

### 段001｜多镜叙事｜6s｜镜1–镜3
0.0–2.0s（镜1）：...
2.0–4.0s（镜2）：...
4.0–6.0s（镜3）：...
声音边界：所有声音在本段内开始并结束，无跨段声音。
连续性：...
```

### AI生图提示词输出格式

```markdown
## AI生图提示词

### 段001｜格1｜镜1｜起势
[景别], [角度], [构图与角色位置], [决定性瞬间], [仅限必要环境定位线], [用留白和稀疏灰线表示光影], 纯白纸面，黑色与中性灰低完成度动画分镜粗草，少线、断线、重复试探线、局部潦草重线，角色只保留剪影、眼神、嘴形、手势和固定配饰识别点，背景只画方位线，不画材质、装饰、完整阴影和成稿级轮廓，严格黑白灰，无任何彩色、色相或彩色点缀
```

### 视觉分镜图输出格式

```markdown
## 视觉分镜图

### 段001｜4–6宫格｜镜1–镜3
![段001视觉分镜](生成文件的绝对路径)

逐格映射：格1→镜1/起势；...
```

