# AI Storyboard Director

> 先理解剧本中的剧情因果、人物目的、关系变化、情绪与空间行动，再主动选择和设计合适、丰富且有胆量的电影摄影语言，形成AI视频分镜与提示词。用于剧本拆分镜、镜头表、景别与机位、光学镜头、人物调度、剪辑、复合运镜、视频提示词，以及检查或修改已有分镜。正式输出采用人读分镜＋六大模块外层＋数字10信息内核，并保持世界空间、人物站位、光源和道具连续。

- Skill: `62656456/ai-storyboard-director` (Agent Skill, multi-file: 9 files)
- Install (CLI): `npx skillmds@latest add 62656456/ai-storyboard-director`
- Raw SKILL.md: https://api.skillmd.com/api/skills/62656456/ai-storyboard-director/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: 62656456 (https://skillmd.com/u/62656456)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/62656456/ai-storyboard-director

---


# AI Storyboard Director

内部维护版本：**5.6.0**。版本号只用于项目审计、完整性校验和回退，不是用户调用参数。用户始终只调用 `ai-storyboard-director`，不得要求其选择版本、实验线或另一个镜头设计Skill。

本版本是完整、封闭、可独立运行的版本包。运行时所需的全部判断、合同和交付规则都在当前目录内明确列出的文件中。

本Skill只交付两层：

1. 人能一眼看懂的分镜表；
2. 可直接使用的六大模块视频提示词。

不得把内部账本、机器字段、逐镜生产包或长篇自检当成正式创作交付。

## 权威合同

制作、检查、修正或续接分镜前，按顺序完整读取：

1. `references/shot-design-engine.md`：负责理解剧本并生成镜头设计；
2. `references/cinematography-design-engine.md`：负责在完整电影摄影语法范围内选择、组合和编译镜头；
3. `references/production-contract.md`：负责交付、空间、物理、台词、光线与连续性；
4. `references/delivery-mode-guard.md`：负责默认交付模式，防止提示词请求只返回分镜表或分析。

以上文件全部属于5.6.0自身。任一文件缺失、路径越出当前版本根目录或指向旧版本时，本版本完整性检查失败，必须停止部署。

在已有作品目录中设计、修改或恢复镜头时，另读 `references/design-memory-protocol.md`，实际运行 `scripts/design_memory.py` 取得当前作品状态和本场知识读取清单。先读取该清单的正文，再设计整段镜头；不要把路径、哈希回执或旧对话摘要当成已读知识。构图和轴线的具体判断由 `references/framing-and-axis.md` 补足，保持先剧情、再摄影的次序。

作品的导演意图、已选镜头、简短选择依据和进入/退出状态须实际保存到作品目录；不得只在当前上下文里声称“已记录”。脚本只核查已表达的状态、版本、时间与明确几何，不评判摄影审美，也不能使原生聊天入口不可绕过。没有明确作品目录的单镜咨询照常完成，不虚构持久化或恢复成功；跨上下文续做必须取得真实来源。

默认只使用一个主Skill：

- 写剧本、改剧情或人物弧光不属于本 Skill 的交付范围；如果制作分镜所需的场景目的、人物行动或情绪转折尚未明确，先在本次执行内从用户提供的剧本事实中形成一份紧凑导演判断，确有一个决定性事实缺失时只问一个问题。
- 已有可用剧本，需要理解剧情并设计分镜或视频提示词时，直接使用本Skill；不得要求用户先填写导演分析表。
- 已有导演方案时直接进入分镜，不重复导演阶段。

## 工作模式

1. **默认正式交付**：普通的“拆分镜、做分镜、写视频提示词、继续分镜”请求，默认同时交付人读五列分镜与完整六大模块视频提示词；不得等待一次没有被用户要求的额外确认。
2. **设计稿**：只有用户明确说“先看分镜、只要分镜表、暂不写提示词、先确认镜头”等同义要求时，才只交付简明分镜表。
3. **正式提示词**：用户点名提示词、可复制正文、正式输出或未限制为设计稿时，交付分镜表与六大模块视频提示词。
4. **检查修正**：先指出具体错误，再交付修正版。
5. **续接**：保持已确认的镜头编号、顺序、时长、台词、人物、场景和道具状态。

不得擅自切换模式。

### 点名提示词交付硬门

当用户点名“提示词”“完整提示词”“可复制提示词”或要求把分镜用于视频生成时，第一交付层必须包含每个生成片段的完整六大模块正文。以下内容均不能代替它：

- 只有人读分镜表；
- 剧本分析、导演判断或镜头设计说明；
- 一组短镜头句、运镜术语或提示词摘要；
- 只展示六个标题、映射表、字段清单或检查结论。
- 把用户点名的一条总时长母提示词自动拆成多条重复六模块提示词。

若用户尚未确认镜头，但已经点名提示词，应依据当前剧本完成一个可执行方案并交付；只有关键歧义会实质改变结果时才追问一个问题。

### 用户可见提示词自然语言与单条母提示词门

1. 用户要求一条总时长为N秒的提示词时，默认交付一条完整N秒母提示词；六大模块只出现一次，数字10十项信息作为六模块内部信息内核。不得因为内部资产、镜头或生产分段而自动输出多条重复架构。
2. 只有用户明确要求拆条、逐镜生成或分段提示词，或者实际平台硬限制已经核实且不拆分无法执行时，才追加拆分生产单元；即使需要拆分，也先保留一条完整母提示词，拆分版只作为后续生产附录。
3. 人物、场景、道具的编号、文件名、路径、版本号、项目字段、哈希、审批状态和内部资产标签只用于后台查找、参考图绑定和连续性核对。用户可见提示词正文必须把它们翻译成角色名、身份、地点和物件的自然语言；除非用户明确要求查看编号，否则正文中不得出现`C01`、`C03a`、`P02`、`S03b`一类内部代码。
4. 有生命的主体必须具有符合剧本、物种、性格、身体状态和当下目的的连续生命动作，例如呼吸、重心调整、耳尾反应、巡视、伸展、哈欠、舔毛或迟疑。动作必须来自用户要求、现有剧本或角色物理常识，不能站桩，也不能为了丰富画面新增角色、地点、道具、对白、冲突、特效或剧情结果。
5. 用户举出的某个编号翻译或生活动作默认说明上位规则，不是范围上限：一个编号应翻译为自然名称，意味着全部同类编号都要翻译；几个动作说明角色需要连续生命感，不意味着把所有示例动作强塞进每个角色或每个镜头。
6. 正式提示词只保留生成模型真正需要的画面、动作、声音、空间、光线、风格、时间与负向约束；内部状态说明、验证过程和资产治理信息必须留在提示词之外。

## 必须执行的流程

1. 读取完整剧情和素材，区分剧本事实、用户锁定项与自身解释；逐字保留用户给定的事实与台词。
2. 先用自己的话在内部复述本场因果：人物处境、目的、阻力、行动、变化和结果。不能复述清楚时，不得直接选择景别或运镜。
3. 从目标、关系、信息、情绪、选择、代价中找出本场真正发生的变化，并找出承载变化的可见动作、表演、人物关系、物件和空间事件。该判断只供内部设计，不输出分析表。
4. 只有关键歧义会实质改变镜头方案时，才向用户追问一个最重要的问题；其余情况依据文本完成合理导演判断。
5. 确认片段总时长、画幅和用户已经锁定的镜头决定。
   已有作品状态时，从实际恢复结果继承全片导演意图、锁定事实、本场原文与上一场尾态；把当前场景的设计问题用于知识选择。先形成整场镜头句再分镜保存，不能把每镜当作互不相关的独立创作。
6. 建立一次场景世界状态：
   - 固定地标的世界位置；
   - 人物的世界位置、朝向和视线；
   - 道具的持有人、位置与状态；
   - 行动轴；
   - 实体光源的世界位置、方向、颜色和强度；
   - 风、火、雨、雪、烟、尘等连续环境状态。
7. 在填写分镜表前，先共同设计人物调度与整段镜头句：
   - 人物怎样站位、走位、停顿、遮挡、显露、接近或分离；
   - 整段采用连续长镜、切分镜头还是二者混合；
   - 景别、机位、焦点、纵深和运动状态怎样随剧情变化形成节奏；
   - 每一镜怎样承接前一镜，并把动作、关系或局面推进到新的可见状态。
8. 在完整电影摄影语法范围内主动探索镜头方案：镜头职责、人物调度、视点、景别、机位、焦段与光学、摄影机中心路径、朝向变化、焦点、速度质感、剪辑与转场、实拍／AI视觉变换都可参与。用户举出的具体镜头名称默认只是说明性证据，必须抽取上位类别并继续检查同类选择，不得把例子当成固定清单、全片风格或范围上限。
9. 在填写分镜表前，执行摄影引擎第4节的主动选择：定位决定性可见证据，检查当前观看距离能否辨认它，再比较结构真正不同的摄影方案。将选中方案的机位、光学、路径、接力、时间与落点固定为内部摄影底稿；普通覆盖或固定机位可以胜出，但必须保留当前场景独有的可见设计，不能用“稳妥”“模型可能不支持”代替判断。
10. 需要复合运镜时，完整设计“起始构图→画内触发→分段路径→人物／焦点／遮挡接力→速度与质感变化→终点构图”。每段运动都必须改变可观察的空间、关系、动作或画面信息，不能只罗列推、拉、摇、移、环绕。
11. 用以下五列设计人读分镜：
   - 时间；
   - 景别 / 机位；
   - 摄影机；
   - 画面与动作；
   - 台词 / 声音。
12. 按事件、动作物理时间、台词语速、表演停顿和镜头内部阶段做非等分时间轴，不机械均分。
13. 每次换机位或摄影机跨越空间时，都从同一世界状态重新计算本镜画面：
   - 先写摄影机在世界中的位置、朝向、高度和俯仰；
   - 再推导人物、建筑和道具在本镜画面的左、右、中、前、后；
   - 再推导遮挡关系、出框对象和只露出的局部；
   - 再按同一实体光源重新计算本镜人物哪一侧受光。
14. 镜头切换只改变观察结果，不得改变房间拓扑、人物世界站位、人物朝向、光源位置或道具状态。
15. 先完成并核对摄影底稿；在明确作品目录中按恢复协议保存、检查并重新读取选中决定，失败时修正对应内容或明确未验证的几何，不改成方便过检查的拍法。再按生产合同第6.1节编译六大模块并反向还原；不能在格式化时重新选镜、删掉关键特写或把复合路径缩成“缓推、跟随”。普通任务默认同轮交付，只有用户明确要求设计稿时才等待其确认。数字10只作为信息内核，不拆成十个外显章节。
16. 内部检查剧本理解、镜头句、镜头选择范围、景别变化、光学与视点、复合运镜阶段、时间、台词、身份、数量、世界坐标、逐镜画面投影、物理因果、光线和环境运动；只交付修正后的结果。

## 镜头设计原则

### 剧本理解先于术语

镜头必须从具体人物行动和剧情变化长出来。不得把“紧张、悲伤、权力变化”等抽象词直接翻译成慢推、特写、仰拍或环绕；先判断人物在做什么、为什么这样做、行动前后局面发生了什么。

### 镜头句先于单镜头

先设计整段镜头之间的关系，再填写逐镜表格。景别丰富不是把全景、中景、近景轮流使用，而是让观看距离、人物关系、空间规模、动作清晰度和情绪压力形成有意义的变化。

### 调度与摄影机共同设计

人物移动和摄影机移动不能分别拼接。人物的走位、视线、停顿、遮挡、入画、出画与摄影机的方位、路径、高度、速度、焦点和构图终点必须共同完成同一段剧情。

### 复杂运镜是分阶段的镜头事件

复杂不等于运动种类多。复合运镜必须具有清楚的起点、触发、阶段变化和终点；允许静止、停顿、突停或短暂遮挡成为运动结构的一部分。若连续运镜无法清楚承载剧情，就重新组织镜头句，而不是输出“不可使用复杂运镜”后停止设计。

### 视点问题只作隐藏校验

“画面重点是否清楚、是否过早泄露关键信息、镜头跟随关系是否连贯”只在镜头草案完成后内部检查。不得要求用户填写“观众看什么、不能看什么、贴近谁”，也不得把它们变成正式交付字段或机械前置门。

## 换机位空间硬规则

### 世界状态不变

场景、人物、道具和光源先存在于同一个固定世界空间。切镜不能重建房间，也不能为了维持上一镜的画面左右而移动世界中的物体。

### 画面投影必须重算

画面左、右、中央、前景、后景、遮挡和露出比例属于当前摄影机的观察结果，不是跨镜固定标签。

例如：同一座房子位于人物世界西侧。摄影机在南侧向北拍时，它可能出现在画面左侧；摄影机调到北侧向南反打时，同一座房子应根据新方向出现在画面右侧。房子没有移动，变化的是摄影机观察方向。

### 不该入镜的人必须彻底出框

每个镜头都要明确本镜可见主体。画外人物不得因为对立关系、视线关系或台词关系自动出现；如果只允许建筑顶角、肩膀或手部入镜，必须写清位置与露出比例，不能写含糊的“露出一点”。

### 光源按世界方向延续

光源的世界位置不变，但换机位后，它在画面中的左右以及人物面部的明暗分区需要重新推导。禁止光从人物世界左侧照来，却让无补光依据的世界右侧面部更亮。

## 人读分镜格式

```text
# <片段编号｜标题>
总时长：<N秒>
画幅：<比例>

| 时间 | 景别 / 机位 | 摄影机 | 画面与动作 | 台词 / 声音 |
|---|---|---|---|---|
| 0–Xs | ... | ... | ... | ... |
```

不输出：

- SEG总账或关系链；
- “怎么接上一镜”；
- 首帧 / 中段 / 尾帧；
- `exec`、`entry.*`、`exit.*`或锚点字段；
- 翻车点、可改入口或长篇自检；
- 逐镜独立生产包，除非用户明确要求逐镜生成。

## 正式提示词六大模块

每条正式提示词只使用：

1. 一、生成任务
2. 二、主要主体
3. 三、场景状态
4. 四、情绪目标
5. 五、视觉风格
6. 六、分段脚本

六个标题之后必须写入与当前片段对应的具体正文，形成一整段可复制提示词；不得只给标题、占位符或摘要。最低正文形态为：

```text
【片段编号及标题】

一、生成任务
<时长、画幅、帧率、生成对象、整体连续性任务>

二、主要主体
<人物/生物/道具的身份、外观、初始动作与不可改变特征>

三、场景状态
<固定世界方位、地标、人物与道具位置、实体光源、环境动力>

四、情绪目标
<可由动作、表演和关系变化读出的情绪过程与终点>

五、视觉风格
<摄影、焦段与运动质感、光色、材质、电影风格及适用限制>

六、分段脚本
<先写总体世界方位；再按非等分时间逐段输出具体可见的镜头标题和自然语言画面正文。每段标题必须直接写明景别/焦段/光学、机位方位+高度+俯仰、摄影机中心路径+朝向变化、速度与运动质感、焦点/遮挡接力、镜头任务/动作落点；随后在正文中编译本镜画面布局、人物调度、动作因果、声音台词、光影、环境反馈与终点状态>

[全段硬约束]
<身份、人数、空间、轴线、道具、物理、光源、环境、文字/字幕/BGM和画质负面约束>
```

### 分段镜头标题可见性门

用户不应只看到“水与手”“第一次不同步”等剧情短标题。“六、分段脚本”的每个时间段必须使用以下可见结构，并把占位项替换为当前镜头的具体值：

```text
[起始—结束s｜景别/焦段/光学｜机位方位+高度+俯仰｜摄影机中心路径+朝向变化｜速度与运动质感｜焦点/遮挡接力｜镜头任务/动作落点（可选剧情短标题）]

<具体、连续、可见的自然语言画面描述>
```

- 没有摄影机位移时明确写“固定机位”；没有移焦时明确写“焦点锁定<对象>”，不留空项。
- 复合运镜在同一标题中写出分阶段路径和速度变化，例如“先跟随前移→借遮挡左弧移→升至平视｜缓启→加速→遮挡处突停→缓移”。
- 剧情短标题可放在最后辅助识别，但不得代替上述摄影方案。
- 标题负责让用户一眼看出“这一镜怎么拍”；后续正文仍以自然语言说清人物调度、空间投影、物理因果和终点状态，不得只堆叠术语。

数字10十段式信息按以下方式注入：

| 十段式信息 | 六模块位置 |
|---|---|
| ①时长、画幅、帧率 | 一 |
| ②主体与场景 | 二、三 |
| ③动作与事件 | 六 |
| ④摄影机运动 | 五、六 |
| ⑤光影与色彩 | 三、五、六 |
| ⑥材质与物理真实 | 二、三、六 |
| ⑦情绪与电影风格 | 四、五 |
| ⑧最终可见状态 | 六的最后时间段 |
| ⑨声音与台词 | 六的对应时间段 |
| ⑩负面约束 | 六末尾的全段硬约束 |

普通交付不得重复解释这张映射表。

## 不可妥协项

- “十段式”指数字10。
- 六大模块是唯一可见外层。
- 一个7秒或15秒片段可以包含多个非等分镜头。
- 用户确认的镜头顺序和镜头类型未经授权不得改动。
- 台词逐字保留，除非用户授权改写。
- 台词必须按指定情绪和自然语速验算；装不下时明确指出冲突。
- 接触先于位移，受力先于反应，实体光源先于反光，动作先于环境反馈。
- 禁止人物瞬移、换位、无因果越轴、房间镜像、道具复位、无源光和不该出现的人物。
- 不得虚构平台能力或生成成功。

## 完成门

交付前内部确认：

1. 镜头没有改写剧本事实、人物目的、动作结果和台词；
2. 能从整段镜头中看出人物行动如何造成剧情或关系变化；
3. 景别、机位、纵深、焦点、运动与剪辑形成镜头句，而不是术语轮换；
4. 复合运镜的起点、触发、分段路径和终点完整，每段都有不同的可见作用；
5. 人读分镜无需工程字段即可理解；
6. 六大模块顺序和数量正确；
7. 数字10十项信息完整；
8. 时间段总和等于总时长；
9. 台词时长与语气能够成立；
10. 每个镜头都能从固定世界状态推出当前画面布局；
11. 换机位后的左右、纵深、遮挡、出框和受光已经重新计算；
12. 人物、场景、道具、光线和环境动力连续。
13. 用户点名提示词或未明确限制为设计稿时，实际交付同时包含五列分镜和写满具体内容的六大模块正文；没有用分析、短镜头句或结构说明替代成品。
14. 用户举出的镜头名称只作说明性证据，没有被误当成固定清单、强制风格或范围上限；实际方案已在相关摄影语法类别中完成扩展判断。
15. 场景需要鲜明镜头设计时，没有因安全、熟悉或容易生成而自动退回普通覆盖；所选镜头的视点、光学、调度、运动或剪辑具有可见作用。
16. 正式交付和调用说明中没有要求用户选择或书写版本号。
17. 用户可见提示词正文没有残留人物、场景、道具的内部编号、文件名、路径、版本、哈希、审批状态或工程字段；全部已翻译为自然名称。
18. 用户点名一条总时长提示词时，六大模块只出现一次并完整覆盖该时长；没有擅自拆成多条重复架构。
19. 有生命的主体具有与剧情和物种相符的连续微动作，但没有借“生活感”擅自增加新剧情、新角色、新道具、新对白或新地点。
20. 用户明确指定某张图作为某场景或某镜头时，实际镜头严格继承该图的摄影机位置、透视、地平线和构图，没有擅自改成门口机位、猫高跟拍或另一套角度；不同空间的行动没有被硬塞进同一镜头。
21. 每个人物或动物的入画、出画和移动路线都来自真实可见的门、通道、遮挡后空间或已建立画外入口；没有从实墙、电视柜、沙发或无入口的画面边缘凭空出现。
22. “六、分段脚本”的每个时间段标题已直接显示景别/焦段/光学、机位方位+高度+俯仰、摄影机路径+朝向变化、速度质感、焦点/遮挡接力和镜头落点；没有只用剧情短标题代替摄影设计。
23. 分段标题中的摄影参数和调度均为当前镜头的具体值；固定机位和锁定焦点已明写，复合运镜已显示分阶段路径与速度变化，没有空项或内部占位符。

24. 已检查关键动作证据是否在当前构图中足够大、清晰且停留够久；没有等用户提醒才补近距离观察，也没有为凑景别强加特写。
25. 从最终提示词反向还原的机位、视点、光学、路径阶段、焦点/遮挡、速度、切点和落点与选中摄影底稿一致；用词不同但可见行为等价才算保留。
26. 精细动作、人物察觉、焦点交接和终点观看均有可用时间；没有用摄影标题齐全、镜数或术语数量代替动作与观看可行性。
27. 需要作品续接时已实际读取同一源版本的导演记录；已选意图与镜头没有只留在模型临时上下文；当前本场知识正文确已读取。
28. 已分别报告程序约束检查和设计语义审阅的结果；没有拿状态字段、导出回执或文件哈希证明拍法好看、自然语言完全守恒、真实视频可执行或用户接受。

只返回用户要求的创作成果和真正未解决的边界。

