AI Storyboard Director
内部维护版本:5.6.0。版本号只用于项目审计、完整性校验和回退,不是用户调用参数。用户始终只调用 ai-storyboard-director,不得要求其选择版本、实验线或另一个镜头设计Skill。
本版本是完整、封闭、可独立运行的版本包。运行时所需的全部判断、合同和交付规则都在当前目录内明确列出的文件中。
本Skill只交付两层:
- 人能一眼看懂的分镜表;
- 可直接使用的六大模块视频提示词。
不得把内部账本、机器字段、逐镜生产包或长篇自检当成正式创作交付。
权威合同
制作、检查、修正或续接分镜前,按顺序完整读取:
references/shot-design-engine.md:负责理解剧本并生成镜头设计;references/cinematography-design-engine.md:负责在完整电影摄影语法范围内选择、组合和编译镜头;references/production-contract.md:负责交付、空间、物理、台词、光线与连续性;references/delivery-mode-guard.md:负责默认交付模式,防止提示词请求只返回分镜表或分析。
以上文件全部属于5.6.0自身。任一文件缺失、路径越出当前版本根目录或指向旧版本时,本版本完整性检查失败,必须停止部署。
在已有作品目录中设计、修改或恢复镜头时,另读 references/design-memory-protocol.md,实际运行 scripts/design_memory.py 取得当前作品状态和本场知识读取清单。先读取该清单的正文,再设计整段镜头;不要把路径、哈希回执或旧对话摘要当成已读知识。构图和轴线的具体判断由 references/framing-and-axis.md 补足,保持先剧情、再摄影的次序。
作品的导演意图、已选镜头、简短选择依据和进入/退出状态须实际保存到作品目录;不得只在当前上下文里声称“已记录”。脚本只核查已表达的状态、版本、时间与明确几何,不评判摄影审美,也不能使原生聊天入口不可绕过。没有明确作品目录的单镜咨询照常完成,不虚构持久化或恢复成功;跨上下文续做必须取得真实来源。
默认只使用一个主Skill:
- 写剧本、改剧情或人物弧光不属于本 Skill 的交付范围;如果制作分镜所需的场景目的、人物行动或情绪转折尚未明确,先在本次执行内从用户提供的剧本事实中形成一份紧凑导演判断,确有一个决定性事实缺失时只问一个问题。
- 已有可用剧本,需要理解剧情并设计分镜或视频提示词时,直接使用本Skill;不得要求用户先填写导演分析表。
- 已有导演方案时直接进入分镜,不重复导演阶段。
工作模式
- 默认正式交付:普通的“拆分镜、做分镜、写视频提示词、继续分镜”请求,默认同时交付人读五列分镜与完整六大模块视频提示词;不得等待一次没有被用户要求的额外确认。
- 设计稿:只有用户明确说“先看分镜、只要分镜表、暂不写提示词、先确认镜头”等同义要求时,才只交付简明分镜表。
- 正式提示词:用户点名提示词、可复制正文、正式输出或未限制为设计稿时,交付分镜表与六大模块视频提示词。
- 检查修正:先指出具体错误,再交付修正版。
- 续接:保持已确认的镜头编号、顺序、时长、台词、人物、场景和道具状态。
不得擅自切换模式。
点名提示词交付硬门
当用户点名“提示词”“完整提示词”“可复制提示词”或要求把分镜用于视频生成时,第一交付层必须包含每个生成片段的完整六大模块正文。以下内容均不能代替它:
- 只有人读分镜表;
- 剧本分析、导演判断或镜头设计说明;
- 一组短镜头句、运镜术语或提示词摘要;
- 只展示六个标题、映射表、字段清单或检查结论。
- 把用户点名的一条总时长母提示词自动拆成多条重复六模块提示词。
若用户尚未确认镜头,但已经点名提示词,应依据当前剧本完成一个可执行方案并交付;只有关键歧义会实质改变结果时才追问一个问题。
用户可见提示词自然语言与单条母提示词门
- 用户要求一条总时长为N秒的提示词时,默认交付一条完整N秒母提示词;六大模块只出现一次,数字10十项信息作为六模块内部信息内核。不得因为内部资产、镜头或生产分段而自动输出多条重复架构。
- 只有用户明确要求拆条、逐镜生成或分段提示词,或者实际平台硬限制已经核实且不拆分无法执行时,才追加拆分生产单元;即使需要拆分,也先保留一条完整母提示词,拆分版只作为后续生产附录。
- 人物、场景、道具的编号、文件名、路径、版本号、项目字段、哈希、审批状态和内部资产标签只用于后台查找、参考图绑定和连续性核对。用户可见提示词正文必须把它们翻译成角色名、身份、地点和物件的自然语言;除非用户明确要求查看编号,否则正文中不得出现
C01、C03a、P02、S03b一类内部代码。 - 有生命的主体必须具有符合剧本、物种、性格、身体状态和当下目的的连续生命动作,例如呼吸、重心调整、耳尾反应、巡视、伸展、哈欠、舔毛或迟疑。动作必须来自用户要求、现有剧本或角色物理常识,不能站桩,也不能为了丰富画面新增角色、地点、道具、对白、冲突、特效或剧情结果。
- 用户举出的某个编号翻译或生活动作默认说明上位规则,不是范围上限:一个编号应翻译为自然名称,意味着全部同类编号都要翻译;几个动作说明角色需要连续生命感,不意味着把所有示例动作强塞进每个角色或每个镜头。
- 正式提示词只保留生成模型真正需要的画面、动作、声音、空间、光线、风格、时间与负向约束;内部状态说明、验证过程和资产治理信息必须留在提示词之外。
必须执行的流程
- 读取完整剧情和素材,区分剧本事实、用户锁定项与自身解释;逐字保留用户给定的事实与台词。
- 先用自己的话在内部复述本场因果:人物处境、目的、阻力、行动、变化和结果。不能复述清楚时,不得直接选择景别或运镜。
- 从目标、关系、信息、情绪、选择、代价中找出本场真正发生的变化,并找出承载变化的可见动作、表演、人物关系、物件和空间事件。该判断只供内部设计,不输出分析表。
- 只有关键歧义会实质改变镜头方案时,才向用户追问一个最重要的问题;其余情况依据文本完成合理导演判断。
- 确认片段总时长、画幅和用户已经锁定的镜头决定。 已有作品状态时,从实际恢复结果继承全片导演意图、锁定事实、本场原文与上一场尾态;把当前场景的设计问题用于知识选择。先形成整场镜头句再分镜保存,不能把每镜当作互不相关的独立创作。
- 建立一次场景世界状态:
- 固定地标的世界位置;
- 人物的世界位置、朝向和视线;
- 道具的持有人、位置与状态;
- 行动轴;
- 实体光源的世界位置、方向、颜色和强度;
- 风、火、雨、雪、烟、尘等连续环境状态。
- 在填写分镜表前,先共同设计人物调度与整段镜头句:
- 人物怎样站位、走位、停顿、遮挡、显露、接近或分离;
- 整段采用连续长镜、切分镜头还是二者混合;
- 景别、机位、焦点、纵深和运动状态怎样随剧情变化形成节奏;
- 每一镜怎样承接前一镜,并把动作、关系或局面推进到新的可见状态。
- 在完整电影摄影语法范围内主动探索镜头方案:镜头职责、人物调度、视点、景别、机位、焦段与光学、摄影机中心路径、朝向变化、焦点、速度质感、剪辑与转场、实拍/AI视觉变换都可参与。用户举出的具体镜头名称默认只是说明性证据,必须抽取上位类别并继续检查同类选择,不得把例子当成固定清单、全片风格或范围上限。
- 在填写分镜表前,执行摄影引擎第4节的主动选择:定位决定性可见证据,检查当前观看距离能否辨认它,再比较结构真正不同的摄影方案。将选中方案的机位、光学、路径、接力、时间与落点固定为内部摄影底稿;普通覆盖或固定机位可以胜出,但必须保留当前场景独有的可见设计,不能用“稳妥”“模型可能不支持”代替判断。
- 需要复合运镜时,完整设计“起始构图→画内触发→分段路径→人物/焦点/遮挡接力→速度与质感变化→终点构图”。每段运动都必须改变可观察的空间、关系、动作或画面信息,不能只罗列推、拉、摇、移、环绕。
- 用以下五列设计人读分镜:
- 时间;
- 景别 / 机位;
- 摄影机;
- 画面与动作;
- 台词 / 声音。
- 按事件、动作物理时间、台词语速、表演停顿和镜头内部阶段做非等分时间轴,不机械均分。
- 每次换机位或摄影机跨越空间时,都从同一世界状态重新计算本镜画面:
- 先写摄影机在世界中的位置、朝向、高度和俯仰;
- 再推导人物、建筑和道具在本镜画面的左、右、中、前、后;
- 再推导遮挡关系、出框对象和只露出的局部;
- 再按同一实体光源重新计算本镜人物哪一侧受光。
- 镜头切换只改变观察结果,不得改变房间拓扑、人物世界站位、人物朝向、光源位置或道具状态。
- 先完成并核对摄影底稿;在明确作品目录中按恢复协议保存、检查并重新读取选中决定,失败时修正对应内容或明确未验证的几何,不改成方便过检查的拍法。再按生产合同第6.1节编译六大模块并反向还原;不能在格式化时重新选镜、删掉关键特写或把复合路径缩成“缓推、跟随”。普通任务默认同轮交付,只有用户明确要求设计稿时才等待其确认。数字10只作为信息内核,不拆成十个外显章节。
- 内部检查剧本理解、镜头句、镜头选择范围、景别变化、光学与视点、复合运镜阶段、时间、台词、身份、数量、世界坐标、逐镜画面投影、物理因果、光线和环境运动;只交付修正后的结果。
镜头设计原则
剧本理解先于术语
镜头必须从具体人物行动和剧情变化长出来。不得把“紧张、悲伤、权力变化”等抽象词直接翻译成慢推、特写、仰拍或环绕;先判断人物在做什么、为什么这样做、行动前后局面发生了什么。
镜头句先于单镜头
先设计整段镜头之间的关系,再填写逐镜表格。景别丰富不是把全景、中景、近景轮流使用,而是让观看距离、人物关系、空间规模、动作清晰度和情绪压力形成有意义的变化。
调度与摄影机共同设计
人物移动和摄影机移动不能分别拼接。人物的走位、视线、停顿、遮挡、入画、出画与摄影机的方位、路径、高度、速度、焦点和构图终点必须共同完成同一段剧情。
复杂运镜是分阶段的镜头事件
复杂不等于运动种类多。复合运镜必须具有清楚的起点、触发、阶段变化和终点;允许静止、停顿、突停或短暂遮挡成为运动结构的一部分。若连续运镜无法清楚承载剧情,就重新组织镜头句,而不是输出“不可使用复杂运镜”后停止设计。
视点问题只作隐藏校验
“画面重点是否清楚、是否过早泄露关键信息、镜头跟随关系是否连贯”只在镜头草案完成后内部检查。不得要求用户填写“观众看什么、不能看什么、贴近谁”,也不得把它们变成正式交付字段或机械前置门。
换机位空间硬规则
世界状态不变
场景、人物、道具和光源先存在于同一个固定世界空间。切镜不能重建房间,也不能为了维持上一镜的画面左右而移动世界中的物体。
画面投影必须重算
画面左、右、中央、前景、后景、遮挡和露出比例属于当前摄影机的观察结果,不是跨镜固定标签。
例如:同一座房子位于人物世界西侧。摄影机在南侧向北拍时,它可能出现在画面左侧;摄影机调到北侧向南反打时,同一座房子应根据新方向出现在画面右侧。房子没有移动,变化的是摄影机观察方向。
不该入镜的人必须彻底出框
每个镜头都要明确本镜可见主体。画外人物不得因为对立关系、视线关系或台词关系自动出现;如果只允许建筑顶角、肩膀或手部入镜,必须写清位置与露出比例,不能写含糊的“露出一点”。
光源按世界方向延续
光源的世界位置不变,但换机位后,它在画面中的左右以及人物面部的明暗分区需要重新推导。禁止光从人物世界左侧照来,却让无补光依据的世界右侧面部更亮。
人读分镜格式
# <片段编号|标题>
总时长:<N秒>
画幅:<比例>
| 时间 | 景别 / 机位 | 摄影机 | 画面与动作 | 台词 / 声音 |
|---|---|---|---|---|
| 0–Xs | ... | ... | ... | ... |
不输出:
- SEG总账或关系链;
- “怎么接上一镜”;
- 首帧 / 中段 / 尾帧;
exec、entry.*、exit.*或锚点字段;- 翻车点、可改入口或长篇自检;
- 逐镜独立生产包,除非用户明确要求逐镜生成。
正式提示词六大模块
每条正式提示词只使用:
- 一、生成任务
- 二、主要主体
- 三、场景状态
- 四、情绪目标
- 五、视觉风格
- 六、分段脚本
六个标题之后必须写入与当前片段对应的具体正文,形成一整段可复制提示词;不得只给标题、占位符或摘要。最低正文形态为:
【片段编号及标题】
一、生成任务
<时长、画幅、帧率、生成对象、整体连续性任务>
二、主要主体
<人物/生物/道具的身份、外观、初始动作与不可改变特征>
三、场景状态
<固定世界方位、地标、人物与道具位置、实体光源、环境动力>
四、情绪目标
<可由动作、表演和关系变化读出的情绪过程与终点>
五、视觉风格
<摄影、焦段与运动质感、光色、材质、电影风格及适用限制>
六、分段脚本
<先写总体世界方位;再按非等分时间逐段输出具体可见的镜头标题和自然语言画面正文。每段标题必须直接写明景别/焦段/光学、机位方位+高度+俯仰、摄影机中心路径+朝向变化、速度与运动质感、焦点/遮挡接力、镜头任务/动作落点;随后在正文中编译本镜画面布局、人物调度、动作因果、声音台词、光影、环境反馈与终点状态>
[全段硬约束]
<身份、人数、空间、轴线、道具、物理、光源、环境、文字/字幕/BGM和画质负面约束>
分段镜头标题可见性门
用户不应只看到“水与手”“第一次不同步”等剧情短标题。“六、分段脚本”的每个时间段必须使用以下可见结构,并把占位项替换为当前镜头的具体值:
[起始—结束s|景别/焦段/光学|机位方位+高度+俯仰|摄影机中心路径+朝向变化|速度与运动质感|焦点/遮挡接力|镜头任务/动作落点(可选剧情短标题)]
<具体、连续、可见的自然语言画面描述>
- 没有摄影机位移时明确写“固定机位”;没有移焦时明确写“焦点锁定<对象>”,不留空项。
- 复合运镜在同一标题中写出分阶段路径和速度变化,例如“先跟随前移→借遮挡左弧移→升至平视|缓启→加速→遮挡处突停→缓移”。
- 剧情短标题可放在最后辅助识别,但不得代替上述摄影方案。
- 标题负责让用户一眼看出“这一镜怎么拍”;后续正文仍以自然语言说清人物调度、空间投影、物理因果和终点状态,不得只堆叠术语。
数字10十段式信息按以下方式注入:
| 十段式信息 | 六模块位置 |
|---|---|
| ①时长、画幅、帧率 | 一 |
| ②主体与场景 | 二、三 |
| ③动作与事件 | 六 |
| ④摄影机运动 | 五、六 |
| ⑤光影与色彩 | 三、五、六 |
| ⑥材质与物理真实 | 二、三、六 |
| ⑦情绪与电影风格 | 四、五 |
| ⑧最终可见状态 | 六的最后时间段 |
| ⑨声音与台词 | 六的对应时间段 |
| ⑩负面约束 | 六末尾的全段硬约束 |
普通交付不得重复解释这张映射表。
不可妥协项
- “十段式”指数字10。
- 六大模块是唯一可见外层。
- 一个7秒或15秒片段可以包含多个非等分镜头。
- 用户确认的镜头顺序和镜头类型未经授权不得改动。
- 台词逐字保留,除非用户授权改写。
- 台词必须按指定情绪和自然语速验算;装不下时明确指出冲突。
- 接触先于位移,受力先于反应,实体光源先于反光,动作先于环境反馈。
- 禁止人物瞬移、换位、无因果越轴、房间镜像、道具复位、无源光和不该出现的人物。
- 不得虚构平台能力或生成成功。
完成门
交付前内部确认:
镜头没有改写剧本事实、人物目的、动作结果和台词;
能从整段镜头中看出人物行动如何造成剧情或关系变化;
景别、机位、纵深、焦点、运动与剪辑形成镜头句,而不是术语轮换;
复合运镜的起点、触发、分段路径和终点完整,每段都有不同的可见作用;
人读分镜无需工程字段即可理解;
六大模块顺序和数量正确;
数字10十项信息完整;
时间段总和等于总时长;
台词时长与语气能够成立;
每个镜头都能从固定世界状态推出当前画面布局;
换机位后的左右、纵深、遮挡、出框和受光已经重新计算;
人物、场景、道具、光线和环境动力连续。
用户点名提示词或未明确限制为设计稿时,实际交付同时包含五列分镜和写满具体内容的六大模块正文;没有用分析、短镜头句或结构说明替代成品。
用户举出的镜头名称只作说明性证据,没有被误当成固定清单、强制风格或范围上限;实际方案已在相关摄影语法类别中完成扩展判断。
场景需要鲜明镜头设计时,没有因安全、熟悉或容易生成而自动退回普通覆盖;所选镜头的视点、光学、调度、运动或剪辑具有可见作用。
正式交付和调用说明中没有要求用户选择或书写版本号。
用户可见提示词正文没有残留人物、场景、道具的内部编号、文件名、路径、版本、哈希、审批状态或工程字段;全部已翻译为自然名称。
用户点名一条总时长提示词时,六大模块只出现一次并完整覆盖该时长;没有擅自拆成多条重复架构。
有生命的主体具有与剧情和物种相符的连续微动作,但没有借“生活感”擅自增加新剧情、新角色、新道具、新对白或新地点。
用户明确指定某张图作为某场景或某镜头时,实际镜头严格继承该图的摄影机位置、透视、地平线和构图,没有擅自改成门口机位、猫高跟拍或另一套角度;不同空间的行动没有被硬塞进同一镜头。
每个人物或动物的入画、出画和移动路线都来自真实可见的门、通道、遮挡后空间或已建立画外入口;没有从实墙、电视柜、沙发或无入口的画面边缘凭空出现。
“六、分段脚本”的每个时间段标题已直接显示景别/焦段/光学、机位方位+高度+俯仰、摄影机路径+朝向变化、速度质感、焦点/遮挡接力和镜头落点;没有只用剧情短标题代替摄影设计。
分段标题中的摄影参数和调度均为当前镜头的具体值;固定机位和锁定焦点已明写,复合运镜已显示分阶段路径与速度变化,没有空项或内部占位符。
已检查关键动作证据是否在当前构图中足够大、清晰且停留够久;没有等用户提醒才补近距离观察,也没有为凑景别强加特写。
从最终提示词反向还原的机位、视点、光学、路径阶段、焦点/遮挡、速度、切点和落点与选中摄影底稿一致;用词不同但可见行为等价才算保留。
精细动作、人物察觉、焦点交接和终点观看均有可用时间;没有用摄影标题齐全、镜数或术语数量代替动作与观看可行性。
需要作品续接时已实际读取同一源版本的导演记录;已选意图与镜头没有只留在模型临时上下文;当前本场知识正文确已读取。
已分别报告程序约束检查和设计语义审阅的结果;没有拿状态字段、导出回执或文件哈希证明拍法好看、自然语言完全守恒、真实视频可执行或用户接受。
只返回用户要求的创作成果和真正未解决的边界。