Video Storyboard
把「一个想法」变成「一份有叙事张力的分镜脚本」。 提炼自六本影视经典(《救猫咪》《故事》《电影剧本写作基础》《分镜头脚本设计教程》《影视分镜头设计与应用》《以眼说话》), 全部转化为服务 AI 视频提示词生成的可操作规则。
这个 skill 解决什么
AI 视频模型逐镜头独立生成,它不会替你讲故事。你给它的每个镜头都是一张独立的"施工图"。 本 skill 只负责分镜层:把创意拆成有张力、能拼接、镜头语言正确的 shot list——不管平台语法。
分镜阶段的核心判据(《分镜头脚本设计教程》):关注的不是单镜画质,而是场景的流畅性与如何用镜头表现内心。 画质交给模型和
video-prompt;镜头逻辑与叙事张力,是这一层的职责。
三件套协作:
video-storyboard(本 skill) → 产出分镜表(shot list)
↓
video-prompt → 把每个镜头翻译成平台提示词(Seedance/Sora/Kling…)
↓
video-review → 多视角审查分镜与提示词
工作流总览
六个阶段顺序推进,但短视频(≤15s)可跳过阶段二、三的展开,直接用精简模板:
阶段一:立意定调 → 一句话概述 + 类型 + 情感目标 + 时长
阶段二:叙事结构 → 节拍表(三幕/beat sheet),按百分比分配时间
阶段三:场景设计 → 每个镜头填 价值转变(+/-) + 冲突(><)
阶段四:镜头语言 → 景别/角度/运镜/转场 + 轴线/视线锁定
阶段五:视觉强度 → 张力曲线 ↔ 视觉曲线(对比与相似)
阶段六:分镜定稿 → 两阶段卡片法 + 一致性锁定,输出 shot list
各阶段的详细依据见 references/,速查表和模板见 assets/。
阶段一:立意定调
动笔前必须先写一句话概述。 三本编剧书(《救猫咪》《故事》《电影剧本写作基础》)在这一点上完全一致: 写不出一句话,说明创意本身没有戏,再漂亮的镜头也是浪费。
一句话概述公式
一个[性格形容词]的[主体],为了[原始欲望],
在[环境/处境]中,对抗[比他略强的障碍/对手]。
- 性格形容词(《救猫咪》):"一个谨小慎微的老师"胜过"一个老师"。形容词注入动机与神态,直接决定模型生成的表演。
- 原始欲望(《救猫咪》"原始驱动力"):生存 / 饥饿 / 保护所爱 / 复仇 / 求偶 / 对死亡的恐惧。AI 视频只有几秒,没时间解释复杂动机——只有原始欲望能瞬间被看懂。
- 反向测试:抽掉原始欲望后创意是否立刻塌掉?若无损失,说明选题不成立,回去改。
四要素自检(改编自 logline 四要素)
[ ] 反讽/钩子:有没有一个"意料之外"的冲突点?
[ ] 脑补画面:读完能立刻"看见"画面吗?时间跨度清楚吗?
[ ] 受众与成本:给谁看?几秒?什么平台/分辨率?
[ ] 标题/首帧:说清内容又不平庸吗?
确定情感目标与时长
- 情感目标:观众看完应该感到什么?(燃/心疼/惊悚/治愈/会心一笑)——这决定后续视觉基调。
- 时长:直接决定镜头数量与节拍密度(见阶段二换算表)。
详见 → references/story-structure.md(类型速查、原始驱动力、救猫咪时刻)
阶段二:叙事结构
详见 → references/story-structure.md
核心洞察(《救猫咪》《电影剧本写作基础》共识):叙事节拍的内部比例不变,因此可等比缩放到任意时长。 这是唯一能解决"多镜头视频如何分配时间"的工具。
节拍时间表(长度无关)
| 节拍 | 占比 | 15s | 30s | 60s |
|---|---|---|---|---|
| 开场画面 | 0% | 0s | 0s | 0s |
| 触发事件(打破日常) | 11% | ~1.7s | ~3.3s | ~6.6s |
| 进入第二幕(主体主动出发) | 23% | ~3.5s | ~7s | ~14s |
| 中点(假胜利/假失败,升级) | 50% | 7.5s | 15s | 30s |
| 失去一切(最低点) | 68% | ~10s | ~20s | ~41s |
| 进入第三幕(找到解法) | 77% | ~11.5s | ~23s | ~46s |
| 终场画面(与开场相反) | 100% | 15s | 30s | 60s |
极短视频(≤15s)最小节拍集
开场画面(0%) → 触发事件(11%) → 中点(50%) → 失去一切(68%) → 终场画面(100%)
三条铁律
- 触发事件必须准时:打破日常的那一刻在 11% 处——短视频里就是前 1–2 秒。晚了观众就走。
- 开场画面 ↔ 终场画面必须成对且相反。这是"用最少镜头讲完一个故事"的最省力手段。若设计不出末镜,说明中段没发生变化。
- 主体必须主动进入第二幕(《救猫咪》):不能被诱骗、被拖着走。避免"他被卷入/他发现自己身处",改为"他推开门/他抓住绳索"。
先定结尾,再定开头
《电影剧本写作基础》铁律:动笔前先确定四件事,顺序不可颠倒——结尾 → 开端 → 情节点I → 情节点II。 分镜表从最后一镜开始填,再倒推第一镜。首尾共享同一视觉元素(同地点/同道具/同构图),既提升完成度又强化一致性。
阶段三:场景设计
详见 → references/story-structure.md(场景价值转变一节)
这是本 skill 最硬的工具:把"这个镜头有没有戏"变成可判定问题。三本编剧书用了三套等价符号,收敛为两个必填字段:
每个镜头必填两格
| 字段 | 符号 | 判据 | 填不出的后果 |
|---|---|---|---|
| 价值转变 | +/- |
这一镜开始时的情绪极性 → 结束时的情绪极性,且两者相反 | 镜头没有事件,删除或合并 |
| 冲突 | >< |
谁 vs 谁/什么,谁赢,只能一个冲突 | 镜头没有戏,删除或合并 |
等价表述:《故事》= "场景=价值转变";《电影剧本写作基础》= "需求(need)+ 障碍(obstacle)"。三者是同一件事。
硬规则(《救猫咪》原文):想不清 +/- 和 >< 之前,不要写这个镜头。想不清,就把它删了——很可能它本身就有问题。
gap 引擎:让镜头不无聊(《故事》最锋利的贡献)
每个镜头 = 主体的保守动作 → 世界的意外反应。AI 模型的默认输出就是"预期反应",所以镜头生成出来"很动但无聊"。
生成 gap 的方法是机械的:
1. 写下主体的动作
2. 写下最符合预期的默认反应
3. 把它反转 —— "那个反应的对立面是什么?"
麦基的诊断:一个人敲门、门就直接开了 = "八秒钟的死镜头",剪辑师会剪掉。
show don't tell:镜头只拍可拍摄的东西
《电影剧本写作基础》判据:这句话能被摄影机拍到吗? 想法/回忆/心情/身份/关系都不能直接拍。 把每一个抽象表述改写成一个可拍摄的动作或道具:
| 想表达(抽象) | 改写为(可拍) |
|---|---|
| 他很痛苦 | 猛击墙壁→踢翻纸篓→贴墙下滑 |
| 夫妻关系出问题 | 丈夫的目光追着路过的年轻女子 |
| 他曾是职业球员 | 墙上的球队合影 + 他走路一瘸一拐 |
| 陷入回忆 | 镜头落在他失焦的眼神特写,再切闪回 |
阶段四:镜头语言
详见 → references/shot-language.md(景别/角度/运镜/转场/轴线完整速查)
为阶段三定稿的每个镜头补齐技术要素。这些术语在 video-prompt 阶段会直接翻译成提示词字段。
每镜必填的镜头语言字段
景别: 远景/全景/中景/近景/特写/大特写(远→近对应 环境→情绪)
角度: 平视/仰视(权威)/俯视(弱势)/荷兰角(不安)/鸟瞰(命运)
运镜: 推/拉/摇/移/跟/升降/固定 + 明确方向(左→右)。一镜只一个运镜。
转场: 硬切/淡出/关联剪辑(match cut)/跳接/蒙太奇 —— 与上一镜的衔接方式
四条镜头语言铁律(AI 视频专属)
- 每镜显式声明屏幕方向(轴线/180°准则)。AI 逐镜生成不记得上一镜朝向,对话戏必须在每条提示词重申"A 在画面左、面朝右;B 在右、面朝左"。这是最高频、最少被提及的错误。
- 视线高度也要锁定。与跳轴并列的隐形杀手,写明"两人视线水平齐平"。
- 优先用"安全镜头"。模型在典型镜头模式上训练最充分。对话戏默认 = 特写 + 双人镜头 + 过肩镜头。炫技运镜(眩晕效果、复合运镜)= 高失败率,拆成两镜或改写成视觉结果描述。
- 一镜一动作 + 明确方向。景别递进走宽→中→特写,禁止宽→特写直跳。
情绪 → 镜头对照表(节选,完整见 references)
| 想表达 | 景别 | 角度 | 运镜/构图 |
|---|---|---|---|
| 角色地位高/登场 | 中景~全景 | 仰视 | 置于画面上方 |
| 弱势/孤独 | 全景~中景 | 俯视 | 大量留白包围 |
| 内心情绪/亲近 | 脸部特写 | 平视 | 排除其他一切 |
| 紧张/速度 | 一组紧凑特写 | — | 快切 |
| 不安/险境 | 任意 | 荷兰角 | 有意失衡 |
| 时间流逝/过程 | 混合景别 | 变化 | 蒙太奇(无台词) |
阶段五:视觉强度
详见 → references/visual-aesthetics.md(对比与相似、七大视觉元素、视觉强度曲线)
核心法则(《以眼说话》):视觉强度 = 对比(增张力)与相似(减张力)。而且——视觉张力曲线必须叠在故事张力曲线之下,同步起伏。
做法:把视觉曲线画在故事曲线下
- 阶段二已排出故事节拍;为每个镜头标注它在张力曲线上的位置。
- 为每个视觉元素选一种形式:
- 恒定(全片不变,保证统一性)
- 渐变(缓慢变化,与人物弧光同步)
- 对比与相似(随冲突跳变,制造张力峰值)
- 高潮镜头增加对比(斜线、纵深、影调极值、冷暖跳变、三维运镜、不规则节奏);结局镜头增加相似。
- 保持简单:大部分元素设为"恒定",只让 1–3 个元素承担张力变化。太多元素同时变,模型难控、观众难懂。
单镜视觉强度杠杆(按增益排序)
- 升强度:斜线 > 垂直 > 水平;三维运镜/快速变焦;纵深或模糊空间;影调纯黑对纯白;互补色并置;不规则快节奏;手持/倾斜。
- 降强度:水平线条+水平运动;二维运镜;影调压缩;单一色相/去饱和;规则平缓节奏;固定机位。
竖屏/小屏特别注意
AI 视频常做竖屏短片。小屏几乎无法表现纵深与运动连续性——改用影调、色彩、节奏承担张力,不要依赖景深和复杂运镜。
阶段六:分镜定稿
详见 → references/storyboard-workflow.md,模板 → assets/storyboard-template.md
两阶段卡片法(《救猫咪》演示板 + 《电影剧本写作基础》3×5 卡片)
不要一上来就写长提示词 —— 结构还没定就写细节,无法调整。分两步:
第一步:极简卡片表(一行一镜,每镜几个字)
→ 排列顺序,检查流程是否通顺,自由增删重排
第二步:用户确认结构后,再展开成完整分镜(补齐镜头语言 + 价值转变 + 视觉)
关键帧摘取法(《分镜头脚本设计教程》)——文字→分镜的机械算法
Step 1 把创意逐句/逐动作编号,得到"候选镜头列表"(尽量细,如12个)
Step 2 按"是否承载叙事"筛减:砍掉过场,用音效替代画外事件,该并的并
→ 得到最终镜头表(如6个)
Step 3 为每个保留的镜头补齐技术要素
Step 4 补上"分内工作":交待镜头、跳离镜头、关联剪辑元素(剧本里都没有,但必须加)
镜头数量参考
| 时长 | 镜头数 | 结构 |
|---|---|---|
| ≤15s | 3–5 | 起/转/落 |
| 30s | 6–10 | 四段各 1.5–2.5 |
| 60s | 10–16 | 四段各 2.5–4 |
| 广告/短视频 | 6–30(常见~20) | 见 references |
数量偏离太多说明有问题:过多是段落被拆碎,过少是有"剧情黑洞"。
短视频默认骨架(广告类,《分镜头脚本设计教程》橙汁广告结构)
① 定场镜头 宽镜头,交待地点与时间(每个新场景第一镜必须是它)
② 状态/介绍 中景,主体登场 + 核心物件首次出现
③ 状态 过肩镜头,引入第二方
④ 动作 反转镜头(回应③),关键事件发生,严守180°
⑤ 结论 事件结果
⑥ 收尾 产品展示/首尾呼应镜头
一致性锁定区(分镜表顶部,每条提示词都携带)
- 角色锁:姓名 → 身体特质、发型、服装 + 一个"跛脚和眼罩"式独特视觉标记,每镜复述
- 场景锁:地点 → 环境要素、光源位置
- 风格锁:摄影风格、色彩组合
- 方向锁:屏幕方向、视线高度
- 光线锁:统一光线方向与色温
标记高风险镜头
大幅运动 / 复杂多人交互 / 特效镜头 → 交给 video-prompt 时特别标注,准备降级方案(拆分、简化、改特写规避)。
输出格式
分镜定稿后,输出结构化 shot list,供 video-prompt 消费:
# 分镜脚本:[标题]
## 立意
一句话概述:[...]
类型 / 情感目标 / 时长 / 目标平台:[...]
## 一致性锁定
角色锁 / 场景锁 / 风格锁 / 方向锁 / 光线锁
## 分镜表
| 镜号 | 时长 | 节拍位置 | 内/外·地点·时间 | 景别 | 角度 | 屏幕方向 | 运镜 | 画面动作(一镜一动作) | +/- | >< | 音效 | 与上镜切换 | 视觉强度 | 风险 |
|------|------|---------|----------------|------|------|---------|------|----------------------|-----|-----|------|-----------|---------|------|
| 1 | ... |
## 交接说明
[给 video-prompt 的备注:高风险镜头、需参考图的镜头、平台特殊要求]
子 Agent 协作(可选加速)
若当前环境已注册 storyboard-director 子 agent(插件 agents/ 目录自动加载),可在阶段二~六委派结构设计:
Agent(subagent_type: "storyboard-director", prompt: "为[创意]设计N镜分镜,时长Xs,参照video-storyboard方法论")
降级规则:Agent 不可用或 spawn 失败时,主线程直接按本文件执行,不阻塞流程。
完成之后
分镜定稿后,按顺序衔接:
video-prompt— 把每个镜头翻译成目标平台的提示词(Seedance/Sora/Kling…)video-review— 多视角审查(结构/镜头语言/视觉/一致性),按报告返回本 skill 修改
参考文档索引
| 文件 | 内容 | 何时读 |
|---|---|---|
references/story-structure.md |
三幕/15节拍、场景价值转变、gap引擎、类型速查、show don't tell | 阶段一~三 |
references/shot-language.md |
景别/角度/运镜/转场完整速查、轴线180°、安全镜头、情绪→镜头表 | 阶段四 |
references/visual-aesthetics.md |
对比与相似、七大视觉元素、视觉强度曲线、类型片视觉配方 | 阶段五 |
references/storyboard-workflow.md |
关键帧摘取法、卡片法、镜头数量、一致性锁定、高风险镜头 | 阶段六 |
assets/storyboard-template.md |
分镜表模板(含 +/- 与 >< 列) | 阶段六 |
assets/beat-sheet-template.md |
节拍表模板(时长换算) | 阶段二 |