# Video Storyboard

> Turn a rough idea into a narrative-driven, shot-by-shot storyboard for AI video generation. Use when the user has a concept, story, script, or theme and needs it structured into shots BEFORE writing platform prompts — covering logline, three-act/beat-sheet pacing, scene value-change, shot language (size/angle/movement/transition), the 180° rule, and the visual-intensity curve. Hand the resulting shot list to video-prompt to render platform-ready prompts, and to video-review to audit it.

- Skill: `wanna-money/video-storyboard` (Agent Skill, multi-file: 7 files)
- Install (CLI): `npx skillmds@latest add wanna-money/video-storyboard`
- Raw SKILL.md: https://api.skillmd.com/api/skills/wanna-money/video-storyboard/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: AI & ML
- License: MIT
- Author: wanna-money (https://skillmd.com/u/wanna-money)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/wanna-money/video-storyboard

---


# Video Storyboard

> 把「一个想法」变成「一份有叙事张力的分镜脚本」。
> 提炼自六本影视经典(《救猫咪》《故事》《电影剧本写作基础》《分镜头脚本设计教程》《影视分镜头设计与应用》《以眼说话》),
> 全部转化为**服务 AI 视频提示词生成**的可操作规则。

---

## 这个 skill 解决什么

AI 视频模型逐镜头独立生成,**它不会替你讲故事**。你给它的每个镜头都是一张独立的"施工图"。
本 skill 只负责**分镜层**:把创意拆成有张力、能拼接、镜头语言正确的 shot list——不管平台语法。

> 分镜阶段的核心判据(《分镜头脚本设计教程》):关注的**不是单镜画质,而是场景的流畅性与如何用镜头表现内心**。
> 画质交给模型和 `video-prompt`;镜头逻辑与叙事张力,是这一层的职责。

**三件套协作**:
```
video-storyboard(本 skill)  →  产出分镜表(shot list)
       ↓
video-prompt                →  把每个镜头翻译成平台提示词(Seedance/Sora/Kling…)
       ↓
video-review                →  多视角审查分镜与提示词
```

---

## 工作流总览

六个阶段顺序推进,但**短视频(≤15s)可跳过阶段二、三的展开,直接用精简模板**:

```
阶段一:立意定调   → 一句话概述 + 类型 + 情感目标 + 时长
阶段二:叙事结构   → 节拍表(三幕/beat sheet),按百分比分配时间
阶段三:场景设计   → 每个镜头填 价值转变(+/-) + 冲突(><)
阶段四:镜头语言   → 景别/角度/运镜/转场 + 轴线/视线锁定
阶段五:视觉强度   → 张力曲线 ↔ 视觉曲线(对比与相似)
阶段六:分镜定稿   → 两阶段卡片法 + 一致性锁定,输出 shot list
```

各阶段的详细依据见 `references/`,速查表和模板见 `assets/`。

---

## 阶段一:立意定调

**动笔前必须先写一句话概述。** 三本编剧书(《救猫咪》《故事》《电影剧本写作基础》)在这一点上完全一致:
写不出一句话,说明创意本身没有戏,再漂亮的镜头也是浪费。

### 一句话概述公式

```
一个[性格形容词]的[主体],为了[原始欲望],
在[环境/处境]中,对抗[比他略强的障碍/对手]。
```

- **性格形容词**(《救猫咪》):"一个**谨小慎微**的老师"胜过"一个老师"。形容词注入动机与神态,直接决定模型生成的表演。
- **原始欲望**(《救猫咪》"原始驱动力"):生存 / 饥饿 / 保护所爱 / 复仇 / 求偶 / 对死亡的恐惧。**AI 视频只有几秒,没时间解释复杂动机**——只有原始欲望能瞬间被看懂。
- **反向测试**:抽掉原始欲望后创意是否立刻塌掉?若无损失,说明选题不成立,回去改。

### 四要素自检(改编自 logline 四要素)

```
[ ] 反讽/钩子:有没有一个"意料之外"的冲突点?
[ ] 脑补画面:读完能立刻"看见"画面吗?时间跨度清楚吗?
[ ] 受众与成本:给谁看?几秒?什么平台/分辨率?
[ ] 标题/首帧:说清内容又不平庸吗?
```

### 确定情感目标与时长

- **情感目标**:观众看完应该感到什么?(燃/心疼/惊悚/治愈/会心一笑)——这决定后续视觉基调。
- **时长**:直接决定镜头数量与节拍密度(见阶段二换算表)。

详见 → `references/story-structure.md`(类型速查、原始驱动力、救猫咪时刻)

---

## 阶段二:叙事结构

详见 → `references/story-structure.md`

**核心洞察(《救猫咪》《电影剧本写作基础》共识)**:叙事节拍的**内部比例不变**,因此可等比缩放到任意时长。
这是唯一能解决"多镜头视频如何分配时间"的工具。

### 节拍时间表(长度无关)

| 节拍 | 占比 | 15s | 30s | 60s |
|---|---|---|---|---|
| 开场画面 | 0% | 0s | 0s | 0s |
| **触发事件**(打破日常) | **11%** | **~1.7s** | **~3.3s** | **~6.6s** |
| 进入第二幕(主体主动出发) | 23% | ~3.5s | ~7s | ~14s |
| **中点**(假胜利/假失败,升级) | **50%** | **7.5s** | **15s** | **30s** |
| **失去一切**(最低点) | **68%** | **~10s** | **~20s** | **~41s** |
| 进入第三幕(找到解法) | 77% | ~11.5s | ~23s | ~46s |
| 终场画面(与开场相反) | 100% | 15s | 30s | 60s |

### 极短视频(≤15s)最小节拍集

```
开场画面(0%) → 触发事件(11%) → 中点(50%) → 失去一切(68%) → 终场画面(100%)
```

### 三条铁律

1. **触发事件必须准时**:打破日常的那一刻在 11% 处——短视频里就是**前 1–2 秒**。晚了观众就走。
2. **开场画面 ↔ 终场画面必须成对且相反**。这是"用最少镜头讲完一个故事"的最省力手段。若设计不出末镜,说明中段没发生变化。
3. **主体必须主动进入第二幕**(《救猫咪》):不能被诱骗、被拖着走。避免"他被卷入/他发现自己身处",改为"他推开门/他抓住绳索"。

### 先定结尾,再定开头

《电影剧本写作基础》铁律:动笔前先确定四件事,顺序不可颠倒——**结尾 → 开端 → 情节点I → 情节点II**。
分镜表**从最后一镜开始填**,再倒推第一镜。首尾共享同一视觉元素(同地点/同道具/同构图),既提升完成度又强化一致性。

---

## 阶段三:场景设计

详见 → `references/story-structure.md`(场景价值转变一节)

**这是本 skill 最硬的工具**:把"这个镜头有没有戏"变成可判定问题。三本编剧书用了三套等价符号,收敛为两个必填字段:

### 每个镜头必填两格

| 字段 | 符号 | 判据 | 填不出的后果 |
|---|---|---|---|
| **价值转变** | `+/-` | 这一镜开始时的情绪极性 → 结束时的情绪极性,**且两者相反** | 镜头没有事件,删除或合并 |
| **冲突** | `><` | 谁 vs 谁/什么,谁赢,**只能一个冲突** | 镜头没有戏,删除或合并 |

> 等价表述:《故事》= "场景=价值转变";《电影剧本写作基础》= "需求(need)+ 障碍(obstacle)"。三者是同一件事。

**硬规则(《救猫咪》原文)**:想不清 `+/-` 和 `><` 之前,不要写这个镜头。想不清,就把它删了——很可能它本身就有问题。

### gap 引擎:让镜头不无聊(《故事》最锋利的贡献)

每个镜头 = `主体的保守动作 → 世界的意外反应`。**AI 模型的默认输出就是"预期反应"**,所以镜头生成出来"很动但无聊"。
生成 gap 的方法是机械的:

```
1. 写下主体的动作
2. 写下最符合预期的默认反应
3. 把它反转 —— "那个反应的对立面是什么?"
```

麦基的诊断:一个人敲门、门就直接开了 = "八秒钟的死镜头",剪辑师会剪掉。

### show don't tell:镜头只拍可拍摄的东西

《电影剧本写作基础》判据:**这句话能被摄影机拍到吗?** 想法/回忆/心情/身份/关系都不能直接拍。
把每一个抽象表述改写成一个**可拍摄的动作或道具**:

| 想表达(抽象) | 改写为(可拍) |
|---|---|
| 他很痛苦 | 猛击墙壁→踢翻纸篓→贴墙下滑 |
| 夫妻关系出问题 | 丈夫的目光追着路过的年轻女子 |
| 他曾是职业球员 | 墙上的球队合影 + 他走路一瘸一拐 |
| 陷入回忆 | 镜头落在他失焦的眼神特写,再切闪回 |

---

## 阶段四:镜头语言

详见 → `references/shot-language.md`(景别/角度/运镜/转场/轴线完整速查)

为阶段三定稿的每个镜头补齐技术要素。**这些术语在 `video-prompt` 阶段会直接翻译成提示词字段。**

### 每镜必填的镜头语言字段

```
景别:  远景/全景/中景/近景/特写/大特写(远→近对应 环境→情绪)
角度:  平视/仰视(权威)/俯视(弱势)/荷兰角(不安)/鸟瞰(命运)
运镜:  推/拉/摇/移/跟/升降/固定 + 明确方向(左→右)。一镜只一个运镜。
转场:  硬切/淡出/关联剪辑(match cut)/跳接/蒙太奇 —— 与上一镜的衔接方式
```

### 四条镜头语言铁律(AI 视频专属)

1. **每镜显式声明屏幕方向**(轴线/180°准则)。AI 逐镜生成不记得上一镜朝向,对话戏必须在**每条**提示词重申"A 在画面左、面朝右;B 在右、面朝左"。这是最高频、最少被提及的错误。
2. **视线高度也要锁定**。与跳轴并列的隐形杀手,写明"两人视线水平齐平"。
3. **优先用"安全镜头"**。模型在典型镜头模式上训练最充分。对话戏默认 = 特写 + 双人镜头 + 过肩镜头。炫技运镜(眩晕效果、复合运镜)= 高失败率,拆成两镜或改写成视觉结果描述。
4. **一镜一动作 + 明确方向**。景别递进走**宽→中→特写**,禁止宽→特写直跳。

### 情绪 → 镜头对照表(节选,完整见 references)

| 想表达 | 景别 | 角度 | 运镜/构图 |
|---|---|---|---|
| 角色地位高/登场 | 中景~全景 | 仰视 | 置于画面上方 |
| 弱势/孤独 | 全景~中景 | 俯视 | 大量留白包围 |
| 内心情绪/亲近 | 脸部特写 | 平视 | 排除其他一切 |
| 紧张/速度 | 一组紧凑特写 | — | 快切 |
| 不安/险境 | 任意 | 荷兰角 | 有意失衡 |
| 时间流逝/过程 | 混合景别 | 变化 | 蒙太奇(无台词) |

---

## 阶段五:视觉强度

详见 → `references/visual-aesthetics.md`(对比与相似、七大视觉元素、视觉强度曲线)

**核心法则(《以眼说话》)**:视觉强度 = **对比(增张力)与相似(减张力)**。而且——**视觉张力曲线必须叠在故事张力曲线之下**,同步起伏。

### 做法:把视觉曲线画在故事曲线下

1. 阶段二已排出故事节拍;为每个镜头标注它在张力曲线上的位置。
2. 为每个视觉元素选一种形式:
   - **恒定**(全片不变,保证统一性)
   - **渐变**(缓慢变化,与人物弧光同步)
   - **对比与相似**(随冲突跳变,制造张力峰值)
3. **高潮镜头增加对比**(斜线、纵深、影调极值、冷暖跳变、三维运镜、不规则节奏);**结局镜头增加相似**。
4. **保持简单**:大部分元素设为"恒定",只让 1–3 个元素承担张力变化。太多元素同时变,模型难控、观众难懂。

### 单镜视觉强度杠杆(按增益排序)

- **升强度**:斜线 > 垂直 > 水平;三维运镜/快速变焦;纵深或模糊空间;影调纯黑对纯白;互补色并置;不规则快节奏;手持/倾斜。
- **降强度**:水平线条+水平运动;二维运镜;影调压缩;单一色相/去饱和;规则平缓节奏;固定机位。

### 竖屏/小屏特别注意

AI 视频常做竖屏短片。**小屏几乎无法表现纵深与运动连续性**——改用**影调、色彩、节奏**承担张力,不要依赖景深和复杂运镜。

---

## 阶段六:分镜定稿

详见 → `references/storyboard-workflow.md`,模板 → `assets/storyboard-template.md`

### 两阶段卡片法(《救猫咪》演示板 + 《电影剧本写作基础》3×5 卡片)

**不要一上来就写长提示词** —— 结构还没定就写细节,无法调整。分两步:

```
第一步:极简卡片表(一行一镜,每镜几个字)
        → 排列顺序,检查流程是否通顺,自由增删重排
第二步:用户确认结构后,再展开成完整分镜(补齐镜头语言 + 价值转变 + 视觉)
```

### 关键帧摘取法(《分镜头脚本设计教程》)——文字→分镜的机械算法

```
Step 1  把创意逐句/逐动作编号,得到"候选镜头列表"(尽量细,如12个)
Step 2  按"是否承载叙事"筛减:砍掉过场,用音效替代画外事件,该并的并
        → 得到最终镜头表(如6个)
Step 3  为每个保留的镜头补齐技术要素
Step 4  补上"分内工作":交待镜头、跳离镜头、关联剪辑元素(剧本里都没有,但必须加)
```

### 镜头数量参考

| 时长 | 镜头数 | 结构 |
|---|---|---|
| ≤15s | 3–5 | 起/转/落 |
| 30s | 6–10 | 四段各 1.5–2.5 |
| 60s | 10–16 | 四段各 2.5–4 |
| 广告/短视频 | 6–30(常见~20) | 见 references |

> 数量偏离太多说明有问题:过多是段落被拆碎,过少是有"剧情黑洞"。

### 短视频默认骨架(广告类,《分镜头脚本设计教程》橙汁广告结构)

```
① 定场镜头   宽镜头,交待地点与时间(每个新场景第一镜必须是它)
② 状态/介绍  中景,主体登场 + 核心物件首次出现
③ 状态       过肩镜头,引入第二方
④ 动作       反转镜头(回应③),关键事件发生,严守180°
⑤ 结论       事件结果
⑥ 收尾       产品展示/首尾呼应镜头
```

### 一致性锁定区(分镜表顶部,每条提示词都携带)

- **角色锁**:姓名 → 身体特质、发型、服装 + 一个"跛脚和眼罩"式独特视觉标记,每镜复述
- **场景锁**:地点 → 环境要素、光源位置
- **风格锁**:摄影风格、色彩组合
- **方向锁**:屏幕方向、视线高度
- **光线锁**:统一光线方向与色温

### 标记高风险镜头

大幅运动 / 复杂多人交互 / 特效镜头 → 交给 `video-prompt` 时特别标注,准备降级方案(拆分、简化、改特写规避)。

---

## 输出格式

分镜定稿后,输出结构化 shot list,供 `video-prompt` 消费:

```
# 分镜脚本:[标题]

## 立意
一句话概述:[...]
类型 / 情感目标 / 时长 / 目标平台:[...]

## 一致性锁定
角色锁 / 场景锁 / 风格锁 / 方向锁 / 光线锁

## 分镜表
| 镜号 | 时长 | 节拍位置 | 内/外·地点·时间 | 景别 | 角度 | 屏幕方向 | 运镜 | 画面动作(一镜一动作) | +/- | >< | 音效 | 与上镜切换 | 视觉强度 | 风险 |
|------|------|---------|----------------|------|------|---------|------|----------------------|-----|-----|------|-----------|---------|------|
| 1 | ... |

## 交接说明
[给 video-prompt 的备注:高风险镜头、需参考图的镜头、平台特殊要求]
```

---

## 子 Agent 协作(可选加速)

若当前环境已注册 `storyboard-director` 子 agent(插件 `agents/` 目录自动加载),可在阶段二~六委派结构设计:

```
Agent(subagent_type: "storyboard-director", prompt: "为[创意]设计N镜分镜,时长Xs,参照video-storyboard方法论")
```

**降级规则**:Agent 不可用或 spawn 失败时,主线程直接按本文件执行,不阻塞流程。

---

## 完成之后

分镜定稿后,按顺序衔接:
1. `video-prompt` — 把每个镜头翻译成目标平台的提示词(Seedance/Sora/Kling…)
2. `video-review` — 多视角审查(结构/镜头语言/视觉/一致性),按报告返回本 skill 修改

---

## 参考文档索引

| 文件 | 内容 | 何时读 |
|------|------|--------|
| `references/story-structure.md` | 三幕/15节拍、场景价值转变、gap引擎、类型速查、show don't tell | 阶段一~三 |
| `references/shot-language.md` | 景别/角度/运镜/转场完整速查、轴线180°、安全镜头、情绪→镜头表 | 阶段四 |
| `references/visual-aesthetics.md` | 对比与相似、七大视觉元素、视觉强度曲线、类型片视觉配方 | 阶段五 |
| `references/storyboard-workflow.md` | 关键帧摘取法、卡片法、镜头数量、一致性锁定、高风险镜头 | 阶段六 |
| `assets/storyboard-template.md` | 分镜表模板(含 +/- 与 >< 列) | 阶段六 |
| `assets/beat-sheet-template.md` | 节拍表模板(时长换算) | 阶段二 |

