# Doubao Creative Drama

> 当用户提出短篇短剧、动画短片、微电影、剧情视频、AI视频、影视化短片、动态漫、宣传片、预告片等**单集 5-10 分钟以内**的短篇制作需求，或包含"做个短剧"、"拍个微电影"、"弄个动画短片"、"写个短剧剧本"、"画个分镜"、"搞个人设/场景资产"、"出个关键帧"、"写图生视频提示词/Seedance提示词"等表达时调用。适用于需要按"规划-剧本-分镜-资产-关键帧-视频生成"推进完整视频生产流程的短篇场景。**不承接几十集连续短剧、长篇商用短剧、连续剧、连续番剧的完整制作**；如遇此类需求，明确声明本 skill 边界并建议用户使用专门的长篇短剧工具或分批下单。

- Skill: `ahang1598/doubao-creative-drama` (Agent Skill, multi-file: 6 files)
- Install (CLI): `npx skillmds add ahang1598/doubao-creative-drama`
- Raw SKILL.md: https://api.skillmd.com/api/skills/ahang1598/doubao-creative-drama/raw
- Safety review: pending (external: skill-scanner PASS, skillspector PASS)
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: ahang1598 (https://skillmd.com/u/ahang1598)
- Updated: 2026-08-19
- Page: https://skillmd.com/skills/ahang1598/doubao-creative-drama

---


# 短篇短剧视频全流程

## 定位

本 skill 是**短篇短剧 / 剧情短片**生成的主规划入口，承接**单集 5-10 分钟以内**的短篇制作，负责按固定流程路由任务：

```text
planner -> scriptwriter -> storyboard -> assets -> frame -> prompt
```

`planner` 就是当前主 `SKILL.md`。其它阶段按需读取 refs：

| 阶段 | 读取文件 |
|---|---|
| scriptwriter | `references/scriptwriter.md` |
| storyboard | `references/storyboard.md` |
| assets | `references/assets.md` |
| frame | `references/frame.md` |
| prompt | `references/prompt.md` |

阶段之间存在依赖，推荐按上述顺序推进；发现上游依赖缺失时，回到最早缺失的阶段补齐再继续，通常比往后硬推更省事。

## 承接边界

- **主承接**：单集 5-10 分钟以内的短篇短剧、微电影、剧情短片、动画短片、宣传片、预告片、广告剧情、单条剧情短视频。
- **可承接（建议同步声明幻觉风险）**：多集/长篇短剧的完整剧本创作。剧本阶段可以承接生成，但集数超过 10 集时较易出现剧情漂移与人设漂移，生成前建议一次性向用户告知这一风险，并在剧情梗概之外附一份分集大纲以降低漂移概率（详见 `references/scriptwriter.md` 的声明模板与"长篇分集大纲附表"要求）。**长篇完整剧本推荐按"首批 3-5 集 → 用户确认 → 下一批"分批输出，不建议一次性输出全部剧集**。
- 长篇短剧诉求也可以主动建议用户拆成独立短篇/单集样片下单，或改用专门的长篇短剧生产工具，以更彻底地规避漂移风险。
- 无论短篇还是长篇，剧本创作阶段建议交付**"剧情梗概（约 1500 字）→ 人物小传（主角/配角/反派）→ 主要故事场景（2-4 个短篇 / 4-8 个长篇）→ 完整剧本（分集分场专业格式）"四段产物**，缺任何一段都会影响下游对齐；完整剧本的场景推荐从产物三"主要故事场景"清单中选取，如遇例外应先回填清单再继续。

## 核心规则

- 当用户要求生成视频时，**必须先澄清并确认以下基础参数再动手**，不得跳过参数确认直接调用视频生成工具：
 - 时长：单段视频长度。**当前项目侧全局锁定 15s**（下游生视频模型仅支持 15s，无需向用户澄清），30s 作为项目侧预留分支保留在下游 refs 中，未来模型支持 30s 后由项目侧统一切换。
 - 当用户调用image_video且task_type=r2v，比例支持：'16:9','4:3','1:1','3:4','9:16','21:9'
 - 当用户调用image_video且task_type=f2v，比例仅支持保持原比例，如果用户要求调整，需向用户说明。
 - 生成详细内容：画面主体、动作、场景、风格、镜头运动、情绪氛围、文字、声音或其他限制。
 - 一次最多生成2个视频，**超出必须先与用户澄清"一次仅能生成两个视频"**。
 - **即时输出原则**：在资产设定（如角色设定图、场景图等）和视频生成阶段，**每生成完一张图或一个视频，建议立即将其展示并返回给用户**，不建议等待所有图片或所有视频全部生成完毕后再统一打包返回。
 - **图片质量审查原则**：完成任何一个阶段的图片生成后，建议检查图片是否存在问题：
   - **人设图审查**：重点审查左侧面部特写是否是正脸，三视图是否与左侧面部特征保持一致，三视角是否是同一个人物。
   - **关键帧审查**：重点审查画面是否和对应剧情对得上，人物、场景、道具是否和资产设定图中的对应特征对得上。
 - **角色形象变化资产更新原则（强制）**：随着剧情进展，如果人物形象发生较大变化（如换装、发型变化、受伤/毁容、年龄阶段变化、身份伪装、盔甲/制服/礼服等关键造型变化），**必须先重新生成对应阶段的角色资产设定图并经用户明确确认后，再继续生成后续关键帧或视频**；禁止直接沿用旧资产图硬套新造型。
 - **【强制】图片输出统一使用 Markdown 图片格式**：所有阶段（人设图、场景图、道具图、关键帧图等）生成的图片，**必须**以 Markdown 图片语法（`![描述](图片URL或本地路径)`）在对话中直接呈现给用户；不得仅返回 URL 文本、附件链接或纯文件路径，也不得用 HTML `<img>` 标签替代。
 - **【强制】视频生成结果必须通过 `notify_human` 工具输出**：无论 `text_to_video` / `image_to_video`、UGC / marketing / corporate，任何视频生成结果交付前**必须调用 `notify_human` 工具**上屏视频本体，禁止以纯 Markdown 链接、`<video>` 标签、裸 URL 或总结文案替代；`notify_human` 入参必须包含可渲染的视频资源本体（`video_url/output_url/url/result_url` 或本地视频路径）。
 - **【强制】资产设定阶段分批确认顺序**：资产设定阶段**必须严格按以下顺序分批生成并逐批等待用户明确确认**，禁止合并生成或跳批推进：
   1. **主角设定图**：先生成主角人设图（含左侧正脸特写 + 三视图），输出后停下来等用户明确确认。
   2. **配角/反派设定图**：主角确认通过后，再依次生成配角、反派的人设图，每生成一位输出一次并等用户确认；全部角色设定图生成完毕后，**必须再向用户做一次总体确认**（"所有角色资产是否 OK"）。
   3. **场景全景图**：角色资产总体确认通过后，进入场景资产阶段；每个场景**先生成一张全景图**，输出后停下来等用户明确确认。
   4. **场景其余视角图**：全景图确认通过后，再继续生成该场景的其余视角图（近景、特写、俯视/仰视等）；同一场景全景未确认前，禁止提前生成其他视角。
 - **用户明确确认参数后才可进入生成**。无论用户是否已经一次性提供完整参数，都必须先输出一次参数摘要并等待用户确认，即使信息看似完整也不得直接进入生成。明确确认可以是 确认、可以生成、开始生成、没问题、yes、looks good、ok 等表达。

## 澄清清单

在剧情设计、剧本设定和视频生成开始前，建议主动澄清会显著影响结果的关键参数。每轮只问 1-3 个问题。用户说"你来定""随便""直接做"等表达时，可以内部选择合理默认值并继续推进非生成阶段。

真正生成视频前，**必须确认以下基础参数**（用户确认门禁，不因规划自由度软化而放松）：

- **单集总时长**：短篇短剧默认 5-10 分钟。用户未明确时默认 6 分钟，并在澄清中告知用户可选 5-10 分钟区间。
- **单个视频片段时长**：**当前项目侧全局锁定 15s**（下游生视频模型仅支持 15s），30s 作为项目侧预留分支保留在下游 refs 中，无需向用户澄清；仅在用户主动明确要求 30s 或双版本时按其指定生成。
- 比例：例如 `16:9`、`4:3`、`1:1`、`3:4`、`9:16`、`21:9`。
- 生成模式：文生视频、图生视频、参考视频生成、首帧驱动视频，或工具侧的 `r2v` / `f2v` 等模式。
- 画面详细内容：主体、动作、场景、风格、镜头运动、情绪氛围、可见文字、台词、声音和限制。
- 生成数量：单批最多 2 个视频，**超出必须先与用户澄清"一次仅能生成两个视频"**。
- 确认表达：**必须**在用户明确回复"确认""可以生成""开始生成""没问题""yes""looks good"等之后再进入生成。

### 分阶段澄清

| 阶段 | 需要澄清 |
|---|---|
| planner | 目标、产物形式、受众、单集总时长（5-10 分钟）/长篇总集数、剧作基调（微电影三幕式 / 短视频钩子驱动）、已有素材、希望从哪个阶段开始。**如果用户诉求指向 >10 集的长篇短剧完整剧本，建议在此阶段一次性向用户告知"超过 10 集可能出现剧情/人设漂移"的幻觉风险，附主动建议（拆分下单 / 改用长篇工具），并同步告知长篇完整剧本会分批输出（首批 3-5 集，逐批确认）；用户明确知晓风险与分批机制后再进入 scriptwriter 阶段**。 |
| scriptwriter | 故事主题、题材、单集总时长/长篇总集数、主角/配角/反派人物设定、核心冲突、结局方向、情绪基调、禁用内容、剧作基调偏好。**建议交付"剧情梗概（约 1500 字）→ 人物小传（主角/配角/反派）→ 主要故事场景（2-4 / 4-8 个）→ 完整剧本（分集分场专业格式）"四段产物**；长篇建议附分集大纲，且完整剧本按"首批 3-5 集 → 用户确认 → 下一批"的模式分批输出，不建议一次性输出全部剧集；完整剧本的场景推荐从产物三清单中选取。剧情设计和剧本设定缺关键参数时先澄清通常更稳。 |
| storyboard | 单集时长、章节切分（3-5 个叙事章节）、每章节 15s 片段数量、镜头密度、台词/字幕/声音要求。 |
| assets | 角色、场景、道具、视觉风格、参考图用途、一致性锚点、音色或台词锚点。**生成顺序强制为：主角设定图 → 用户确认 → 配角/反派设定图（逐位输出逐位确认）→ 角色总体确认 → 场景全景图（逐场景输出逐场景确认）→ 场景其余视角图**，不得合并或跳批。 |
| frame | 哪一章节/哪些片段、关键帧数量与判定标准（决定性瞬间/情节转折/身份亮相/状态突变/空间锚点等）、场景引用、角色引用、构图、光影、角色物理状态连续性。 |
| prompt | 工具模式、目标片段时长（当前锁定 15s）、比例、参考资产、该片段已锁定的关键帧列表、时间戳动作规划、台词/声音、负向约束、批次数量。 |

如果某个缺失值只影响最终生成、不影响规划，可以继续规划，并把它标为生成前确认点。

## 阶段判断

按顺序检查，通常停在第一个缺失依赖处补齐：

1. 只有 idea、标题、简短梗概、不完整故事或松散角色概念时，进入剧本创作，交付"剧情梗概 + 人物小传 + 主要故事场景 + 完整剧本（分集分场专业格式）"四段产物。
2. 有完整剧本但没有按章节/片段/镜头切分时，进入分镜切分。
3. 有分镜但没有可用角色、场景、道具资产引用或详细视觉基准时，进入资产设定。
4. 有资产和分镜但没有片段关键帧图时，进入关键帧生成。
5. 有关键帧但没有最终视频提示词执行包时，进入视频提示词生成并生成对应视频。

## 规划输出

启动或接续项目时，先输出简短规划报告，再读取下一阶段 ref：

```markdown
## 短篇短剧生产规划报告

### 项目信息
- 项目名称：
- 类型（短篇短剧 / 微电影 / 剧情短片 / 动画短片 / 广告剧情等）：
- 风格：
- 默认比例：
- 单集总时长（5-10 分钟内）：
- 剧作基调（微电影三幕式 / 短视频钩子驱动）：
- 单段视频时长：当前项目侧全局锁定 15s（30s 为项目侧预留分支）

### 当前完成度检查
| 阶段 | 要求 | 是否完成 | 缺失内容 |
|---|---|---|---|
| 1. 剧本创作 | 剧情梗概（约 1500 字）+ 人物小传（主角/配角/反派）+ 主要故事场景（2-4 / 4-8 个）+ 完整剧本（分集分场专业格式）；长篇附分集大纲，且完整剧本按每批 3-5 集分批输出、逐批确认；剧本场景建议来自"主要故事场景"清单 | 是/否 | |
| 2. 分镜切分 | 章节切分 + 15s 片段规划（30s 为预留分支） | 是/否 | |
| 3. 资产设定 | 角色、场景、道具资产与参考图 | 是/否 | |
| 4. 关键帧 | 每个片段依判定标准动态锁定 1-3 张（15s）/ 2-5 张（30s）关键帧图 | 是/否 | |
| 5. 视频提示词 | 可执行视频 prompt 与生成参数 | 是/否 | |

### 承接确认
- 剧本形态：短篇（单集 5-10 分钟）/ 长篇（>1 集，标注总集数）。
- 长篇总集数 >10 集：已一次性向用户输出"剧情/人设漂移"幻觉声明，并附主动建议：是/否/不适用。
- 长篇分批输出：完整剧本首批 3-5 集，每批用户确认后再继续下一批：是/否/不适用。

### 执行规划
当前阶段：
后续流程：
需要确认：
```

## 路由

- 当前阶段是剧本创作时，读取 `references/scriptwriter.md`。
- 当前阶段是分镜切分时，读取 `references/storyboard.md`。
- 当前阶段是资产设定时，读取 `references/assets.md`。
- 当前阶段是关键帧生成时，读取 `references/frame.md`。
- 当前阶段是最终视频生成时，读取 `references/prompt.md`。

**每阶段完成后必须先向用户明确确认再进入下一阶段（用户确认门禁，强制）：**
在剧本、分镜、资产、关键帧的任何一个阶段完成输出后，**必须停下来**，主动询问用户是否满意、是否需要修改；**必须**收到"确认/没问题/继续/yes/ok"等明确许可后，才可以读取下一个 reference 文件推进。**禁止**在没有获得用户明确许可的情况下，擅自读取下一个 reference 文件并自动推进到下一阶段。

## 工具门禁

以宿主环境实际可用工具为准。旧版工具名按下表理解：

| 旧工具名 | 当前含义 |
|---|---|
| `text_to_image` | 文生图 |
| `image_to_image` | 基于参考图的图像编辑 / 图像生成 |
| `image_to_video` | 基于图片参考的视频生成 |

**工具调用失败处理：**
当阶段规则要求使用 `image_to_image` / I2I 或 `image_to_video` / I2V 时，如果实际调用失败，建议先重新尝试对应工具，仍失败再停下来向用户说明失败原因与所需补充信息。不建议为了绕过失败而擅自降级改用 `text_to_image` / T2I 或纯 `text_to_video` / T2V——这会丢失参考图约束并破坏角色、场景、道具一致性，通常得不偿失。

## 完成检查

声明完成前建议逐项过一遍；标注为「强制」的项属于用户确认与交付门禁，不可跳过：

- 阶段依赖已按顺序补齐，未跳过上游阶段（如遇例外应先说明再继续）。
- **【强制】视频生成前已完成必要澄清并获得用户明确确认**。
- 比例、时长、模式、数量、参考素材和限制已记录。
- 角色、场景、道具和关键帧连续性已保持。
- **【强制】剧情导致人物形象明显变化时，已补充并经用户明确确认新的角色资产设定图**，不得直接沿用旧资产图硬套新造型。
- **【强制】所有图片交付统一使用 Markdown 图片语法呈现**（`![描述](URL或本地路径)`），未使用纯 URL 文本、附件链接或 HTML `<img>` 标签替代。
- **【强制】资产设定阶段严格按"主角 → 配角/反派（逐位确认）→ 角色总体确认 → 场景全景（逐场景确认）→ 场景其余视角"顺序推进**，每一批输出后都已停下等用户明确确认，未合并或跳批。
- 应使用 I2I / I2V 的任务未因工具调用失败而擅自降级为 T2I / T2V；如失败，建议已重试对应工具或明确说明失败原因。
- **【强制】单批生成视频数量不超过 2 个**。
- 资产和视频的输出遵循"即时输出"原则，生成一个返回一个，不建议囤积。
- **【强制】所有视频生成结果**，无论 `text_to_video` / `image_to_video`、UGC / marketing / corporate，交付前**必须调用 `notify_human` 整理输出并展示视频**；不得以"非飞书内容""在线 URL 可直接回复""链接可展示""Markdown/HTML video 标签可播放""用户偏好直接交付"等理由跳过。
- **【强制】`notify_human` 入参必须包含可渲染的视频资源本体**：`video_url/output_url/url/result_url` 或本地视频路径；不得只传总结文案、HTML/Markdown `<video>` 片段或裸链接文本。
- **【强制】只有确认 `notify_human` 已正常上屏视频后，才可以输出 `视频已生成` 或成功格式**；如未正常上屏，必须用同一视频资源重试一次，仍失败再说明展示失败并保留链接/路径排查。
- 若宿主环境的实际工具名是 `notify_hunman`（历史拼写），按宿主侧实际工具名调用，本文件文档统一采用 `notify_human` 作为说明。
