# Seedance 2 Video Gen

> Seedance 2.0 生视频「方法论」参考：三种模式(文生视频/图生视频/参考生视频)、时长、分辨率、音频、比例、参考图/视频/音频限制等参数知识。仅提供方法论——本项目通过自有 new-api / 画布生视频工具(doubao-seedance)执行，不直连外部 API、不需要任何外部 API key。

- Skill: `anymouschina/seedance-2-video-gen` (Agent Skill, multi-file: 3 files)
- Install (CLI): `npx skillmds@latest add anymouschina/seedance-2-video-gen`
- Raw SKILL.md: https://api.skillmd.com/api/skills/anymouschina/seedance-2-video-gen/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Integrations & APIs
- Author: anymouschina (https://skillmd.com/u/anymouschina)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/anymouschina/seedance-2-video-gen

---


# Seedance 2.0 生视频方法论（本地版）

> **定位（重要）：本 skill 只给方法论，不执行、不调用外部 key。**
> 本项目的视频生成统一走自己的链路：画布 `video` 节点 / `tapcanvas_video_generate_to_canvas` 工具 → new-api 的 doubao-seedance 官渠（如 `doubao-seedance-2-0-260128` / `-fast`）。**官渠已直接支持真人，项目不再有任何 `-face` 模型，禁止输出 `doubao-seedance-2.0-face` 等 -face 变体。**
> 需要真正出视频时，**用项目自有的生视频工具/节点**，把下面的方法论填进去；**不要**注册 EvoLink、不设任何 `*_API_KEY`、不 curl 外部端点。
> 边界：seedance-20 skill 教的是**外部平台表面**（EvoLink/OpenRouter/API key/外部定价），仅供咨询外部用法；本项目出片一律走自有链路，**不采信其 API/key 指引**。
> **TapCanvas 正式提示词边界**：本 skill 的 Timeline、动作、运镜与模型知识只可作为领域方法输入，不能自行成为最终 prompt 标准。任何写入 TapCanvas 视频节点、提示词包或真实供应商请求的提示词，都由 `tapcanvas-video-workflow` 派 `video-prompt-writer`，并在同一上下文按 `tapcanvas-video-reviewer` 修订；动态 generationContract 优先于本文件中的历史时长、分辨率、引用数量与示例 `@图N`。

## 三种模式（方法论）

| 模式 | 用法 | 输入 |
|---|---|---|
| **文生视频** | 描述场景直接出视频 | prompt（可选 web 搜索增强时效性内容） |
| **图生视频** | 从图动起来 | 1 张图=首帧动画（首尾帧插值/续写/尾帧续接已于 2026-06-26/07-06 在本项目停用：镜间并发独立+exitState 文字承接；此段仅存档） |
| **参考生视频** | 多模态混合/编辑 | 图(0–9) + 视频(0–3) + 音频(0–3) + prompt，用自然语言按编号引用输入（续写用法已停用，同上注） |

> 当前口径：`storyboardImageNodeId` 是可选图片引用。单状态可用普通 image；确需表达连续变化时可用一张承载 2～3 个有序状态的故事板 image；无关键帧也合法。只有 `bridge_frames` 把它作为真起幅并要求 `lastFrameImageNodeId`。仍禁运行时从已出视频抽帧续写，整章母板、通用设计板、四格以上分镜板和站位图禁止进入视频。

## 参数方法论

| 参数 | 说明 | 默认 |
|---|---|---|
| **prompt** | 运动意图描述。**写运动方向与物理后果，把动作沿时间轴铺开（Timeline 分拍见下），禁止一句笼统带过**。 | 必填 |
| **duration** | 4–15 秒。单段越短累积畸变越少（口径澄清：单拍 ≤3s（台词拍除外），单条 clip ≤15s）。 | 5s |
| **resolution** | 480p / 720p。 | 720p |
| **audio** | 可自动生成同步的人声/音效/BGM。 | 开 |
| **aspect** | 16:9 / 9:16 / 1:1 / 4:3 / 3:4 / 21:9 / adaptive。 | 16:9 |
| **referenceImages** | 图生视频 1–2 张；参考模式 0–9 张。 | 条件 |
| **referenceVideos** | 参考模式 0–3 个(.mp4/.mov，单段 2–15s，合计 ≤15s)。用于运镜/动作参考。（作为被编辑/续写源视频的用法已于 2026-06-26/07-06 在本项目停用：镜间并发独立+exitState 文字承接；此句仅存档） | 条件 |
| **referenceAudio** | 参考模式 0–3 个(.wav/.mp3，单段 2–15s，合计 ≤15s)。用于 BGM/音效/配音参考。 | 条件 |

## 一致性 / 喂图方法论（配合故事板）

- **按需关键帧 + 精选资产**：每镜可不使用关键帧、使用普通单状态 image，或使用一张 2～3 状态故事板 image；再按剧情需要精选核心人物、群像、场景、武器/道具/VFX。整章母板、通用设计板、四格以上网格图和站位图绝不喂视频模型。
- **产品一致性**：`keep the product appearance completely unchanged, camera movement only, no rotation`；只动相机不动主体；单片段 ≤3s。
- **角色一致性**：身份板**派生单图**（大头照+全身照）当锚点，每镜带固定外观描述；**禁三视图整图直接喂视频**（ID 漂移/双胞胎风险，与 sd2-pe 口径一致）。

## 动态/运动最佳实践（Timeline 分拍 —— 治「静帧伪动」）

> 实测：单张静态关键帧 + 一句笼统 prompt → Seedance 把动作「冻成一帧」，只剩特效闪烁的伪动态；近身打斗尤其垮。根因不是模型，是 prompt 没把运动「沿时间轴铺开」。以下为治本写法。

- **Timeline 分拍（核心）**：用显式时间戳把运动分布到整条片，模型才不会塞成静帧。
  - 叙事档：5s：`[0s] [1.5s] [3.5s]` 三拍；10s：`[0s] [2s] [3.5s] [5s] [6.5s] [8.5s]` 六拍。拍长随动作内容自然分布、禁机械等分；叙事/情绪拍可 3~5s+，硬要求=描述密度与时长守恒（长拍写满演进链，过稀被写入闸退回补密）。
  - 打斗档（电光火石·单拍最低1s·无拍数上限）：8s：`[0s][1s][2.5s][3.5s][4s][5.5s][7s]` 逐秒密拍——**镜内逐秒时间轴 ≠ 碎镜**（碎镜指跨条 clip 的独立短镜）。同样拍长随动作自然分布、禁机械等分。
  - 每拍格式：`[Xs] 景别：主体的【一个】动作。镜头：运镜词。氛围/光。`
- **每拍只给一个主要动作动词**：多动作/复杂多角色同框 = chaos/静帧。复杂编排拆成连续 beats（升级弧：setup → 出招 → 升级 → 反转 → 收）。
- **主体运动与镜头运动分开写**，镜头用电影词且**每拍只用一个主运镜**：push-in/dolly、pull-out、pan、tracking、orbit、aerial、handheld、fixed。
- **打斗要写「撞击物理 + 后果」，不要虚词**：不是「扑击/格挡」，而是「爪砸上符墙→迸成金色碎光、虎妖被反震后挫半步、碎瓦崩飞」。给方向、距离、受力形变、destruction 结果。
- **撞击「后果余波」必须写全（治「只撞上不弹开」）**：不止写「撞上」，要写「被弹回」——受击方反震滞空顿挫、重心趔趄后退半步；重物落地/重击必写「地面震颤 + 一圈尘浪扩散 + 碎屑崩飞联动」。只写接触不写余波 = 假。
- **动作-情绪联动（治「全程一张脸」）**：发力/受击/被弹的每个关键瞬间，同步写角色**表情变化**（吃痛、错愕、咬牙、瞳孔收缩、眉骨皱起、头猛地后仰）。表情不随动作变 = 最大的「假」来源。
- **发力链/重量感**：写重心压低、蹬地或扎马受力、肌肉绷紧、衣料随发力甩动、巨物移动带起地面浮尘；避免「摆拍顺拐」式的表层漂移动作。
- **节奏点睛（条件规则）**：决定性瞬间只有在当前 UserIntentContract 明确允许时间强调时，才可用表演凝滞、慢运镜或微距推进；精确变速归剪辑层，不得偷偷写进生成提示词。用户要求疯切、全程实时、无慢动作或无英雄时刻时，保持实时速度，用切点、攻击路径、接触材质、位移和反作用读清强度，不得用 slow/smooth/gradual、微升格、抽帧或定格换名恢复慢镜。
- **负向必加**（同时治一致性抖动）：`avoid jitter, avoid bent limbs, avoid temporal flicker, no identity drift`。
- **密度守恒，不设字数下限也不设字数上限**：按 Timeline 分拍把每个时间段的动作、物理后果、运镜、光与声音写足写满；描述密度与时长守恒（长拍写满演进链）。本项目结构化 shots 渲染的长提示词不受任何词数上限约束、不注水、不因“怕长”压缩叙事；单段内宁可写满也不要一句笼统带过。
- **图生视频**：源图已给外观，**prompt 只写运动/运镜/光，不要重述外观**（减少身份/背景漂移）。
- **运动/动作参考**：复杂动作优先走 **参考生视频** 传 `referenceVideos`（运动参考片），比静态帧更能逼出真实动作；style 转换时强调 `preserve core motion and timing`。

### 动作镜 prompt 模板（可套）
```
N秒，16:9。[环境一句 + 角色锚点一句]。
[0s] 景别：主体【一个动作】。镜头：一个主运镜。氛围。
[3s] 主体【下一个动作，含撞击物理与后果】。镜头：运镜。
[6s] 景别：主体【反应/反震】。镜头：运镜（只有用户允许时才可时间强调）。
[8s] 收拍/开放动作（只有用户或父任务明确要求收束时才允许定格；独立 clip 默认以未完成动势退出）。
对白：@角色（情绪）：「台词」口型同步（2026-07-10 全项目符号统一）。 SFX：动作同步音效。
拒绝：BGM/背景音乐；文字字幕/水印/随机汉字；jitter/bent limbs/temporal flicker；identity drift；现代元素；漫画平涂线稿。
```

### 进阶杠杆（破文字描述的上限）

- **参考视频「运动迁移」（最强杠杆，治真实重量/卸力/连招）**：复杂动作别只靠文字，传 1 段 **3–8s 干净单一动作**的运动参考片到 `referenceVideos`（参考生视频模式）。Seedance 逐帧复制其**运动路径 + 机位 + 编排**到我方角色；**运动由参考片定、风格/外观由文字+参考图定（两套独立系统）**。文字里写 `transfer the motion and camera from the reference video onto 沈砚/虎妖, keep their appearance from the reference images, preserve core motion and timing`。
- **二级运动(secondary motion)必写**：每个动作附带 头发/衣料随力甩动、尘土/碎屑/火星/水花扬起、动作收势 follow-through、巨物移动带起浮尘——Seedance 物理强，写了就有，不写就「漂浮假」。
- **角色一致性强化**：① 身份锚点(姓名+不可变特征)放 **prompt 最前 20–30 词**，否则切镜会幻觉出新角色；② **参考图宁少勿多**（2 张干净锚点 > 6 张杂图，漂移↓约 60%）；③ 点名**独特特征**（额「王」纹、金瞳、暗银云纹、丹青笔暖金）+ 显式负向 `no missing markings, no mirrored features, no identity drift`。
- **具体连招 + 环境破坏链**：不写「打斗」，写可执行连招（如「侧滚→反手一笔劈出符墙→借力后撤」）与连锁破坏后果（梁柱断裂→碎瓦多米诺崩落）。
- **CRAFT 多模态参考法**：Context(场景) · Reference(@图/@视频/@音) · Action(动作) · Framing(机位) · Timing(节拍) 逐项写清。图引用规范写法=@图N（2026-07-10 全项目符号统一）。

## 重要限制（与本项目一致）

- **真人写实脸**：官渠 `doubao-seedance-2-0-260128` 已直接支持真人参考图/首帧，正常出片并转存 R2。**项目已不存在 `-face` 模型，禁止输出 `doubao-seedance-2.0-face` 等 -face 变体**；真人镜照常用官渠模型，别因怕审核把人删成纯产品镜。
- 默认约束：16:9 避裁切、24fps 对齐电影标准。

## 模型能力速记

- 文生/图生/参考生视频；自动音频(人声/音效/BGM)；时长 4–15s；分辨率 480p/720p；比例多档含 adaptive。

## 参考
- `references/api-params.md`：完整参数方法论（三模式输入限制、时长/分辨率/音频/比例、最佳实践）。

