# Seedance Video Gen

> 小艺视频创作，基于Seedance 1.5 Pro实现视频生成。支持纯文本、首帧图、首尾帧图三种输入模式，可生成4-12秒短视频，原生音画同步。适用于短视频创作、剧情片段、角色演绎、动画短片、电商产品展示等场景。触发词：生成视频、做视频、视频创作、小艺视频、text-to-video、image-to-video。

- Skill: `18816132863/seedance-video-gen` (Agent Skill, multi-file: 3 files)
- Install (CLI): `npx skillmds@latest add 18816132863/seedance-video-gen`
- Raw SKILL.md: https://api.skillmd.com/api/skills/18816132863/seedance-video-gen/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: 18816132863 (https://skillmd.com/u/18816132863)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/18816132863/seedance-video-gen

---


## ⚠️ 强制规则（不可违反）

**规则1：每次生成必须确认**
- 无论任何情况，每次调用视频生成脚本前，**必须先获得用户的「确认」回复**
- **禁止跳过确认步骤**
- **禁止假设用户已确认**
- 即使用户说"再生成一次"、"同样的再来一个"、"继续生成"，也**必须重新展示参数并等待确认**
- 即使用户在上一次视频生成中已经确认过，仍需**重新确认**

**规则2：确认内容必须完整**
- 必须展示以下6项内容：
  1. 视频内容（prompt）
  2. 视频时长（duration）
  3. 画面比例（ratio）
  4. 分辨率（resolution）
  5. 是否带声音（has_audio）
  6. AI点数消耗（ai_points）
- 缺少任何一项都算确认不完整，**禁止执行生成**

**规则3：禁止自动执行**
- 在收到用户明确回复「确认」之前，**禁止调用 generate_video.py 脚本**
- **禁止预先写入script文件后直接执行**
- **禁止假设用户会同意而提前执行**

**规则4：每次生成是独立事件**
- 每次视频生成请求都是独立的，不继承之前的确认状态
- 用户说"再生成一次"时，必须从头执行完整的确认流程

---

## ❌ 常见错误行为（禁止）

以下行为是**错误的**，必须避免：

| 错误行为 | 正确做法 |
|---------|---------|
| ❌ 用户说"再生成一次"时，直接复用之前的脚本执行 | ✅ 重新展示参数，等待用户确认后再执行 |
| ❌ 用户之前确认过类似参数，就跳过确认步骤 | ✅ 每次生成都是独立的，必须重新确认 |
| ❌ 在用户确认前就写入script文件并执行 | ✅ 先展示参数 → 等待确认 → 写入script → 执行 |
| ❌ 假设用户会同意，提前执行生成 | ✅ 永远等待明确的「确认」回复 |
| ❌ 用户说"生成xxx视频"后直接执行 | ✅ 必须先展示参数并等待确认 |

---

## 角色

根据用户的需求，生成结构化、电影级别的 Seedance 1.5 Pro 视频提示词，并调用python脚本生成视频。你需要充分利用 Seedance 1.5 Pro 的音画同步能力和自然语言理解能力。

## Seedance 1.5 Pro 核心能力

### 参数

| 维度 | 规格 |
|------|------|
| 图片输入 | jpeg/png/webp/bmp/tiff/gif，首帧图≤1张，尾帧图≤1张，单张<30MB |
| 文本输入 | 自然语言描述 |
| 生成时长 | 4-12秒，可自由选择 |
| 声音输出 | 原生同步生成音效/配乐/人声，支持多语言/方言口型精准对齐 |
| 分辨率   | 仅支持720P

### 核心能力总览

- **纯文本生成**：仅通过文字描述生成视频
- **首帧控制**：可设定起始帧图片，精准控制视频开头的画面
- **首尾帧控制**：可设定起始帧和结束帧图片，精准控制视频开头和结尾的画面
- **原生音画同步**：并行生成画面与同步音频，对齐人声口型、环境音效、背景音乐，支持中文方言、英文及多语种
- **单场景叙事**：支持单镜头连贯画面生成，可精准控制人物动作、光影氛围、画面风格
- **人物情绪精准还原**：可细腻呈现人物面部微表情与情绪张力，适配短剧、剧情类视频创作

## Seedance 1.5 Pro 提示词技巧

### 1. 纯文本生成（无参考素材）

最基础的用法，仅靠文字描述生成视频，无需上传任何素材。

**提示词模式**：
```
(主体描述) + (动作序列) + (环境/光影) + (镜头语言) + (风格关键词) + (声音 / 台词要求)
```

**示例**：
```
镜头跟随黑衣男子快速逃亡，后面一群人在追，镜头转为侧面跟拍，人物惊慌撞倒路边的水果摊爬起来继续逃，人群慌乱的脚步声、叫喊声，背景是雨夜的城市街道，电影级写实风格，冷色调。
```

### 2. 首帧图生视频

通过上传首帧图片保持人物、商品、场景的一致性。

**提示词模式**：
```
[角色]（基于首帧图片） + [动作/剧情/运镜的完整描述] + [场景] + [风格 / 光影 / 声音补充]
```

**示例**：
```
基于首帧图中下班后的男人，他疲惫地走在走廊，脚步变缓，最后停在家门口，脸部特写镜头，男人深呼吸，调整情绪，收起了负面情绪，变得轻松，然后特写翻找出钥匙，插入门锁，进入家里后，他的小女儿和一只宠物狗，欢快的跑过来迎接拥抱，室内非常的温馨，全程自然对话
```

### 3. 首尾帧图生视频

使用首尾帧控制视频的起始和结束画面，实现更精准的叙事控制。

**提示词模式**：
```
[角色/场景]（[首帧图]） + [从首帧到尾帧的完整剧情描述] + [角色/场景]（[尾帧图]） + [风格 / 光影 / 声音补充]
```

**示例**：
```
主角在出发起点的冒险者酒馆（首帧图），收拾行囊，与酒保挥手告别，推门走进阳光明媚的街道，镜头快速切换展现旅途中穿越森林、翻越山脉、横渡河流的精彩片段，最终疲惫但满足地抵达目的地的小村庄（尾帧图），夕阳西下，在夕阳中的客栈前坐下休息
```

### 4. 剧情创作/对白补全

模型具备强大的创意性和剧情补全能力，可根据文本描述自动生成连贯剧情，精准匹配对白与人物口型。

**提示词模式**：
```
[分镜 / 画面时序描述] + [演绎方式] + [台词内容用引号标注，标注角色和情绪] + [音效 / 配乐要求]
```

**示例**：
```
0-x 秒：特写女主撕契约镜头，纸屑飘落，总裁单膝跪地伸手阻拦，眼神慌乱，女主侧身躲开，嘴角挂着冷漠笑意
总裁（卑微慌乱）："苏晚，别走！"
"x-y 秒：女主抬脚避开他的手，将撕碎的契约纸扔在他脸上，镜头扫过周围宾客的窃窃私语
女主（冷漠反杀）："顾总，现在求我？晚了！"
y-z 秒：总裁僵在原地，脸上沾着纸屑，女主转身昂首离开，红裙裙摆飘动
音效：华丽又带张力的背景音，契约撕碎的声响，宾客轻微的窃窃私语声
风格：电影感写实
```

### 5. 声音与口型精准控制

支持原生音画同步，支持精准控制人声对白、音色、情绪、环境音效。

**提示词模式**：
```
[画面描述] + [短句台词（用引号标注，按时长控制字数，标注角色和情绪）] + [音效 / 配乐要求]
```

**示例**：
```
固定镜头，男主坐在窗边的沙发上，侧逆光勾勒轮廓，窗外是飘雪的冬夜，男主眼神温柔，对着镜头缓缓说话，音色低沉有磁性，语气温柔治愈
男主："雪落的时候，总有人在等你回家。这个冬天，愿你有温暖的灯火，也有满心的欢喜。"
背景音：轻柔的钢琴声，窗外雪花飘落的沙沙声，整体氛围安静治愈，电影感暖色调
```


## 高级提示词技巧

### 时间戳分镜法

对于8-12秒长视频，使用时间戳精确控制每个镜头的内容，这是实际创作中最常用的高级技巧：

```
0-x 秒：[画面描述 + 镜头语言]
x-y 秒：[画面描述 + 镜头语言]
y-z 秒：[画面描述 + 镜头语言]
```

**示例——仙侠战斗**：
```
仙侠高燃战斗镜头，金红暖色调。
0-x 秒：低角度特写主角蓝袍衣摆被热浪吹得猎猎飘动，双手紧握雷纹巨剑，剑刃赤红电光持续爆闪，地面熔岩翻涌冒泡，远处魔兵嘶吼着冲锋逼近，主角低喝 "今日，便以这柄剑，镇尔等邪祟！"，伴随剑鸣与熔岩咕嘟声；
x-y 秒：环绕摇镜快切，主角旋身挥剑，剑刃撕裂空气迸射红色冲击波，前排魔兵被击飞碎裂成灰烬粒子消散，伴随剑气破空声与魔兵惨嚎；
y-z 秒：仰拍拉远定格慢放，主角跃起腾空，剑刃凝聚巨型雷光电弧劈向魔兵群，音效收束为余音震颤与渐弱风声。
```


## 镜头语言词汇库

| 类别 | 关键词 |
|------|------|
| 景别 | 大远景、远景、全景、中景、近景、特写、大特写 |
| 运镜 | 推镜头、拉镜头、摇镜头、移镜头、跟拍、环绕拍摄、航拍、手持跟拍、希区柯克变焦 |
| 角度 | 平视、俯拍、仰拍、低角度、鸟瞰视角、鱼眼镜头、第一人称视角、主观视角 |
| 节奏 | 慢动作、快切、延时摄影、升格拍摄、硬切、卡点 |
| 焦点 | 浅景深、深景深、焦点转移、虚化背景、选择性对焦 |
| 特殊 | 遮挡擦镜转场、无缝渐变转场、环绕摇镜快切特写、定格慢放 |

## 风格词汇库

| 类别 | 关键词 |
|------|------|
| 画面质感 | 电影感、胶片质感、高清晰度、8K分辨率、HDR、RAW质感、4K医学CGI |
| 影像风格 | 好莱坞大片、独立电影、纪录片、MV风格、广告大片、Vlog风格 |
| 色调氛围 | 暖色调、冷色调、高对比度、低饱和度、莫兰迪色系、赛博朋克霓虹、红金高饱和 |
| 艺术风格 | 写实主义、超现实主义、极简主义、蒸汽波、赛博朋克、中国风水墨、3D国漫CG |
| 光影效果 | 自然光、侧逆光、丁达尔效应、霓虹灯光、月光、黄金时段光线、体积光 |
| 动画风格 | 中国奇幻动画电影风格、超精细CG动画、日漫赛璐璐、3D渲染写实 |

## 场景类型与提示词策略

### 电商/广告

- 产品360度旋转展示、爆炸分解、3D渲染特效
- 第一人称沉浸式手作体验
- 配合广告词和品牌logo

**示例**：
```
基于首帧图中的可口可乐饮料，360度高速旋转2圈后，突然停住蓄力分裂成了3个部分进行展示。随后分解后的可口可乐饮料罐的上中下三部分快速向内旋转合成，一罐完整的可口可乐饮料，3D渲染产品展示特效，动感产品特效展示
```

### AI漫剧/仙侠

- 使用首尾帧控制变身/变装效果
- 时间戳分镜法控制每段画面
- 详细的特效描述（法阵、能量波、粒子效果）
- 台词用引号标注，指定语气

### 短剧/对白

- 画面+台词分开描述，台词标注角色和情绪
- 音效单独描述
- 可指定旁白说"预知后事如何，请看下集"

### 科普教学

- 4K医学CGI风格
- 半透明人体结构可视化
- 科学过渡自然流畅
- 配合教育性旁白

### MV/音乐卡点

- 分镜头描述每个镜头的场景、动作、音效
- 强调声音设计与节拍同步

## 时长策略

### 单段视频（4-12秒）
Seedance 1.5 Pro 单次生成上限为**12秒**，下限为4秒，所有生成内容必须严格遵守此限制。
- 5-8秒：适合完整的短场景、单个动作、简短特效展示。可选用时间戳分镜，分为 2 个阶段。
- 9-12秒：适合完整叙事、短剧对白、剧情片段。**强烈推荐时间戳分镜法**，分为 3 个阶段精确控制。

## 注意事项

- 使用自然流畅的中文描述，**所有提示词必须使用中文编写**
- 描述要具体且有画面感，避免抽象模糊的表述
- 镜头语言和动作描述要有时间顺序，让模型理解画面的先后关系
- 对于10-12秒长视频，推荐使用时间戳分镜法精确控制
- 台词/对白用引号包裹，并标注角色和情绪，所有对白必须符合自然语速，避免几秒镜头内出现过长台词，中文剧情对白按 3–5字/秒 估算；激烈情绪台词最高按 6字/秒 控制
- 音效描述单独成行，与画面描述分开
- 合理控制提示词长度，重点突出，避免信息过载
- 情绪和氛围的描述对最终效果影响很大，不要忽略
- 严格遵守4-12秒的时长上限，不要生成超过12秒的单段提示词


## 交互指引

当识别到用户有视频提示词生成需求时，按以下流程进行：

### 第一步：获取用户输入

主动收集用户对视频的核心需求，包括但不限于：视频内容描述、情绪氛围、镜头风格、用途场景、是否需要人声对白等。

### 第二步：确认关键参数

针对未明确的参数，通过提问逐一确认：

1. **视频时长**：4-12秒，默认10s **时长最低4s，如果小于4s则自动调整为4s**
2. **首尾帧配置**：纯文本（无图片输入）/ 首帧图（用户上传1张图片，用于控制视频开头）/ 首尾帧图（用户上传2张图片，用于首尾帧控制）
3. **视频分辨率**：仅支持720p
4. **视频比例**：横屏16:9 / 4:3 / 21:9 / 竖屏9:16 / 3:4 / 1:1 /自动推荐
5. **是否需要声音**：是 / 否
6. **补充偏好**（可选）：情绪氛围、镜头风格、用途场景、是否需要人声对白等

### 第三步：生成提示词

根据用户需求及确认的参数，生成视频提示词，并按照以下固定结构输出json文件，不需要输出```json和```：

{
  "prompt": "xxx",         // 提示词内部如需使用引号，**统一使用英文单引号 '**，**禁止使用英文双引号 "**
  "duration": 10,          // 视频时长（秒，整数），最长12秒
  "ratio": "9:16",         // 视频比例：9:16 / 16:9 / 4:3 / 3:4 / 1:1 / 21:9
  "resolution": "720p",    // 分辨率：720p
  "has_audio": false       // 是否包含声音
}

### 第四步：配置信息用户确认（⛔ 必须执行，不可跳过）

将第三步生成的完整视频配置，整理为易读格式发送给用户，确认参数无误后再执行下一步：

---

以下是根据您的需求生成的视频制作参数，请确认：

**1. 视频内容：** {{prompt}}

**2. 视频时长：** {{duration}} 秒

**3. 画面比例：** {{ratio}}

**4. 分辨率：** {{resolution}}

**5. 是否带声音：** {{has_audio}}

**6. AI点数消耗约：** {{ai_points}} 点

---

该工具会产生除模型推理外的AI点数消耗，确认无误请回复「确认」，我将立即为您生成视频。

**AI点数计算规则：**
- 无声视频：4 AI点/秒
- 有声视频：8 AI点/秒
- 本次消耗：{{duration}} 秒 × {{rate}} 点/秒 = {{ai_points}} 点

**⚠️ 重要：必须等待用户回复「确认」后，方可进入下一步操作。**

### 第五步：调用脚本生成视频

**⛔ 执行前提检查（必须满足以下所有条件）：**
1. ✅ 已完成第四步的参数展示
2. ✅ 用户已回复「确认」二字
3. ✅ 未收到用户的修改请求或取消请求

**如果以上任一条件不满足，禁止执行本步骤。**

用户确认配置无误后，调用generate_video.py脚本，传入第三步生成的json文件，执行视频生成操作。

### 第六步：发送生成结果

视频生成完成后，及时将视频文件发送给用户，确认用户接收无误，流程结束。


## 常见用法

1. **纯文生视频（无图片输入）**
```bash
python3 generate_video.py --script script.json
```

2. **首帧图生视频（指定首帧）**
```bash
python3 generate_video.py --script script.json --first-frame first.png
```

3. **首尾帧图生视频（指定首尾帧）**
```bash
python3 generate_video.py --script script.json --first-frame first.png --last-frame last.png
```

4. **根据任务ID查询下载视频（异常处理：任务已创建但未正常获取视频时，使用任务ID手动查询并下载）**
```bash
python3 query_video_task.py --task-id your_task_id
```

## 路径说明

- `--script` 可以是相对路径或绝对路径
- `--first-frame` 可以传单张首帧图片路径，支持相对路径
- `--last-frame` 可以传单张尾帧图片路径，支持相对路径
- `--output` 默认存放`~/.openclaw/workspace/generated-videos/`位置

