# Seedance 25

> 即梦Seedance 2.5 提示词编写 + 生成执行 + 后期编辑全流程 Skill。适用场景：用户要给即梦/Seedance 2.5 写任何视频生成 prompt（文生视频、图生视频、视频延长、视频编辑、首尾帧生视频、白模走位、一键成片、无缝转场、多宫格分镜）。触发词：sd2.5、sd2.5pro、seedance 2.5、即梦视频、即梦 AI、jimeng、字节视频生成、超长视频、套娃延长、白模动画。

- Skill: `rickai0118/seedance-25` (Agent Skill, multi-file: 7 files)
- Install (CLI): `npx skillmds@latest add rickai0118/seedance-25`
- Raw SKILL.md: https://api.skillmd.com/api/skills/rickai0118/seedance-25/raw
- Safety review: pending (external: skill-scanner PASS, skillspector PASS)
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: AI & ML
- Author: rickai0118 (https://skillmd.com/u/rickai0118)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/rickai0118/seedance-25

---


# Seedance 2.5 使用手册（v2.0 全量补强版）

> **来源**：
> - 主源：飞书文档【即梦】Seedance 2.5 使用手册 https://bytedance.larkoffice.com/wiki/RXh5ww6EqighMdkVTMccm2d4n7e
> - 补强源：微信公众号《16000字超详细 Seedance 2.5 官方提示词指南及提示词模板》https://mp.weixin.qq.com/s/Jv5iCILkg10q8o-KZ4GpNQ （小互 AI 转载官方）
> **官方体验入口**：https://jimeng.jianying.com/
> **归档日期**：原始 2026-07-31 / 补强 2026-08-30。原始全文：`references/seedance25-manual.md`（198KB，随 skill 分发）

## 使用路径（先看这里）

| 你的需求 | 去哪里 |
|---|---|
| 写基础提示词（素材+概述+情节+补充） | §四 基础公式 |
| 写真人/去 AI 感人物 | §四 真人人物公式 + §七 去 AI 感 |
| 写 30 秒长视频（含时间戳导戏） | §四 30s 公式 + §二-3 时间戳 |
| 写超长视频（30-180s 一次性直出） | §四 超长公式 |
| 视频延长 / 套娃式续写 | §四 延长公式 + §五 转场库 + §四-延长边界连续性 |
| 编辑已有视频（改物/去 BGM/换背景/改机位） | §四 智能编辑公式（4 Case 完整模板） |
| 白模 / 走位调度（Maya/Blender） | §二-4 白模（粗/细粒度对照表）+ §四 白模公式 |
| 多宫格分镜图驱动成片 | §四 多宫格公式（必写读取顺序） |
| **多素材创作**（30 图 + 10 视频 + 10 音频） | §四 多素材公式（4 步编排） |
| **首尾帧独立写法**（不依赖首尾帧模式） | §四 首尾帧公式 |
| **多关键帧顺序控制** | §四 多关键帧公式（4 段式） |
| **一键成片**（多图+参考视频组接） | §八 一键成片 |
| **无缝转场**（两段视频自动补全） | §九 无缝转场（7 步模板 + 5 种方式） |
| **情绪方向可观察表现** | §十 情绪方向（单次 vs 多阶段） |
| **专业摄影术语库** | §十一 摄影术语（7 种热门运镜 + 5 个示例） |
| 生成结果崩坏 / 串脸 / AI 感重 | §七 避坑 + §六 去 AI 感 + §十三 异常处理矩阵 |
| 素材数量 / 时长 / 分辨率参数限制 | §一 速查表 + §十二 能力边界 |
| 非即梦官网平台（fal/Ark 等） | §十三 避坑（局限，2.5 覆盖未验证） |
| **提交前自检** | §十一 提交前检查清单（11 项） |

**TL;DR**：2.5 核心 = 30s 单次 / 60s 套娃延长 / 180s 超长模式 / 时间戳导戏 / 30图+10视频+10音频参考。所有 prompt 按「素材描述 → 概述 → 情节(带时间戳) → 全局补充」四段式组装。

**关联资源**：
- `references/seedance25-manual.md` — 飞书原始 198KB 官方手册全文
- `test-prompts.json` — 3 个典型测试 prompt（古装送别 / 视频延长 / 白模动作），用于实测评估

---

## 执行检查点（生成前/后各 30 秒核对）

### 检查点 0｜任务分诊（开始前 30 秒，必做）

> 🛑 **人类确认点**：先判断任务类型，再决定走哪条公式。

| 用户意图关键词 | 走哪条公式 | 必读章节 |
|---|---|---|
| "生成视频 / 写提示词 / 帮我做" + 无明确素材 | §4.1 基础 5 段式 + §4.6 30s 长视频 | 基础 5 段 → 阶段 → 保持一致 |
| "首尾帧 / 关键帧 / 给张图让它动" | §4.11 关键帧 4 段式 | 首尾帧独立 / 多关键帧 4 段 |
| "延长 / 续写 / 接着往后" | §4.9 延长公式 + §五 转场库 | 7 项必保连续性 / 必填词 |
| "改成 / 替换 / 把 X 换成 Y" | §4.8 编辑 4 Case | Case A/B/C/D 匹配场景 |
| "一键成片 / 把这些图做成片" | §4.15 一键成片 | Step 1-5 模板 |
| "白模 / 走位 / 镜头调度" | §二-4 白模 + §4.14 公式 | 粗/细粒度判断对照 |
| "无缝转场 / 两段拼一起" | §九 无缝转场 | 7 步模板 + 5 种方式 |
| "情绪 / 表情 / 表演" | §十 情绪方向 | 单次 vs 多阶段 |

### 检查点 1｜素材交点确认（多素材任务必做）

> 🛑 **人类确认点**：素材超过 3 份或人物超过 2 个时，逐张图/@ 视频编号，让用户确认归属。

```
确认清单：
□ @图1/@视频1/@音频1 是否对应了正确的角色/动作/音色？
□ 是否有素材需要排除（背景人物 / 旧版服装 / 不相关场景）？
□ 跨场景出现的人物是否始终绑定同一组素材？
```

### 检查点 2｜生成前 11 项检查

**生成前**：
- □ 素材数量/时长在官方建议区间？（超 1-5 主体 / 5-10s / 20s 编辑时做好抽卡准备）
- □ 参考素材已编号并声明用途？（@图1=人物 / @视频1=动作 / @音频1=音色 / @图X=场景）
- □ 时间戳格式正确？（`[00.0-05.0s]` 或 `第 N 帧`；帧数=秒×24fps）
- □ 禁止项写全？（声音 / 字幕 / 行为 / 易崩坏处，可结尾重申）

**生成后验收**：
- □ 无随机字幕/BGM？（有 → 在全局补充段重申禁止项后重抽）
- □ 多人场景无串脸/换脸错位？
- □ 局部编辑物理合理？（不合理 → 缩小范围或改文字指令重试）
- □ 延长段动作衔接/转场自然？（生硬 → 补"禁止生硬切镜"约束重试）
- □ 白模动作无僵化？（有 → 换粗颗粒度 / 去掉四肢模型重试）
- □ **关键帧顺序按预期推进**？（多关键帧任务必查）
- □ **转场前后画面与声音连续**？（延长/无缝转场必查）

---

## 一、2.5 vs 2.0 关键升级速查

| 能力 | 2.0 | 2.5 |
|---|---|---|
| 单次生成时长 | 4-15s（97-361帧） | **4-30s（97-721帧）** |
| 视频延长 | 无 | 单次延长 4-30s，套娃多次累计至 **60s** |
| 超长视频模式 | 无 | 一次性直出 **30-180s** |
| 时间戳控制 | 仅先后顺序 | **秒级/帧级精确指令**（[00.0-05.0s]、第 N 帧） |
| 参考图片数 | 0-9 张 | **0-30 张**（单张 <30MB，宽高比 0.4-2.5，300-6000px） |
| 参考视频 | 单个 2-15s，最多 3 个，总 ≤15s | **单个 2-30s，最多 10 个，总 ≤30s**（实际 1.8-30.2s） |
| 参考音频 | 单个 2-15s，最多 3 段，总 ≤15s | **单个 2-30s，最多 10 段，总 ≤30s** |
| 纯音频驱动 | R2V 不支持仅传音频 | **支持仅传入音频** |
| 输出分辨率 | 480p/720p | 480p/720p（未变） |
| 字幕/BGM 抑制 | 弱 | **大幅优化**，负向 prompt 生效 |
| 小语种 | 弱 | 重点优化中/英/西/印尼/马来，覆盖泰/阿/葡/越/日/韩 |
| 多人参考 | 双胞胎问题 | **防串脸/防换脸错位**，独立面部特征 |
| 音色参考 | 基础 | 多音色、高保真复刻情绪 |

**输入建议（官方）**：
- 主体数：1-5 个效果最好；6-10 个稳定性下降需抽卡（音视频）；主体图 1-8 个，9-12 个需抽卡
- 主体素材时长：5-10s 效果最好
- 视频编辑输入：20s 以内效果好
- 视频参考图编辑：1-5 张效果好，6-8 张需抽卡
- >5 主体时「单视图」更稳；多视角建议拆多张图（多图多视图 > 单图多视图）

---

## 二、四大新功能（核心）

### 1. 🕒 视频延长（套娃式）
- 原视频 ≤30s 才能延长；单次延长 4-30s；产物 ≤30s 可继续延长，**极限 60s**
- 提示词只作用于**新增段**，前段画面完全保留
- 三段式导演控制：每段延长可输入新指令（先跑 10s 再指令跳跃）
- 场景：悬念反转、复杂动作接力（拔剑→突刺→收剑）、视角穿越

### 2. ✌️ 超长视频（30-180s 一次性直出）
- 界面选「超长视频」模式 + 时钟图标调时长（30-180s）
- 长时序一致性：3 分钟跨度人物/服装/场景不"变异"
- 适合：宣传片、完整音乐 MV、情绪独白长镜头

### 3. 🎯 时间戳文本控制（剧本级导戏）
- 格式：`[00.0-05.0s]` 或 `第 N 帧`（帧率换算：10s=240帧@24fps；720帧=30s）
- **帧级写法**：段落用 `第 0–90 帧 (0s - 3s)` 区间，段内用 `第 60 帧` 标精确动作点/音效点
- **【全局约束声明】前置块**（官方案例结构，强烈推荐）：提示词开头统一声明 `1.视觉风格 2.字幕限制 3.参考素材映射（@视频1动作/@音频1音乐/@音效2音效/@图片空镜）`，正文再按帧段推进
- 特殊指令：`注意：仅发声，无字幕`（只说台词不显示字幕）
- 多镜头剧情、卡点 MV、分阶段产品展示
- 实测案例：240 帧武侠打斗，24fps 动作准确；2.0 同 prompt 动作连贯性不足

### 4. 🎬 专业级白模控制（Maya/Blender 插件）
- **粗颗粒度**（简单几何体，推荐）：白模只做"动态骨架"，参考运镜/动作/站位/光影/节奏
  - 公式：参考声明 → 对应关系映射（哪个模型=哪个角色）→ 剧情详述 → 场景处理 → 收束
  - 最佳实践：**不上传有四肢/翅膀的模型**（动作易僵化）；若有四肢需写出完整动作序列
- **细颗粒度**（完整建模）：直接渲染材质/光影/风格
  - 公式：渲染指令 → 分段渲染描述 → 场景处理 → 收束
  - 上传参考视频需去除轨迹线/坐标线/camera cone 干扰信息
- **粗粒度 vs 细粒度判断标准**（官方推荐对照表）：

| 维度 | 粗粒度白模 | 细粒度白模 |
|---|---|---|
| 适合情况 | 用简单几何体预演动作、动线、站位、运镜或切镜 | 已有完整建模，需要更换人物、材质、色彩、场景或风格 |
| 素材要求 | 几何体关系清楚，动作序列完整 | 模型结构完整且画面干净 |
| 必清元素 | 可叠加人物/道具/场景图片 | 避免轨迹线、坐标线、相机锥体 |
| 提示词重点 | 逐一映射白模主体，并说明继承哪些时序与空间信息 | 保持结构、动作和镜头，明确需要重渲染的属性 |

---

## 三、多模态参考优化（10 项）

| 功能 | 一句话 | 提示词要点 |
|---|---|---|
| 🎵 分离/移除 BGM | 删音乐留人声，画面字幕完好 | "去除背景音乐，保留人物对白" |
| ✨ 迁移创意 | 动作模仿→情绪/镜头语言/网感迁移 | 参考视频的运镜轨迹、色彩逻辑、节奏排版 |
| ✂️ 局部消除与编辑 | 无痕擦除+定向替换 | 框选区域 + "消除右侧路人" |
| 🎥 空间视角修改 | 改机位、外推补全画面外空间 | "改为高空俯拍缓慢推进"、"第一人称视角" |
| 🎙️ 音色参考升级 | 多音色、声线高保真复刻情绪 | "参考@音频1说……保持低沉悬疑语调" |
| 👥 多人参考升级 | 防串脸/换脸错位/穿搭独立 | 明确 A/B 动作与关系 |
| 🟩 无缝绿幕编辑 | 绿幕抠像直接换背景（高精细分割） | "将背景替换为……，光影神秘" |
| 🔗 视频无缝转场 | 两段视频自动补全间隙成一体 | 上传前后两段 + "拼接在一起" |
| 🎞️ 多宫格分镜 | 线稿/火柴人分镜图驱动 | 见下节公式 |
| 🎬 白模控制 | 工业级机位/走位调度 | 见上节公式 |

---

## 四、提示词公式（官方全量版）

### 4.1 基础公式（5 段式）

```
完整提示词 = 【主体】+【动作或事件】+【场景与环境（可选）】+【视觉风格（可选）】+【运镜或切镜（可选）】+【声音（可选）】
```

**模板**：
```
<主体>在<场景与环境>中<主要动作或事件>。画面呈现<视觉风格>。镜头采用<景别、机位、运镜或切镜>。声音包括<对白、环境声、音效或音乐>。
```

**示例**：一名陶艺师在清晨的工作室里完成一只浅蓝色陶杯，将它从转盘上取下并放到木架中央。窗外柔和晨光照入室内，湿润陶土呈现细腻光泽，工作台保持整洁。镜头先以中景记录拉坯动作，再缓慢推近陶杯表面的纹理，最后切到木架正面。保留转盘低沉转动声、陶土摩擦声和轻微室内环境声。

**注意**：
- 不需要的部分可以省略
- 生成参数不需要写进提示词；可调参数由生成页面或接口设置
- 动作优先概括主要过程，只为关键动作写具体细节，避免重复描述同一动作

### 4.2 有参考素材时的素材职责声明

#### 素材数量与选择

| 类型 | 输入范围 | 推荐范围 | 扩展上限 |
|---|---|---|---|
| 图片 | 最多 30 张，单张不超过 4K | 主体图片 1-8 个主体 | 9-12 个主体需抽卡 |
| 视频 | 最多 10 段，总时长 ≤30s | 1-5 个主体、单段 5-10s | 6-10 个主体需抽卡 |
| 音频 | 最多 10 段，总时长 ≤30s | 保留直接相关的台词/音色/环境声/音乐 | — |
| 视频编辑 | 可使用视频与参考图共同完成 | 原视频 ≤20s，参考图 1-5 张 | 参考图 6-8 张需抽卡 |

**多视角写法**：主体图超过 5 个且需要多视角时，把不同视角拆成多张图片（多图多视图 > 单图多视图拼图）。

#### 逐份说明素材职责（必写）

上传参考素材后，**必须说明每份素材具体提供什么**。素材中的人物、背景或构图容易被误带入成片时，再写明不采用什么。

**模板**：
```
@图片1用于<主体>的<外貌、服装、结构或材质>。
@视频1用于<动作、运镜或节奏>。
@音频1用于<角色或声音类型>的<音色、台词、环境声或音乐>。
<主体>在<场景>中完成<主要动作或事件>。
画面呈现<视觉风格>，镜头采用<镜头表达>。
```

**示例**：
```
@图片1用于<陶艺师>的五官、发型和深绿色围裙，不采用图片背景。
@图片2用于<陶艺工作室>的木质工作台、窗户位置和晨间光线，不采用图中人物。
@视频1用于双手拉坯、托起陶杯和放置陶杯的动作节奏，不采用视频中的人物身份、服装和场景。
<陶艺师>在清晨的<陶艺工作室>完成一只浅蓝色陶杯，将它从转盘上取下并放到木架中央。
镜头先以中景记录拉坯动作，再缓慢推近陶杯表面的纹理；
保留转盘转动声、陶土摩擦声和室内环境声。
```

**多视角示例**（同一物体多个角度）：
```
@图片1定义同一盏折叠台灯的正面外观。
@图片2定义同一盏折叠台灯的左侧结构。
@图片3定义同一盏折叠台灯的右侧结构。
@图片4定义同一盏折叠台灯的背面结构。
四张图片共同定义同一盏折叠台灯，成片中始终只有一盏折叠台灯。
```

**注意**：
- **素材映射关系必须写进提示词**——不要只依赖图片中的文字标注，也不要让模型自行判断多份素材分别对应哪个人物、道具或场景
- 当参考视频已经准确给出动作、运镜和顺序时，提示词只需说明继承哪些内容，不必逐动作复述；重复描述可能与素材本身冲突
- 白模视频主要提供运动和空间骨架，仍需要写清希望生成的主体、场景、动作和风格

### 4.3 声音与文字的特殊字符（5 种符号）

| 用途 | 符号 |
|---|---|
| 音乐 | `· · ·` |
| 音效 | `< >` |
| 台词 | `{ }` |
| 字幕 | `【 】` |

**示例**：
```
·( )(背景播放舒缓节奏的钢琴乐)
<远处传来钟声>
{你好，欢迎回来}
【第一章：启程】
```

**禁用写法**：
```
无背景音乐，只保留人物对白、环境声和动作音效。
不要字幕。
不要任何声音。
```

#### 台词语言强化公式

台词不是中文时，建议在台词前明确语言：
```
女孩用日语轻声说：{もう大丈夫です}
```

当需要精确控制地区语言习惯时：
```
台词语言 ＋ 地区变体或口音 ＋ 表达方式 ＋ 说话人 ＋ {台词内容}
```

**示例**：
```
台词语言：美式英语。女孩用自然、口语化的美式英语说：{I thought you weren't coming.}
台词语言：地道的洛杉矶美式英语。年轻男子用自然的洛杉矶口语说：{No way, you actually made it.}
```

### 4.4 真人人物公式（去 AI 感核心）

```
人物 = [年龄/种族] + [肤色/皮肤质感] + [面部细节特征] + [眼神/灵魂] + [发型/发色] + [服装/服装质感] + [体型/情绪/气质]
```

- **年龄/种族**：[具体岁数]+[国籍/人种]+[风格形容词]+[脸型名词]
- **皮肤质感**：**必须带"保留真实的微细毛孔与肌肤纹理"**（可加雀斑/瑕疵）
- **面部细节**：眼型+眉骨+鼻梁+唇形+下颌线，至少 3-4 点组合
- **眼神/灵魂**：[眼神形容词]+[目光信息/比喻]+[底层情绪]

### 4.5 多素材创作公式（4 步编排，原文 §2.1）

**适用场景**：组合使用图片+视频+音频，多人物/多道具/多场景。

**4 步流程**：
1. **逐份素材职责** → 明确每张图/视频/音频负责什么
2. **主体映射** → 不同人物/商品/道具分别绑定素材（不要写"@图片1至@图片4分别定义四名角色"）
3. **按类型整理素材** → 分为【人物】/【道具】/【场景】/【动作与声音】四块
4. **主体设定** → 同一人物跨场景使用时，集中描述其完整属性

**完整模板**：
```
【人物】
<修复师>对应@图片1，只采用外貌、发型和服装。
<记录员>对应@图片2，只采用外貌、发型和服装。
<布展员>对应@图片3，只采用外貌、发型和服装。
<讲解员>对应@图片4，只采用外貌、发型和服装。
四人的外貌、服装、动作、站位和台词不互相交换。

【道具】
<样本盒>对应@图片5，只属于<修复师>。
<记录板>对应@图片6，只属于<记录员>。

【场景】
<修复室>参考@图片7，只采用空间、材质和光线。
<展厅>参考@图片8，只采用空间、材质和光线。

【动作与声音】
@视频1用于<修复师>打开样本盒的动作，不采用视频中的人物和场景。
@音频1用于<讲解员>的音色和指定台词。

【主体设定：修复师】
外貌与服装：@图片1。
固定道具：@图片5中的<样本盒>。
出现地点：<修复室>和<展厅>。
动作参考：@视频1的开盒动作、@视频2的放置样本动作。
不采用：其他人物的服装，不持有<记录板>或讲解设备。

【场景调用】
场景一｜修复室检查
使用：<修复师>、<样本盒>、<修复室>和@视频1的开盒动作。
事件：<修复师>在工作台前打开样本盒并检查内部样本。
结束时：<修复师>停在工作台内侧，样本盒始终位于<修复师>自身右手旁，也就是位于画面左侧。

场景二｜展厅登记
使用：<记录员>、<记录板>和<展厅>。
事件：<记录员>在展柜旁核对记录板上的编号。
结束时：记录板仍由<记录员>双手持有，其他人物不进入展柜区域。
```

**核心要点**：多素材创作的目标是让模型在当前场景中**选择正确素材**，不要求所有素材同时出现在画面中。

### 4.6 30 秒长视频公式（阶段组织，原文 §2.2）

**关键原则**：事件较多时，把故事拆成连续阶段；每阶段只安排一个主要状态变化，并写清该阶段结束时画面中可以直接看到的状态。

**模板**：
```
【生成目标】
生成一段<视频类型>。核心主体是<主体>，主要事件是<故事概要>。

【阶段一】
开始时：<人物、道具和场景的初始状态>。
主要事件：<一个主要动作或事件>。
结束时：<人物位置、道具归属或画面状态>。

【阶段二】
承接上一阶段：<需要保持的状态>。
主要事件：<一个主要动作或事件>。
结束时：<可观察状态>。

【阶段三】
主要事件：<收束事件>。
结束时：<最终画面状态>。

【保持一致】
保持<人物身份、数量、服装、道具归属、空间方向和声音关系>稳定。
```

**示例（花店订单包装流程）**：
```
生成一段花店订单包装流程说明视频。<花艺师>和<店员>共同完成花束整理、包装和交付。

【阶段一】
开始时：<花艺师>站在工作台后，桌面放有散开的花枝、剪刀和包装纸。
主要事件：<花艺师>整理花枝并修剪长度。
结束时：花束握在<花艺师>左手，剪刀放回工作台右侧。

【阶段二】
承接上一阶段：两人保持相同身份和服装，花束仍由<花艺师>持有。
主要事件：<店员>展开包装纸，<花艺师>放入花束并系上绿色丝带。
结束时：包装完成的花束平放在工作台中央，丝带结朝向镜头。

【阶段三】
主要事件：<店员>拿起花束并放到取货架上。
结束时：花束只在取货架中央，两人站在工作台后方检查成品。

【保持一致】
保持<花艺师>和<店员>的身份、服装、工作台方向、剪刀位置和花束归属稳定。
```

#### 时间戳与节奏控制

**普通叙事优先使用"阶段"**。只有关键交接、进出场、转场或明确节拍需要控制时，再使用以 1 秒为单位的时间表达。

| 表达类型 | 适合场景 | 示例 |
|---|---|---|
| **时间区间** | 分配剧情节奏 | `0-5秒：展示空置的木质展示台；一只手放下白色陶盘；结束时手已离开，展示台中央只有白色陶盘。5-10秒：移走白色陶盘，再放下透明玻璃杯……` |
| **明确时间点** | 指定一次关键事件 | `第5秒，镜头快速向左横移并完成转场。` |
| **相对时间** | 描述事件之间的等待关系 | `人物按下按钮3秒后，房间灯光逐渐熄灭。` |

**注意**：
- 时间段应连续、不重叠
- 时间段表示事件的时间预算，不是精准剪辑点，动作可能在边界附近提前或延后
- 一个时间段中的内容过少会增加模型的发挥空间，内容过多则可能造成过度切镜或剧情遗漏
- **不要用时间戳控制"一秒完成三次动作"等频率**

### 4.7 编辑 / 首尾帧 / 延长任务参数规则（自动锁定）

| 任务类型 | 画幅比例 | 时长 | 其他限制 |
|---|---|---|---|
| **视频编辑** | 自动保持输入视频比例 | 自动基本保持输入视频时长（最大约 0.3s 差异） | 比例/时长不支持另行设置 |
| **首帧或首尾帧生视频** | 自动使用首帧图片的比例 | 支持设置 | 首帧与尾帧应使用相同画幅，避免尾帧被拉伸 |
| **视频延长** | 自动保持输入视频比例 | 支持设置（延长时长） | — |

被自动锁定的参数不能在生成页面或接口中另行指定。

### 4.8 视频编辑公式（4 Case 完整模板，原文 §2.4）

**通用框架**：
```
【编辑目标】编辑@视频1，在<全片或明确时间段>对<画面对象、区域或声音类别>进行<增加、移除、替换或调整>。
【原视频职责】@视频1是唯一编辑母版，负责<人物、场景、动作、构图、镜头、遮挡关系、声音和事件顺序>。
【目标素材职责】@图片1或@音频1用于<目标对象或声音的指定属性>。
【编辑范围】只处理<对象、区域、时间段或声音类别>。
【保持内容】保持@视频1中的<不应变化的画面、动作、声音和时间关系>。
```

#### Case A：主体替换

```
【编辑目标】编辑@视频1，只把<原对象>修改为<目标对象>。
【原视频职责】@视频1是唯一编辑母版，负责原始场景、机位、镜头运动、动作轨迹、遮挡关系和事件顺序。
【目标素材职责】@图片1用于<目标对象>的<外观、结构或材质>，不采用<无关背景、人物或构图>。
【编辑对象与范围】只修改<明确对象和区域>。全片目标对象数量为<数量>。不修改<需要保持的内容>。
【时间线继承】<目标对象>继承<原对象>每次出现、运动、遮挡和离开的时点、持续时长、路径与速度变化。
除以上明确修改对象或区域外，@视频1中的其他人物、道具、场景内容、镜头运动、镜头切换和事件顺序保持原样。
```

**示例**：
```
【编辑目标】编辑@视频1，只把视频中的黄色折叠台灯替换为@图片1中的白色折叠台灯。
【原视频职责】@视频1是唯一编辑母版，负责书桌、书本、手部动作、机位、镜头运动、遮挡关系和事件顺序。
【目标素材职责】@图片1只用于白色折叠台灯的外观、结构和材质，不采用图片中的背景、构图或其他物体。
【编辑对象与范围】全片始终只有一盏白色折叠台灯。只替换原黄色折叠台灯，不修改书本、书桌、手部和背景。
【时间线继承】白色折叠台灯继承原黄色折叠台灯每次出现、转动灯臂、被手遮挡和离开画面的时点、路径与速度变化。
除以上明确修改对象或区域外，@视频1中的其他人物、道具、场景内容、镜头运动、镜头切换和事件顺序保持原样。
```

#### Case B：背景替换

```
@视频1是唯一编辑母版，负责人物、动作、构图、镜头和事件顺序。
@图片1只提供<目标环境>的空间布局、材质、景深、环境色和光线方向，不采用图中的人物或前景物体。
只把@视频1中人物轮廓之外的<原背景区域>替换为@图片1中的<目标环境>。
人物身份、五官、发型、服装、表情、位置、大小和动作保持@视频1。
除以上明确修改对象或区域外，@视频1中的其他人物、道具、场景内容、镜头运动、镜头切换和事件顺序保持原样。
```

#### Case C：声音编辑

```
编辑@视频1，只移除原有背景音乐，保留人物对白、口型、环境声和动作音效；画面内容、镜头和剪辑节奏保持@视频1。
编辑@视频1，把<讲解员>的台词语言调整为自然的美式英语，台词内容和说话时点保持不变；其他人物声音、背景音乐、环境声和画面保持@视频1。
```

#### Case D：局部编辑

```
【编辑目标】编辑@视频1，只在<时间段>把<画面对象/区域>调整为<目标状态>。
【原视频职责】@视频1是唯一编辑母版，负责人物、房间布局、动作、构图、镜头运动、声音和事件顺序。
【编辑范围】只调整<对象或区域>；<关联属性如肤色>随环境光自然变化。
【保持内容】人物身份、服装、表情、位置、动作、房间结构、镜头运动、对白和环境声保持@视频1。
```

**示例**：
```
【编辑目标】编辑@视频1，只在4-7秒把画面右侧墙面的冷蓝色灯光调整为暖橙色灯光。
【原视频职责】@视频1是唯一编辑母版，负责人物、房间布局、动作、构图、镜头运动、声音和事件顺序。
【编辑范围】只调整右侧墙面及其照亮区域的光线颜色；人物肤色随环境光自然变化。
【保持内容】人物身份、服装、表情、位置、动作、房间结构、镜头运动、对白和环境声保持@视频1。
```

### 4.9 视频延长公式（边界连续性 7 项必保，原文 §2.5）

**核心原则**：视频延长是在原视频边界之外继续创作。**边界画面应追求视觉上的自然衔接**，不应理解为逐像素完全相同。

**向后延长**（先描述尾帧连续状态 → 再描述延长内容）：
```
@视频1是需要向后延长的原视频。向后延长@视频1。
延长片段的第一个画面直接承接@视频1的尾帧：
保持<主体姿态与朝向>、<道具位置>、<背景与空间关系>、<机位与构图>、<光线>、<声音状态>和<运动趋势>连续。
随后，<描述需要延长的新动作、事件、镜头或声音>。
延长过程中保持<人物身份与服装>、<关键道具>、<背景布局>、<摄影轴线>和<原有声音环境>连续。
同一主体始终保持为同一个连续对象，不重复、不分裂；人物外形或物体部件数量保持稳定。
```

**7 项必保（边界连续性清单）**：
1. 主体姿态与朝向
2. 道具位置
3. 背景与空间关系
4. 机位与构图
5. 光线
6. 声音状态
7. 运动趋势

**向前延长**（先描述前置内容 → 写清首帧衔接）：
```
@视频1是需要向前延长的原视频。向前延长@视频1。
在原视频开始之前，<描述前置动作、事件、镜头或声音>。
延长片段的最后一个画面自然衔接@视频1首帧：
<主体姿态与朝向>，<道具位置>，<背景与空间关系>；
保持<机位与构图>、<光线>、<声音状态>和<运动趋势>与@视频1首帧一致。
延长过程中保持<人物身份与服装>、<关键道具>、<背景布局>、<摄影轴线>和<原有声音环境>连续。
同一主体始终保持为同一个连续对象，不重复、不分裂；人物外形或物体部件数量保持稳定。
```

**有其他参考素材时（向后延长）**：
```
@图片1定义<人物A>的面部特征。
@图片2定义<人物A>的服装。
@图片3定义<关键道具>的结构与材质。
@视频1是需要向后延长的原视频。向后延长@视频1。
延长片段的第一个画面直接承接@视频1尾帧：保持<边界画面与声音状态>连续。
随后，<人物A使用关键道具完成的新动作或事件>。
延长过程中保持<人物A的身份与服装>、<关键道具>、<背景布局>、<摄影轴线>和<原有声音环境>连续。
同一主体始终保持为同一个连续对象，不重复、不分裂；人物外形或物体部件数量保持稳定。
```

**向前延长+其他素材**：
```
@图片1定义<人物A>的面部特征。
@图片2定义<人物A>的服装。
@图片3定义<关键道具>的结构与材质。
@图片4定义两名<布展助理>的灰色工作服。
@图片5定义<展陈准备室>的空间和光线。
@视频1是需要向前延长的原视频。向前延长@视频1。
在原视频开始之前，<人物A完成前置动作或事件>。
延长片段的最后一个画面自然衔接@视频1首帧：
<人物A>的姿态与朝向，<关键道具>的位置与状态，其他人物的站位；
保持<背景与空间关系>、<机位与构图>、<光线>、<声音状态>和<运动趋势>与@视频1首帧一致。
延长过程中保持<人物身份与服装>、<关键道具>、<背景布局>、<摄影轴线>和<原有声音环境>连续。
同一主体始终保持为同一个连续对象，不重复、不分裂；人物外形或物体部件数量保持稳定。
<只在原视频开始后出现的素材>不在向前延长片段中提前出现。
```

### 4.10 超长视频公式（30-180s 一次性直出）

```
【全局参数】（开头重申时长/画幅）+ 【素材描述】+ 【一句话概述】+ 【具体情节描述】+ 【全局补充】
```

**示例**：
```
全程3分钟，@图片1猫咪打工vlog，视频比例16：9……
全程无字幕，无背景音乐。
```

### 4.11 关键帧公式（首尾帧独立 + 多关键帧顺序控制，原文 §3.1）

#### 首尾帧独立写法（不依赖首尾帧模式）

**模板**：
```
@图片1作为首帧，定义视频开始时的构图、主体位置、姿态、道具状态、场景和镜头方向。
@图片2作为尾帧，定义视频结束时的构图、主体位置、姿态、道具状态、场景和镜头方向。
@图片3用于<主体A>的<外貌、服装、结构或材质>，不改变@图片1定义的首帧构图，不改变@图片2定义的尾帧构图。
@图片4用于<主体B、道具或场景>的<指定属性>，不改变@图片1定义的首帧构图，不改变@图片2定义的尾帧构图。
<描述一个连续动作或事件>。
画面从@图片1定义的首帧自然开始，经过连续动作后到达@图片2定义的尾帧。
首尾之间保持<人物身份、道具结构与归属、场景布局和镜头方向>连续。
```

**每张锚点图需要单独说明**——不要合并成"图片1和图片2作为首尾帧"。首帧和尾帧应使用相同画幅。其他参考图只提供指定属性，不替代首尾帧的构图。

#### 多关键帧顺序控制（4 段式）

**模板**：
```
以@图片1至@图片N的顺序作为关键帧。
@图片1作为首帧，定义<开始时的构图、主体位置、姿态、道具状态和镜头方向>。
@图片2定义第二个关键帧：<第一阶段结束时的可见状态>。
@图片3定义第三个关键帧：<第二阶段结束时的可见状态>。
@图片N作为尾帧，定义<结束时的构图、主体位置、姿态、道具状态和镜头方向>。
画面依次经过@图片1、@图片2、@图片3至@图片N定义的状态，各阶段之间使用连续动作自然过渡。
全过程保持<主体身份、道具结构与归属、场景布局、光线和摄影轴线>连续。
```

**示例**：
```
以@图片1至@图片4的顺序作为关键帧。
@图片1作为首帧，定义橙色纸飞机静置在教室木桌左侧，机头朝向画面右侧，固定中景。
@图片2定义第二个关键帧：同一架橙色纸飞机被一只手从桌面托起，机头方向不变。
@图片3定义第三个关键帧：同一架橙色纸飞机从窗边掠过，窗帘向右轻微摆动。
@图片4作为尾帧，定义同一架橙色纸飞机落在右侧书架中层，机头仍朝向画面右侧。
画面依次经过@图片1、@图片2、@图片3和@图片4定义的状态，各阶段之间保持飞行方向和速度连续。
全过程保持纸飞机的橙色材质、大小与折痕，教室布局、午后侧光和镜头轴线连续。
```

**重要**：独立关键帧通常比把多个画面拼在一张宫格图中更容易对齐，但它控制的是**阶段顺序和关键状态**，**不等于逐帧复刻**。

### 4.12 宫格分镜公式（必写读取顺序，原文 §3.1）

**模板**：
```
@图片1提供<N格宫格分镜>的镜头顺序和大致构图，按照<从左到右、从上到下>的顺序读取；
不采用图中的<线稿画风、文字标注或占位人物>。
@图片2定义<主体A>的<外貌与服装>。
@图片3定义<关键道具或场景>的<结构、材质或光线>。
镜头1：<景别、主体动作、场景状态>。
镜头2：<景别、主体动作、运镜或切换方式>。
……
镜头N：<结束动作和结束画面状态>。
最终画面采用<视觉风格>，声音包括<对白、环境声、动作音效或音乐>。
```

**建议**：
- 控制在 **15 格以内**
- 使用简洁线稿或干净示意图，减少文字标注
- 明确读取顺序，再写出每格的主体动作、景别或运镜、最终画风和声音

### 4.13 多宫格分镜公式（强化版）

1. 先介绍分镜指代（每个分镜=一个镜头，非人物/场景）
2. 主体设定（引用参考图详述角色）
3. 分镜头描述（故事梗概逐镜补齐，控构图/景别/运镜/动作，带时间戳如 `镜头1（0-3s）`）
4. 其他：全局风格、禁止项（禁止换脸变形/新增无关人物等）

### 4.14 白模公式（粗粒度 + 细粒度）

#### 粗粒度白模

```
@视频1是粗粒度白模参考，仅提供<动作路径、人物站位、机位、运镜、切镜、光影变化、声音节奏或空间关系>，不采用其中的白模外观、材质和场景。
@视频1中的<白模主体A>对应<主体A>。
@视频1中的<白模主体B或几何道具>对应<主体B或关键道具>。
@图片1定义<主体A>的<外貌、服装或结构>。
@图片2定义<主体B、关键道具或场景>的<指定属性>。
<主体>在<场景>中完成<主要动作或事件>。
保持@视频1中的<动作路径、站位、运镜、切镜、光影或声音节奏>。
最终画面采用<人物、场景、材质和视觉风格>，声音包括<对白、环境声或动作音效>。
```

**白模信息 → 需要说明的内容**：
| 信息维度 | 需要在提示词中说明 |
|---|---|
| **动线** | 动作轨迹、运动方向、人物站位和进出场顺序 |
| **运镜** | 机位、镜头路径、运动方向和速度变化 |
| **光照** | 光线方向、明暗变化和变化发生的时机 |
| **切镜** | 切镜位置，以及切镜前后的主体与构图 |
| **声音** | 是否继承对白、音乐、环境声或动作音效 |

**注意**：优先使用关系清楚的简单几何体。手臂、翅膀等附属结构只有在动作序列完整时才适合作为白模信息，否则容易造成动作僵硬或结构误判。

#### 细粒度白模

```
@视频1是细粒度白模参考，保持<主体结构、动作、空间布局、机位、运镜和切镜>，不采用原有灰模材质和空白背景。
@图片1定义<主体>的<人物形象、材质、颜色或表面细节>。
@图片2定义<场景>的<空间、材质、光线或视觉风格>。
将@视频1中的<主体>重渲染为<最终主体>，场景重渲染为<最终场景>。
保持@视频1中的<结构、动作、镜头和空间关系>，画面呈现<材质、色彩和风格>，声音包括<环境声、音效或音乐>。
```

### 4.15 一键成片公式（原文 §3.2，新增章节）

**适用场景**：把多张图片，或图片与风格参考视频，组织成具有统一节奏和包装风格的完整视频。

**核心原则**：提示词需要说明**每份素材的职责、图片顺序、画面动态、剪辑节奏、视觉包装和声音**；不要只写"把这些素材做成视频"。

**5 步编排顺序（显式 Step 编号，便于检索）**：

| Step | 步骤 | 关键产出 |
|---|---|---|
| **Step 1** | **素材职责** | 每份图/视频具体提供什么（@图片1 用作 X / @视频1 仅用作 Y） |
| **Step 2** | **图片顺序** | 逐张写明出现顺序（按 @图片1-@图片N 顺序 / 自由编排） |
| **Step 3** | **动态幅度** | 每张图的运动幅度（轻微 Live 动效 / 视差 / 推拉 / 横移 / 局部动作） |
| **Step 4** | **剪辑风格** | 节奏、转场、字幕、图形包装、色彩 |
| **Step 5** | **声音** | 对白、环境声、音效、音乐 |

**模板**：
```
【素材职责】
@图片1用于<人物、商品、场景或开场画面>。
@图片2用于<人物、商品、场景或过程画面>。
@图片3用于<人物、商品、场景或结尾画面>。
@视频1仅用于<剪辑节奏、转场、字幕包装或音乐风格>，不采用其中的人物身份和场景（可选）。

【编排方式】
图片按照<上传顺序、指定顺序或主题自由编排>出现。
<说明需要保持的人物、商品、地点和事件关系>。

【画面动态】
每张图片采用<轻微Live动效、视差、推拉、横移或局部动作>。
保持<主体外观、商品结构、文字或背景关系>稳定。

【成片风格】
采用<剪辑节奏、转场方式、字幕或图形包装、色彩风格>。

【声音】
包括<对白、环境声、音效或音乐>。
```

**示例（夜市旅行短片）**：
```
【素材职责】
@图片1用于夜市入口和开场环境。
@图片2用于<旅行者>沿街行走的画面。
@图片3用于灯笼摊位和手工艺细节。
@图片4用于三位朋友围桌用餐。
@图片5用于河边夜景和倒影。
@图片6用于三人在桥边合影的结尾画面。
@视频1仅用于轻快剪辑节奏、手绘贴纸和转场方式，不采用其中的人物身份与地点。

【编排方式】
画面按照@图片1至@图片6的顺序出现，形成"到达夜市、沿街游览、用餐、散步、合影"的完整过程。
保持三位朋友的外貌与服装稳定，不互相混合。

【画面动态】
环境图片采用缓慢推近和轻微视差；人物图片只增加自然眨眼、转头、举杯和衣物随风摆动。
保持摊位结构、餐桌位置和桥边栏杆稳定。

【成片风格】
采用明快的旅行短片节奏，场景之间使用自然遮挡和相近色彩衔接，手绘贴纸只出现在画面边缘。

【声音】
保留夜市人声、餐具轻响和河边风声，配合轻快但不过分抢眼的器乐音乐。
```

**注意**：图片顺序重要时，应逐张写明出现顺序；允许模型自由编排时，也要明确写出"可按主题自由编排"。涉及多个人物或多个商品时，仍需逐一命名并绑定素材。

---

## 五、转场库（切镜/延长时用）

| 类型 | 说明 | 适用 |
|---|---|---|
| 自然镜头切换 | 强调呼吸感、留足切换时间 | 常规叙事 |
| 淡入淡出 | 全黑/全白浮现或暗去 | 开头结尾、"第二天" |
| 叠化 | 1-2s 柔和重叠交融 | 回忆/梦境/抒情 |
| 白闪/黑闪 | 瞬间闪白/闪黑 | 卡点/紧张氛围 |
| 遮罩转场 | 物体遮挡镜头→穿出 | 空间穿越 |
| 水墨转场 | 水墨风格过渡 | 国风 |
| 相似物转场 | 形状匹配 | 创意衔接 |
| 焦距/旋转变装/俯冲转场 | 视觉冲击 | 混剪/变装挑战 |

---

## 六、去 AI 感实战要点

- 追求真实感："原生皮肤质感"、"毛发根根分明"
- **长尾动作**（高难度/不常见动态：特殊舞蹈、复杂武术、细微神态）：描述完整动态链（"武术家在雨中后空翻，落地拔剑，雨水顺剑刃滑落"）
- 多镜头一致性：保持角色基本特征描述贯穿所有镜头
- 去字幕/BGM："纯净视频，无字幕，无背景音乐"（2.5 已大幅优化响应）
- 多语言：直接母语写 prompt + 写目标语言台词（成片文字可指定"所有文字必须全部为韩文"）
- 电商分栏模板可用参考图锚定版式："参考图作为风格和版式锚定，保持分栏边框样式、字体排版、光影质感全程统一"

---

## 七、避坑记录（官方承认的局限 + 实测）

- 白模粗颗粒度优先；细颗粒度需干净无干扰的模型视频
- 主体/素材超量时稳定性下降，需抽卡（官方承认）
- 局部消除偶发物理不合理（案例：消除人物后帽子掉落无征兆）——复杂交互需抽查
- 输出分辨率仅 480p/720p，4K 需后期（用户 12GB 显存可本地 LTX 升分辨率）
- 超长视频模式适合一次性长片；短片多次套娃延长可精确控制每段内容

---

## 八、一键成片（详见 §4.15）

> 本节为路径快捷入口；完整公式 + Step 1-5 模板 + 示例见 [§4.15 一键成片公式](#415-一键成片公式原文-32新增章节)。

---

## 九、无缝转场（原文 §3.3 完整覆盖，7 步模板）

---

## 十、情绪方向与可观察表现（原文 §3.4）

**核心原则**：只写"紧张、温馨、压抑"等情绪词，模型可以理解整体方向，但具体表演方式会有更多发挥空间。如果希望稳定控制人物演技，建议写明**眼神、眉头、嘴角、呼吸、视线和手部动作**等能够直接看到或听到的表现。

**不必罗列所有面部细节**。单次情绪转折通常选择 **2 至 4 个**最明确的表现即可；只有当情绪包含多次转折时，才需要按触发事件分阶段描述。

### 单次情绪转折（默认写法，Step 1-4）

```
Step 1｜整体情绪：从<起始情绪>转为<结束情绪>。
Step 2｜触发：发生<触发事件>后，<主体>先出现<即时可观察反应>。
Step 3｜递进：随后，<眼神、眉头、嘴角、呼吸、视线或手部动作>逐渐发生<变化>。
Step 4｜收束：最终，<主体>以<克制或明确的外在表现>表达<目标情绪>。
```

### 多阶段情绪（按触发事件递进，Step 1-3）

```
Step 1｜第一次触发：听到或看到<第一个触发事件>时，<主体的第一个可观察反应>。
Step 2｜第二次触发：当<第二个触发事件>出现后，<主体的表情、视线或呼吸发生的变化>。
Step 3｜确认后：确认<关键信息>后，<主体试图克制或掩饰的情绪>通过<可观察表现>逐渐显现。
（可选 Step 4｜最终动作：<主体的最终动作、表情或说话方式>。）
```

**示例**：
```
舞台后方传来演出结束的掌声。
年轻演员握住节目单的手指突然停住，视线缓慢转向幕布方向，肩膀仍然紧绷。
确认谢幕后，她先轻轻呼出一口气，肩膀逐渐放松，嘴角浮现克制的微笑，眼眶慢慢湿润，但始终没有转身离开。
```

---

## 十一、专业摄影术语（原文 §3.5）

### 基础镜头语言

| 类别 | 术语 |
|---|---|
| **景别** | 大全景、全景、中景、近景、特写 |
| **运镜** | 推、拉、摇、移、跟、环绕、俯冲、后拉、上摇、手持晃动 |
| **机位与视角** | 低角度、俯视、第一人称 |

### 7 种热门运镜（可直接使用，Step 编号）

| Step | 运镜 | 必填字段 | 典型示例 |
|---|---|---|---|
| **Step 1** | **一镜到底** | 镜头连续经过的主体 + 空间 + 事件顺序 | "镜头从咖啡馆门口一路跟随<主角>穿过吧台、过道、储物间，最后停在二楼窗前" |
| **Step 2** | **希区柯克变焦** | 主体保持的大小 + 背景空间被拉近/推远的效果 | "<主体面部>始终保持原大，背后的走廊空间被缓慢拉近" |
| **Step 3** | **航拍视角** | 俯视高度 + 移动方向 + 环境范围 | "镜头从<山顶>200 米高度沿山脊向北推进，覆盖整片原始森林" |
| **Step 4** | **FPV** | 第一人称飞行/穿行路径 + 速度 + 转向 | "FPV 镜头从<地铁站入口>高速冲入，连续穿越闸机、扶梯、月台，最后冲出隧道" |
| **Step 5** | **子弹时间** | 被冻结/放慢的动作 + 镜头环绕方向 | "<子弹>出膛瞬间被冻结，镜头以 360° 弧线环绕主体" |
| **Step 6** | **手持镜头** | 跟拍对象 + 晃动程度 | "镜头紧跟<记者>穿过人群，轻微晃动模拟奔跑节奏" |
| **Step 7** | **回弹变速** | 加速/减速/回弹节点 + 最终停留状态 | "<滑板>在第 3 秒突然减速回弹，最后停在画面左侧" |

**注意**：术语较少见、可能存在多种理解，或需要精确控制画面变化时，应同时说明**术语作用于谁、画面如何变化，以及希望看到的结果**。

### 小众摄影术语（必须翻译成画面变化）

```
公式：专业术语 ＋ 作用主体 ＋ 画面变化 ＋ 前/背景关系 ＋ 方向或速度
```

**示例**：
```
移焦：焦点从前景树叶平滑转移到背景人物。树叶逐渐虚化，背景人物的面部由模糊变得清晰。
```

### 5 个摄影表达示例

| 示例 | 写法 |
|---|---|
| **1. 浅景深人像** | `<糕点师>的眼睛和面部保持清晰，身后的玻璃罐和灯光虚化成柔和圆形散景。` |
| **2. 追随摄影** | `镜头与<滑板者>同速水平移动，人物保持清晰，街边墙面形成从右向左的水平拖影。` |
| **3. 黄金时刻** | `暖色低角度阳光从<登山者>左后方照入，山脊地面形成较长阴影。` |
| **4. 自然暗角** | `画面四角逐渐变暗，中心<钢琴演奏者>的亮度和肤色保持正常，不出现黑色边框。` |
| **5. 甩镜转场** | `第5秒镜头快速向左横移；前景书架完成整屏遮挡时切换到下一场景，切换后镜头继续保持向左运动和相近速度。` |

**注意**：光圈、焦距和快门数值可以写入提示词，但最终画面的可见结果通常比单独写一个数值更明确。

---

## 十二、能力边界（原文 §5，9 条限制）

> 这是 2.5 当前的能力边界，使用时必须遵守；超出会导致结果不可控。

1. **时间戳只能用于分配事件节奏，不是帧级剪辑点**——动作可能在边界附近提前或延后
2. **视频编辑提示词可以提高关键事件与原视频对齐的概率，但不能保证逐帧完全重合**
3. **多素材创作的重点是正确选择和组合素材，不是让所有素材同时出现**
4. **必须完全准确的字幕、公式、标牌、产品参数和帧级时间点，建议通过前期合成好的素材＋视频生成＋后期制作完成**
5. **视频编辑会锁定输入视频比例和基本时长**——这两项不支持另行设置；输出时长与输入视频可能有最大约 0.3 秒的差异
6. **首帧或首尾帧生成会以首帧画幅锁定比例，时长可以设置；首尾图比例不同可能使尾帧出现拉伸**
7. **视频延长会锁定输入视频比例，延长时长可以设置；延长片段的音量可能与输入视频存在轻微差异**
8. **一键成片中，如果图片顺序或人物对应关系重要，需要在提示词中明确指定**
9. **视频无缝转场追求视觉与声音连续，不代表两段原视频能够逐像素保持不变**

---

## 十三、提交前检查清单（11 项，原文 §4）

> 提交生成前，**逐项核对**以下 11 条；任一不满足就先改 prompt，不浪费抽卡次数。

1. **主体与事件**：是否说清楚了主体和主要动作或事件？
2. **素材职责**：每份参考素材是否明确说明采用什么、不采用什么？
3. **人物道具命名**：不同人物、商品和道具是否逐一命名并绑定素材？
4. **多素材场景选择**：多素材是否按场景选择，而不是要求全部同时出现？
5. **长视频阶段**：长视频的每个阶段是否只有一个主要变化，并写清结束状态？
6. **一致性**：人物数量、服装、道具归属和空间关系是否稳定？
7. **视频编辑四要素**：是否明确唯一母版、修改范围、目标数量和保持内容？
8. **情绪与术语翻译**：抽象情绪和摄影术语是否对应了可以直接看到或听到的表现？
9. **关键帧与首尾帧**：首尾帧和多关键帧是否逐张说明职责，首帧与尾帧是否使用相同画幅？
10. **白模与分镜**：宫格分镜是否写清继承的结构；白模是否先判断粗粒度或细粒度，并写清需要继承的时序、结构、材质和风格？
11. **任务参数锁定**：视频编辑、首尾帧生成和视频延长是否遵循自动锁定的比例与时长规则？视频延长是否同时检查边界画面、运动趋势和声音连续性？一键成片是否说明素材职责、图片顺序、动态幅度、剪辑风格和声音？无缝转场是否写清两段视频的职责、触发动作、过渡过程和到达状态？

---

## 十四、异常处理矩阵（fallback）

| 异常 | 处理 |
|---|---|
| 平台只有 2.0（fal/Ark/第三方路由） | 切 seedance-20 技能流程：参考图≤9/视频≤3/音频≤3，单次≤15s，无时间戳/白模/绿幕/超长 |
| 多参考+4K 任务挂死 | 超 5 分钟无输出即中止；切 t2i 无参考 + 详细文字描述重做（RunningHub 实测教训） |
| 主体/素材超量崩坏 | 先降载到 1-5 主体 / 5-10s / 20s 内，再考虑抽卡（§一 输入建议） |
| 白模动作僵化 | 换粗颗粒度 + 不上传四肢/翅膀模型；或用文字写全四肢动作序列 |
| 局部编辑物理不合理 | 缩小编辑范围或改文字指令重试；接受后人工剪辑修补 |
| 仍带字幕/BGM | 在全局补充（结尾）段重复禁止项——模型对结尾强调响应更好 |
| 输出分辨率不足 | 本地 LTX-2.3 升分辨率（12GB 显存可跑 1080p） |
| 参考素材超限 | 2.5 上限：30 图 / 10 视频(≤30s) / 10 音频(≤30s)；超了分批或抽关键帧 |
| 多关键帧顺序错乱 | 改为关键帧 4 段式（首帧/中间帧/尾帧/连续）+ 重抽 |
| 转场生硬/不连续 | 补"延长自然、动作衔接流畅、禁止生硬切镜"约束 + 检查 7 项边界必保 |
| 多人串脸 | 显式分组命名（【人物】/【道具】/【场景】）+ 不采用其他人物的服装 |

---

## 十五、版本与来源

| 版本 | 日期 | 主要变化 | 来源 |
|---|---|---|---|
| 1.0 | 2026-07-31 | 初版归档（飞书官方手册） | 飞书【即梦】Seedance 2.5 使用手册 |
| **2.0** | **2026-08-30** | **全量补强**：新增 §4.5 多素材 4 步 / §4.8 编辑 4 Case / §4.9 延长 7 项必保 / §4.11 首尾帧独立 + 多关键帧 / §4.15 一键成片 / §九 无缝转场 7 步 / §十 情绪可观察 / §十一 摄影术语 7 种运镜 / §十二 能力边界 9 条 / §十三 提交前 11 项检查 | 微信公众号《小互 AI》转载的官方提示词指南 |

---

**END OF SKILL**

