# Martial Arts Director Cy

> 武术指导 skill — 根据人物 / 武术流派 / 场景信息，生成一份 N 宫格武术动作分解海报提示词，并可把每一格拆分为独立的镜头/表达提示词供后续单张图或图生视频使用。借鉴电影武指（袁和平 / 成龙 / 甄子丹 / John Wick / 87eleven）的招式节奏与镜头语言。当用户说"武术指导"、"武术分解海报"、"武打分镜"、"招式分解"、"N宫格武术动作"、"武术套路海报"、"武术编舞海报"时触发。也适用于把现有舞蹈 / 动作分解海报提示词改写成武术版本。

- Skill: `gaojesse999/martial-arts-director-cy` (Agent Skill, multi-file: 33 files)
- Install (CLI): `npx skillmds@latest add gaojesse999/martial-arts-director-cy`
- Raw SKILL.md: https://api.skillmd.com/api/skills/gaojesse999/martial-arts-director-cy/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: gaojesse999 (https://skillmd.com/u/gaojesse999)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/gaojesse999/martial-arts-director-cy

---


# 武术指导（Martial Arts Director）

把一段武术套路 / 对打设计 / 动作戏拆解成 N 格 keypose，输出一份可直接喂给 AI 绘图工具的「N 宫格武术动作分解海报」完整提示词。可选地，再把每一格拆分为独立的「镜头/表达」提示词，供后续做单张高清图、图生视频或剧照拼图。

## 核心理念

- **图片默认 = 高清写实线稿图（v10.0 风格修正，必读 `references/line-art-style.md`）**：本 skill 的图片产出**默认渲染为「高清写实线稿图 / line art / 精密线描稿」**——演武主体与背景一律用「黑色线条 + 干净白底 + 排线 / 影线（hatching、cross-hatching）表达体积明暗」呈现，**不上色、不做照片级写实渲染、不做 CG / 二次元 / 插画**；但线稿必须精确还原 8K IMAX 院线真人实拍质感所需的全部真实人体结构、皮肤微观纹理、布料褶皱、明暗交界结构信息，**使后续可由 AI 从线稿还原为电影级写实风格**。这是一条「线稿 → 可还原写实」的工作流：图片是结构精准的写实线稿，视频 / 后续上色环节再把线稿还原成 8K IMAX 院线真人实拍风格。
- **角色化默认 + 白模为可选规避方案（v9.0，仍适用于"画什么人物"层面）**：在线稿这一渲染风格之下，**默认仍根据用户需求（年龄 / 性别 / 气质 / 调性 / 武术体系 / 影视参考）适配具象演武者形象**（只是以写实线稿而非彩色照片呈现），让画面有真实人物的张力与情感。白模只在两种场景下使用：(1) 用户明确要做版权规避（如复刻 IP 桥段时避免侵权）；(2) 用户明确要做动作 retarget 工作流（动作设计独立于最终角色）。其余情况直接根据用户需求想象适配的具象角色（写实线稿呈现），不要硬套白模。
- **武术作为艺术（v9.0 核心维度）**：武术不只是动作，而是**身形 + 节奏 + 力道 + 气韵 + 弧线 + 静动对比 + 环境对话**七维艺术。视频与图片都要承载这些艺术性元素：
  - **身形之美**：身姿的舒展 / 收放 / 倾仰，肢体线条的雕塑感
  - **节奏之美**：呼吸感 / 留白 / 顿挫 / 流动，"动如脱兔静如处子"——长段爆发 + 突然减速 + 加速
  - **力道之美**：劲道贯穿 / 寸劲爆发 / 长劲蓄势 / 重心崩溃，让观众感受到"力"的传导
  - **气韵之美**：眼神 / 表情 / 杀气 / 凝望 / 屏息，传递人物内在状态
  - **弧线之美**：刀光弧线 / 剑光残影 / 拳影轨迹 / 衣袂飘动，构成画面的视觉旋律
  - **静中有动**：定格瞬间饱含张力，对峙凝望胜过千招万式
  - **环境对话**：环境元素与招式互相塑造（具体环境如雨 / 雪 / 竹林 / 灯火等由 agent 根据题材选）

  **武术哲学专业术语锚点（v9.3 新增，让 agent 思考有深层概念支撑）**：
  - **武意（Wuyi / martial ideation）**：动静交替中的情感溢出——看似无招却有意、看似空白却饱含张力。一拳未发已有杀气，一招收住余韵未散。这是武术超越"打"的境界
  - **武术作为叙事诗**：每一招都在讲故事——人物的伤痛 / 觉悟 / 决断 / 爱恨 / 极限 都通过招式传递。打斗不是为了打，是为了说不能说的话
  - **美学化暴力（aestheticized violence）**：把暴力转化为视觉美感与哲学表达——血滴成珠 / 剑光成线 / 衣袂如旗 / 落地溅水。让观众感受到的不是恐惧，而是惊叹与肃穆
  - **道家"无"的形而上空白**：招与招之间的留白、动作与停顿之间的呼吸、对峙凝望中的沉默——这些"无"的瞬间往往比"有"的招式更打动人
  - **使用方式**：写图片 / 视频 prompt 时，agent 思考"这个题材的武意在哪里？这套打斗在讲什么故事？哪个瞬间是美学化暴力的高潮？哪里需要留白？"——而不是只编排招式
- **动作戏 7 大基础原则（v9.3 新增，电影学通识，clarity 第一）**：本 skill 输出的所有动作 / 武术 / 打斗内容必须满足以下 7 原则——这是电影动作戏的基本功，与具体题材 / 武术体系 / AI 模型无关：
  1. **Clarity 清晰（最高优先级）**：观众必须能跟得上每一招——谁打谁、用什么、命中哪、结果如何。这是动作戏第一原则，所有其他原则都让位于它。如果观众看不懂在打什么，再炫的招都是失败
  2. **Geography 场景几何**：人物在空间中的位置始终明确——A 在左 B 在右、A 持刀 B 徒手、距离两步、面朝彼此。每一招后位置变化都要可追踪，不能"瞬移"或失去方位感
  3. **Stakes 赌注**：观众要明白"这场打斗输了会怎样"——是生死、是尊严、是爱人、是觉悟。没有赌注的打斗是炫技，有赌注的打斗才让观众屏息
  4. **Motivation 动机**：每一招都是角色驱动——A 为什么主攻？B 为什么徒手？她们之前发生了什么？打斗不是为打而打，是人物内在的外化
  5. **Choreography 编排**：招式有创意、有逻辑、有节奏——避免"轻微换姿势"、避免抽象招式、避免与人物 / 武术体系不符的设计
  6. **Vulnerability 脆弱**：角色要被真实威胁——A 失刀那一刻 B 占优势 / B 倒地时 A 刀逼近 / 双方都在极限。脆弱让紧张感建立
  7. **Consequences 后果**：打斗有真实代价——衣袂破损 / 喘息加重 / 汗水雨水滑下 / 重心崩溃 / 关节阻力。每一击都有重量、每一动都有痕迹
- **武指 + 摄影指导联合产出（v9.1 核心升级）**：本 skill 不只设计动作，更设计**动作 + 镜头的一体化方案**——每一招都要配套镜头语言（景别 + 运镜 + 角度 + 速度），让最终视频达到电影级武指作品的水准。

  **电影镜头语言维度（仅作为方法论工具箱，不预设具体应用）**：
  - **景别**：大远景 / 远景 / 全景 / 中景 / 中近景 / 近景 / 大特写
  - **运镜**：固定机位 / 推（push in）/ 拉（pull out）/ 摇（pan）/ 横移跟拍（track）/ 升降（crane）/ 紧贴跟拍（handheld follow）/ 环绕（360 orbit / arc）/ 希区柯克变焦（dolly zoom）/ Whip Pan / 一镜到底（oner）
  - **角度**：平视 / 仰拍（威严力量）/ 俯拍（弱小全局）/ 鸟瞰 / 荷兰角（失衡紧张）
  - **速度**：实时正常速度（默认 80%+）/ 慢镜 / 凝固定格 / 子弹时间 / 快慢交替

  **这些维度只是工具箱，由 agent 根据用户题材动态选择应用**：什么招式配什么景别 / 什么节点用什么运镜 / 什么瞬间用什么速度——都不预设。
- **影视参考由 agent 动态思考与搜索（v9.2 反硬编码原则）**：本 skill **不预先列出"必须参考的电影清单"**——agent（Claude Code / Codex 等）在执行 skill 时，必须根据用户输入的具体题材 / 调性 / 武术体系 / 人物气质，**自主分析并选择 1-3 部最契合的影视参考作品**，然后把这些作品的镜头美学 / 节奏感 / 视觉风格融入图片与视频 prompt。具体执行：
  - 如果 agent 对用户题材有充分训练记忆 → 直接选用最契合的影视参考
  - 如果用户题材冷门、新颖、agent 不确定哪部最契合 → **主动调用 WebSearch / WebFetch 等工具**搜索"XX 题材武术电影代表作"、"XX 风格打斗经典镜头美学"、"XX 武术体系最佳影视范例"等关键词，获取最新参考资料
  - 生成最终 prompt 中**可以引用具体电影名**（这是模型理解风格的最大杠杆）——但这些电影名是 agent 当下根据题材动态选定的，**不是 skill 模板里预先硬编码的清单**
  - 同样原则适用于"武术体系动作设计"、"环境元素"、"调性参照"——agent 都应根据用户输入动态思考，必要时搜索补充，不套预设模板
- **同一人物锁定**：所有格子是同一个演武者、同一套服装、同一种调性，靠人物锚定卡防止 AI 跨格漂移
- **每招视觉差异化**：朝向、重心、肢体张开度、攻击部位都明显不同，避免"轻微换姿势"
- **可拆分**：主提示词出一张多宫格海报；每格还能单独拆出来做高清图或视频起始帧
- **动态生成，反硬编码**：骨架库 / 模板 / 强化关键词都是「工具箱」，不是「答案」。每次生成必须根据用户输入的人物、调性、场景、影视参考做实质性定制；同一题材两次调用，招式名 / 动作要点 / 姿态分配 / 景别选择都应有可观察的差异（至少 30% 不同），让 AI 出图也能呈现不同的演武编排
- **标准交付 = 1 份图片 prompt + 1 份视频 prompt（v9.6 根本性修正）**：本 skill 最终产出**两份提示词**：
  1. **多宫格分镜 prompt**（Step 3）→ 4×4 / 16 宫格分镜海报，既是用户的武指工作单（整体动作字典），**也是直接喂给视频模型的参考图**——用户拿到后无需额外加工
  2. **视频 prompt**（Step 4）→ 用户把多宫格海报 + 这段视频 prompt 一起喂给视频模型，生成 15 秒连贯打斗视频，**视频会按图中 16 格顺序连贯演完所有动作**

  **关键架构（解决"视频与图对不上"的根本性问题）**：视频模型默认会把多宫格图当作单帧拼贴而困惑，**所以视频 prompt 必须前置一段「参考图阅读协议」**，明确告诉视频模型：
  - 这张图是 4×4 = 16 格**分镜表**（不是多场景拼贴 / 不是单一画面）
  - **格序 = 时间序**：从左上第 1 格 → 按行优先（左→右、上→下） → 右下第 16 格，每一格是一个连续动作时间点
  - **15 秒视频 = 16 格动作的完整连贯演绎**，不漏任何一格、不增任何图外动作
  - **排除 UI 注释层**：图中编号 / 中文标题 / 要点 / 箭头 / 轨迹线 / 格子边框 / 文字标注全是分镜表的注释（武指工作单标记），不要渲染到视频，视频是单一连贯电影画面无格子分隔
  - **角色与场景一致性锚点**：每格的人物外貌 / 服装 / 武器 / 场景必须在视频全程保持一致（图就是这些信息的视觉锚点）
  
  **不需要再生成额外的"首帧图"**——多宫格图本身就是足够的视觉锚点 + 完整动作字典，前提是视频 prompt 中正确教会模型"如何读图"
- **最终视频效果优先（北极星指标）**：本 skill 不是出"好看的图"，也不是出"通顺的 prompt"，而是出**一段大片级打斗视频**。每个写作决策都要回答："这条对最终视频的**视觉冲击力 / 动作连贯性 / 打斗故事感**有什么贡献？"——没贡献就删，有反作用就改。三个核心要求：
  - **动作连贯性**：图作为视频起始帧必须能被自然驱动延展，keypose 是"运动中的瞬间"（剑刚劈到一半 / 拳头正向上身要害推进中 / 脚刚离地）而非"已完成的死姿态"
  - **大片打斗 essence**：必须包含冲击瞬间 / 节奏对比 / 空间立体调度 / 环境破坏 / 凝视停顿 / 死亡威胁感 等大片武指语法
  - **戏剧弧线**：起势凝神 → 试探 → 爆发 → 反转 → 高潮 → 收势，是讲一个打斗故事，不是堆砌招式
- **图视频零漂移（v8.3 强化）**：图片 prompt 与视频 prompt 必须**镜头一一对应、无遗漏、无幻觉、无 UI 串扰**：
  - **镜头无丢失**：图里 N 格 keypose 必须**全部出现在视频里**——可以"完整演 / 一笔带过 / 凝视聚焦 / 浓缩并击"，但**不能跳过**。Step 4 视频 prompt 必须显式输出「镜头覆盖清单」，让用户能逐格核对
  - **UI 不串扰**：图里的编号 / 中文标题 / 动作方向箭头 / 重心轨迹线 / 格子边框 / 网格分隔线 / 中文要点说明 是 pre-vis 海报的**工作单标记**，**不是画面内容**——视频生成时这些 UI 元素**严禁**出现，必须在视频 prompt 中显式排除
  - **环境与人物连贯**：视频中的人物服装 / 兵器形态 / 环境光感 / 调性必须与图严格一致，避免"图是白模 → 视频变成真人""图是黄昏 → 视频变成正午"等漂移

---

## 工作流（5 步，按顺序执行 + 双模式分流）

### Step 1｜信息收集（前期准备）

**模式分流（在收集信息前先判断用户意图）**：

| 模式 | 触发条件 | 处理路径 |
|------|---------|---------|
| **A. 创作模式**（默认） | 用户只给方向（如"做一个仙逆风的"、"做一个咏春的"、"女杀手双刀"） | 按下方 Step 1 表格走完整 9 字段 |
| **B. 桥段还原模式** | 用户指定具体作品桥段（如"还原叶问 vs 十个武道家"、"复刻仙逆 S1 第 X 集王林对战苏铭"、"重现《老男孩》走廊那场"），含「还原 / 复刻 / 重现 / 像 X 里的 Y 那样」等指向具体片段的词 + 具体作品 / 章节 / 场景 | 跳到本 Step 末尾的「桥段还原子流程」 |

**默认走 A 创作模式。** 如不确定，主动问用户："你是想自由创作一套（A），还是想还原某个具体桥段（B）？"

---

向用户列出下表，让用户用一段话回复即可（不要逐项追问）。任何字段缺失主动补问，已给出就跳过。

| 字段 | 说明 | 示例 |
|------|------|------|
| **呈现风格**（必填，默认高清写实线稿图 line art） | 图片的视觉表达方式 | **高清写实线稿图 / line art（默认，黑线白底、排线表达体积、可还原写实）** / 3D 白模 / 线框模型 / 木质人偶 / 黑色剪影 / **角色化彩色最终画面**（仅当用户明确要求上色时） |
| **体型与气质** | 性别气质、身高比例、体格倾向（线稿仍精确刻画真实人体结构） | 修长精瘦男性肩宽腿长 / 中等身材女性舞者身段 / 矮壮敦实大叔型 |
| **角色化外貌**（线稿默认也填） | 演武者具象外貌（线稿精确还原其真实人体结构）；仅纯白模规避模式可跳过 | 中国女孩长相、约 22 岁、英气、五官立体 |
| **角色参考图 + 挂载名**（可选，影响命名） | 是否随附演武者参考图及其挂载名 / 引用名。**有参考图 → 后续所有 prompt 直接引用「参考图挂载名」（如 `@女主`，不是参考图人物的真实角色名），不写泛化外貌；无参考图 → 用泛化视觉描述、不出现名字**（见 Step 3 规范 13b） | 提供参考图、挂载名 `@女主` / 自有角色照标 `@角色1` / 无 |
| **武术体系** | 传统武术 / 现代格斗 / 兵器 / 影视武指风格 | 咏春 / 八极 / MMA / 双刀 / John Wick gun-fu |
| **风格调性** | 写实硬派 / 飘逸写意 / 暴力美学 / 慢镜美学 / 长镜头压迫 | 暴力美学 + 慢镜头 |
| **装备简化表示** | 必要装备的极简表示（白模模式下用极简符号；角色化模式下用完整服装） | 白模：头束简洁布带 / 腰系窄腰带 / 脚踝绑带 / 持械护手 等极简符号；角色化：黑色短款机能马甲 + 紧身长裤 + 战术绑腿 + 皮革护腕 等完整服装 |
| **场景** | 地点 / 背景调性 / 光感 | 暗色舞台灰 / 竹林晨雾 / 雨夜霓虹街 / 中性灰背景 |
| **宫格规格** | 总格数 + 排布 | 16 = 4×4（默认）/ 9 = 3×3 / 12 = 3×4 / 4 = 2×2 |
| **是否带兵器** | 影响招式骨架 | 徒手 / 单刀 / 双截棍 / 长棍 / 软鞭 / 双枪 |
| **影视参考**（可选） | 喜欢的武指风格 | 袁和平《卧虎藏龙》/ 甄子丹《叶问》/ John Wick / 杀死比尔 / 老男孩长镜头 |

**输出物**：一份「人物锚定卡」表格，作为后续所有提示词的统一参数源。

> 如果用户只给了主题（如"做一个咏春的"），先按表格补全：默认 16 格、徒手、暗色舞台灰背景、暴力美学+电影武指调性，然后让用户对默认值做增删。

---

#### 桥段还原子流程（B 模式专用，替代 A 模式的 Step 1 表格）

进入还原模式后，**严禁 AI 凭印象自由发挥**——AI 对作品的"训练记忆"可能不准、过时、张冠李戴，必须以用户描述为准。

**收集字段**：

| 字段 | 说明 |
|------|------|
| **作品名 + 桥段定位** | 如：仙逆 S1 第 12 集王林初战苏铭 / 叶问 1 武馆十人战 / 杀死比尔 1 青叶屋大战 / 突袭 2 走廊群斗 |
| **桥段长度 / 总招式数** | 用户希望拆成几格（默认 16） |
| **参与角色逐一描述** | 每位角色：外貌、服装、武器、阵营 |
| **招式按时间顺序** | 每一招：谁做了什么动作 / 对谁 / 用什么武器 / 结果（命中 / 闪过 / 反击）|
| **关键镜头切换** | 哪几招用了特写 / 慢镜 / 长镜 / 跳切 |
| **环境与氛围** | 场地、光线、天气、配乐风格 |

**操作流程**：

1. 让用户**详细描述**桥段——不要催促、不要让用户简化
2. 如果 AI 对该桥段有印象（训练数据中存在），**主动告知**："我对这个桥段的印象是 XYZ，对吗？你想强调或修改哪些细节？"——但**必须等用户确认或修正**，不要直接当答案
3. 如果 AI 对该桥段无印象，**直接告知用户**："我对这个桥段没有可靠记忆，请你尽量详细描述每一招，我严格按你的描述拆分镜。"
4. 用户描述 + 确认后的细节，转换成标准的「人物锚定卡」+「N 招招式列表」
5. **B 模式不调用 `references/choreography-beats.md` 的骨架库**——招式列表完全来自用户描述，骨架库是泛化模板，不能用于精准复刻
6. 起势 / 收势仪式感、姿态配额、4 类强化关键词、虚化对手剪影等规则**仍然适用**——除非用户描述明确说"该桥段没有起势 / 直接打"

完成后，回到主流程的 Step 2（招式编排）继续，但跳过骨架库，直接用用户描述生成招式列表。

---

### Step 2｜招式编排（武指段子设计）

读取 `references/martial-arts-systems.md` 找到对应武术体系的招式词库，再读取 `references/choreography-beats.md` 选用与「宫格规格 × 武术体系 × 是否带兵器」匹配的段子骨架。

骨架要遵守的四条规则：

1. **每招视觉差异明显**：朝向（正/侧/背）、重心（高桩/中桩/低桩/腾空）、肢体张开度、主要发力部位都不能重复
2. **段间逻辑闭环**：起势 → 进攻段 → 防御/反击段 → 收势，符合套路或对打的真实节奏
3. **可视化优先**：选定格清晰、画面有张力的招式，避免"快速过渡动作"（如步法切换、虚招）单独占格
4. **风格匹配**：硬派选短促爆发的招式（寸拳、肘击、膝撞），写意选舒展飘逸的招式（云手、剑花、回旋踢）
5. **起势 / 收势仪式感**：第 1 格（起势）和第 N 格（收势）严禁默认成"双手负后正面站姿"——必须从下方仪式感动作池中根据角色调性动态选择，且起势与收势两者必须明显不同（如一个面对镜头一个背身、一个高桩一个低桩、或不同的手部状态）。
   - **仪式感动作池**：抱拳礼 / 持剑诀（食中二指竖立胸前）/ 单膝半跪 / 微微低头蓄势 / 立掌当胸 / 拈花指 / 双手合十 / 长身抱兵（持械礼）/ 撑剑而立 / 跨步亮势 / 回身扣手 / 双手负剑微低头 / 倚壁负手 / 横兵于膝
   - **选择依据**：人物调性（阴鸷→低头蓄势 / 庄严→抱拳礼 / 飘逸→拈花指 / 杀气→撑剑跨步 / 颓废→倚壁负手）+ 兵器（无兵器→抱拳礼或合十；剑→持剑诀或撑剑而立；棍→长身抱兵；枪→跨步亮势）

**动态生成原则（不可违反）**：

- 骨架是「招式词典」不是「答案模板」，必须基于用户输入做实质性定制：
  - 根据**人物性格**（阴鸷 / 豪迈 / 优雅 / 野性 / 颓废 / 冷静 等）调整招式风格
  - 根据**场景**（雪地 / 屋顶 / 走廊 / 竹林 / 道场 / 雨夜 / 沙漠 等）调整动作幅度与方向
  - 根据**影视参考**（袁和平 / 甄子丹 / 87eleven / 杀死比尔 等）调整节奏与镜头偏好
  - 根据用户**兴趣点**（"我喜欢飞剑回旋""不要雷术""加更多近身缠斗"等）增删
- 每次生成**至少替换、改写或重组 1/3 的骨架招式**，不要原样套用
- 同一题材连续两次调用，结果必须有明显不同（招式名 / 姿态分配 / 要点描述）

**姿态配额（强制）**：N 招的姿态分布必须满足以下下限，否则视觉差异不够，AI 出图会"每格都在站桩"：

- 至少 ⌈N/5⌉ 招**低桩**（半蹲 / 沉马 / 跪步 / 仆步）
- 至少 ⌈N/8⌉ 招**腾空或高位**（跳跃 / 仰头 / 双手举高）
- 至少 ⌈N/5⌉ 招**转身或背身**（背对镜头 / 侧身 90°）
- 至少 ⌈N/8⌉ 招**近景特写**（手部 / 兵器局部 / 眼神局部，画面只露上半身或局部）
- 其余可自由站姿

以 16 格为例：≥3 低桩 / ≥2 腾空高位 / ≥3 转身侧身 / ≥2 近景特写 / ≤6 自由站姿。

**输出物**：一份「N 招招式列表」，每招一行，在要点后用方括号标注姿态标签：

```
01｜起势抱拳礼 ｜ 双手抱拳胸前、目视正前、中桩 [自由站姿]
02｜进步直拳   ｜ 右脚上步、右拳水平直击、重心前倾 [低桩]
05｜转身扫腿   ｜ 转身 180°、右腿水平鞭击、双臂展开 [转身]
07｜腾空飞踢   ｜ 双脚离地、右腿前蹬、长袍狂舞 [腾空]
11｜符箓特写   ｜ 抓符箓的手指清晰、符光绽放 [近景特写]
...
16｜定格亮相   ｜ 单膝半跪、左拳收腰、右掌前推 [低桩]
```

把这份列表先给用户看一眼（不必等确认），再进 Step 3。

---

### Step 3｜组装多宫格海报提示词（核心产出）

读取 `references/poster-template.md` 与 `references/line-art-style.md`，把 Step 1 的人物锚定卡 + Step 2 的招式列表填入主模板，并把线稿风格脊柱（线稿技术规范 / 写实人体与材质线条逻辑 / 画面排除项）按语义融进风格 / 服装 / 背景 / 整体效果各处。

**写作规范（十三条）**：

0. **线稿风格强制嵌入（v10.0 必出）**：图片默认渲染为「高清写实线稿图 / line art」。提示词中线稿核心关键词必须出现：黑色线条 + 干净白底、线条流畅肯定粗细有节奏、外轮廓与结构转折线准确、体积与明暗用排线 / 影线（hatching、cross-hatching）表达、不上色不做照片级渲染、保持纯线稿质感、可由 AI 从线稿还原为 8K IMAX 院线真人实拍写实风格。同时声明排除项：不要卡通 / 动漫 / 二次元线稿 / 插画上色 / 游戏 CG / 色彩填充 / 照片级上色 / 塑料材质 / 水印 / Logo。**唯一允许的非线稿元素是多宫格功能性工作单注释**（编号 / 招式标题 / 要点 / 箭头 / 重心轨迹线 / 格子边框）。线稿虽不上色，但要精确刻画真实人体比例、肌肉骨骼、皮肤微观纹理（留白表高光）、布料褶皱物理、空间透视（远疏近密）等全部写实结构信息。

1. **不留占位符**：模板里所有 `{{xxx}}` 必须替换为具体描述，不能留字面
2. **招式全列**：N 招按顺序全部写出，名字精炼但具体（"转身扫腿"而非"扫腿"）
3. **调性对齐**：调性定语必须与 Step 1 的"风格调性"严格一致
4. **人物三锚点**：人物特征至少包含 3 个锚点（如"短马尾、英气剑眉、修长比例"），降低跨格漂移
5. **服装三要素**：材质 + 颜色 + 款式都要写出
6. **字数控制**：中文字符总长度 700-1050 字之间——过短信息量不够，过长 AI 容易丢点
7. **兵器贯穿**（如有）：兵器材质 + 颜色 + 长度在主提示词中明确，并在动作连贯句中至少出现 2 次
8. **纯文字输出**：不加 markdown、编号符号、引号、参数名等装饰
9. **动态招式强化**：动态招式（瞬移 / 突进 / 雷光下劈 / 旋身鞭腿 / 腾空踢 等）的招式名后或要点说明中，必须含**动作模糊 / 残影 / 速度线 / 衣袂横拖**等词，否则 AI 出图会画成静态站桩
10. **法术/特效招式标注方向**：法术或灵气类招式（灵气压制 / 引雷术 / 灵气爆体 / 符箓爆发 等）必须标注**灵气方向**（前推 / 上冲 / 下劈 / 爆散 / 环绕），否则 AI 默认全部画成"环绕特效"
11. **手部精细动作标注清晰度**：手部动作密集的招式（手印 / 抓符 / 指诀 / 拈花 / 捏诀）必须在要点中加"清晰可见的手指姿势 / 五指分明"
12. **对手参照系（强约束）**：单人海报里涉及"对手"语义的招式（封喉 / 反刺 / 定身 / 锁喉 / 控制 / 肘击 / 摔投），必须同时标注：(a) **目标高度参照**（颈部 / 胸口 / 腹部 / 头顶 / 视线斜上）；(b) **虚化对手剪影**（半透明黑影 / 残影 / 对手轮廓 / 虚影站立 / 跪倒虚影），让 AI 把对手画进画面而不是靠观者脑补
13. **角色描述模块化（v8.3 新增）**：把「演武者外貌 / 服装」描述写成一段**自成一段、清晰可识别的角色块**（开头用「演武者为同一位 ...」结尾用「全程保持同一人物」），让用户后续要替换为自己上传的人物图时，**只需替换这一块**即可保留所有动作 / 镜头 / 场景 / 调性设计。**禁止**把人物外貌特征零散散布在多招要点里——会让"角色替换"变得非常麻烦
13b. **角色命名规则：有参考图用「参考图挂载名」，无参考图用泛化描述（v10.2 修正）**：根据用户是否提供「角色参考图」分流——
   - **已提供角色参考图**：角色块**直接引用该参考图的挂载名 / 引用名**（即用户给这张上传参考图起的标签 / 句柄，如 `@女主`、`@角色1`、`参考图人物`），写成「演武者为同一位{参考图挂载名}，全程保持同一人物」。**这里用的是"参考图的名字"，不是参考图里人物的真实角色名 / IP 名**——目的是让 i2i 工具按挂载的那张参考图来画，而不是去推断或暴露角色真实身份。**也不要**再写「一位古典神话风格的女战士」等泛化外貌堆砌（参考图已锁定全部外观）；可在挂载名后补 1-2 个动作 / 兵器 / 气质锚点。
   - **未提供角色参考图**：按常规用泛化视觉描述（年龄 + 性别 + 气质 + 武术身份 + 服装三要素 + 三个面部 / 体型锚点），不出现任何名字。
   - **适用范围**：Step 3 图片角色块、Step 4 视频「人物开场」、单格高清图角色描述全部遵循同一分流。
   - **与版权脱敏的关系**：因为引用的是"参考图挂载名"而非真实角色名 / IP 名，本身不触发版权脱敏问题；用户未提供参考图、走 IP 桥段还原或通用绘图时，仍按版权脱敏规则用视觉特征替代专名（Step 4 视频 prompt 的脱敏底线不变）。若用户给参考图起的挂载名恰好是某 IP 真实角色名，提醒用户改用中性挂载名（如 `@女主`）再喂工具。
14. **每格 keypose 必须是"运动中的瞬间"（v8.7 强化，服务实时视频起始帧）**：每格的姿态描述必须是**爆发瞬间 / 接触瞬间 / 动作中段**（如「短刀正向上身要害推进中」「拳头正向胸口推进中」「脚刚离地腾空起跳」「衣袂横拖出残影」），**禁止**写"已完成的最终定格姿态"（如「已经完成劈砍后收刀的姿态」）。**理由**：v8.7 视频是 15 秒实时速度，图作为起始帧若是死姿态，视频开场会"重新启动"造成节奏断裂；若是运动中瞬间，模型会自然延续动作流
15. **图片与视频是配套整体，图片不预分段（v8.7 修正）**：图片就是一份完整连贯的 N 格动作分解，按用户题材 / 武术体系 / 风格 / 兵器动态生成；视频参考整张图作为视觉锚点 + 动作字典生成 15 秒对应视频。**严禁在图片层硬编码"A 段 / B 段 / C 段"视觉分组、戏剧弧线进度条、金色边框 / 红色描边 / 段落标题等装饰**——这违反反硬编码原则、过度设计、且让海报失去 pre-vis 工作单的简洁。**段落选择是视频 prompt 阶段的责任**（视频从 N 格里精简到 8-10 招），不是图片层要预先分组

**输出物**：一段完整可直接复制的中文提示词。输出后告诉用户："这段直接复制到主流 AI 绘图工具，输出为高清写实线稿图（黑线白底、排线表达体积、可还原写实），多宫格海报建议画面比例 1:1 或 4:3、分辨率尽量 ≥1024×1024（若要单格 / 单人竖屏分镜可用 9:21），输出目标 4K 以上以保留可还原写实的全部结构信息。**这张多宫格线稿海报既是你的武指工作单（整体动作字典），也是直接喂给视频模型的参考图——不需要再生成首帧图**。视频模型会根据 Step 4 视频 prompt 中的「参考图阅读协议 + 线稿还原声明」把线稿结构还原为电影级写实风格、按 16 格顺序连贯演完所有动作。如果之后想用自己上传的人物图或彩色角色替换，只需替换提示词中『演武者为同一位 ... 全程保持同一人物』这一段。"

---

### Step 4｜一整段图生视频 prompt（标准必出，与 Step 3 配套）

Step 3 已输出图片 prompt（多宫格海报）。要做成**最终的动态打斗视频**，必须再输出**一份一整段连贯的视频 prompt**——不是 N 段碎片，是从起势写到收势的完整电影叙事段落。

**完整生产链**：

```
Step 3 图片 prompt           → 1 张多宫格海报（既是视觉规划，也是视频参考图）
                                       
Step 4 一整段视频 prompt      → 用户把 Step 3 生成的图作为视觉参考
                                （first frame 或 style reference）
                                + 这段视频 prompt
                                → 喂给视频模型（即梦 / Kling / Seedance / Sora / Veo）
                                → 一段 5-15 秒连贯的完整打斗视频
```

**关键原则**：

1. **视频 prompt 是"一整段连贯描述"，不是"N 段碎片"**——它描述完整的动态演变，让视频模型一次性出一段连贯片段
2. **必须与图片 prompt 配套**——人物 / 服装 / 兵器 / 场景与 Step 3 严格一致；只给图不给视频 prompt（用户没法生成视频）/ 只给视频 prompt 不给图（视频模型缺视觉锚点）都不算交付完整
3. **15 秒标准时长 + 8-10 招完整戏剧弧线（v8.7 产品规格）**——经过多版迭代，本 skill 把视频时长**固定为 15 秒**作为标准产品规格，不再让用户每次纠结 5/10/15 秒。15 秒是大片打斗的黄金时长：
   - **能装 8-10 招实时连招**（每招约 1.5-2 秒，符合院线大片真实搏击节奏）
   - **能展开完整戏剧弧线**（起势凝神 → 试探 / 第一次接触 → 爆发主攻 → 反转 / 转守为攻 → 高潮决招 → 收势凝望）
   - **能容纳 1 处决定性瞬间凝固定格**（约占 1 秒，作为屏息电影海报级一帧）
   - **15 秒招式编排模板**（六阶段相对时长锚点，写在视频 prompt 中作为节奏指引）：
     - 起势凝神：约占 1/10 时长（1 招）
     - 试探 / 第一次接触：约占 1/6 时长（1-2 招）
     - 爆发主攻：约占 1/4 时长（2-3 招）
     - 反转 / 转守为攻：约占 1/8 时长（1 招）
     - 高潮决招（含凝固定格）：约占 1/4 时长（1-2 招）
     - 收势凝望：约占 1/8 时长（1 招）
     - 合计 8-10 招 / 完整 15 秒
   - **图片 N 格是"完整动作字典"，视频从中选 8-10 招最具视觉张力的核心段落**（默认选含戏剧反转的高潮前后段）
   - **如果 N 格里某些段落用户特别想要**：分多段拍 15 秒视频后期剪辑拼接成 30-45 秒完整对打（如「起势对峙段 15s → 试探接触段 15s → 高潮决战段 15s」）
   - **工具兼容性**：如果用户工具不支持 15 秒只支持 10 秒，把试探段或反转段压缩 / 删除一招，戏剧弧线骨架保留即可

   **保留的镜头覆盖清单**（v8.3 仍然必出，但语义改为"本视频选演哪几招、其余跳过"）：
   - **5s 视频**：核心招完整演（约 3-4 招）+ 其余通过快剪 / 残影叠化 / 一笔带过的方式仍然出现
   - **10s 视频**：核心招完整演（约 6-8 招）+ 其余通过 0.3-0.5s 快剪 / 凝视特写 出现
   - **15s+ 视频**：N 招全部演到，节奏可松紧错落
   - **镜头覆盖清单格式**（视频 prompt 中必须显式列出）：
     ```
     第01格-起势仪式｜完整演（1.5s）｜起势凝神 → 视频开场
     第02格-进步直拳｜完整演（1.0s）｜爆发主攻第一击
     第03格-闪身侧避｜一笔带过（0.3s）｜快剪转场
     第07格-腾空飞踢｜凝视聚焦（凝固定格 0.5s）｜高潮决招
     第11格-符箓特写｜插入特写（0.4s）｜节奏停顿点
     ...
     第16格-收势凝望｜完整演（1.5s）｜收势凝望 → 视频收尾
     ```

**字数与质量平衡（v9.8 修正 — 分镜清单为主，其他极简）**：

字数压缩不能以牺牲表达质量为代价。**核心原则是「信息密度最大化」+ 「禁止重复信息」**。

**v9.8 关键重构**：自从 v9.7 引入「分镜执行清单」后，分镜清单本身已经包含所有 16 格的动作 / 招式 / 镜头 / 时序信息——所以其他段落**必须极度精简，禁止重复分镜清单中已有的信息**。

**视频 prompt 新架构（推荐）**：
```
[参考图阅读协议]            约 80-100 字（5 条核心规则）
[节奏定调]                  约 30-50 字（实时 + 反例排除）
[忠于参考图 + 一致性]       约 50-80 字（外观锁定 + 动态元素白名单）
[分镜执行清单]              约 350-450 字（主体，16 格逐行）
[自检指令]                  约 20-30 字（1 句话）
合计目标 600-800 字
```

**禁止出现的冗余段落**（之前版本残留，v9.8 必须删除或合并）：
- ❌ [场景与人物]：场景与人物信息已融入分镜清单第 1 格 + [忠于参考图] 段
- ❌ [实时连招叙事]：与分镜清单完全重复，**禁止保留**
- ❌ [镜头与速度]：每格的镜头已标在分镜清单，全局速度已在 [节奏定调]
- ❌ [Continuity]：核心 1-2 句融入 [忠于参考图]，不需要单独段落
- ❌ [武术艺术]：核心 cue（武意 / 决定性瞬间）已在分镜清单的关键格描述中体现

**目标长度：600-800 中文字符**（含标点）：
- 低于 600 字：分镜清单可能描述太薄
- 600-800 字：分镜清单充分 + 全局约束精简的最佳区间
- 高于 800 字：基本就是有重复段落了，必须删冗余

- **必须保留的关键 cue（少了就质量崩塌）**：
  - **节奏定调**：「实时速度」+「反例排除（不要慢镜 / 不要教学）」+「凝固定格仅 1 处」
  - **风格锚点**：影视参考片单（如《疾速追杀》《一代宗师》《突袭》），这是模型理解风格的最大杠杆
  - **UI 排除**：编号 / 文字 / 箭头 / 轨迹线 / 格子边框
  - **忠于参考图**：动态元素白名单 + 不加额外人物 / 武器
  - **动作三要素（每招必须含）**：人物 + 具体动作 + 对手反应（"A 推刀 B 闪过"而不是"A 进攻"）
  - **决定性瞬间标记**：明示哪一刻是凝固定格屏息一帧
  - **物理重量感关键词**：关节阻力 / 衣袂鼓荡 / 落地水花 / 残影等具体词（任选 2-3 个）

- **可以压缩的（不影响质量）**：
  - 重复表达（同一原则不在多段重复说）
  - 过度修饰副词（"缓缓"、"渐渐"、"慢慢地"等）
  - 独立解释段（如"动作连贯性原则解释"独立成段——其实融入叙事动词「余势带 / 借势 / 反弹起」就够了）
  - 冗长场景铺陈（开场 1-2 句即可）

- **写作技巧**：
  - 用动词代替形容词（"推刀"代替"正在缓缓推进的刀光瞬间"）
  - 关键指令前置（节奏 / UI 排除 / 忠于图 写最前 3 段）
  - 动作叙事用顿号 + 短句堆叠（每个短句 = 一招），节奏感更强
  - 列名词清单代替造句（如"动态元素仅限：衣袂残影、雨水飞溅、霓虹反光、速度线"）

- **图片 prompt 目标长度仍为 700-1050 中文字符**（绘图模型容量大、需要更细致角色与场景锚点）。

**视频 prompt 结构方法论（v9.3 新增，行业通用模板，agent 根据题材自主选用）**：

写视频 prompt 时不要凭感觉散写——以下三种结构都是动作 / 武术 / 打斗题材的成熟方法论，agent 选一种应用即可（也可以混合）：

**A. 五段式结构（适合大部分动作戏 / 武术 / 打斗）**
```
[Cinematography 镜头] + [Subject 主体] + [Action 动作] + [Context 环境] + [Style 风格氛围]
```
每段一两句，整体 250-450 字。优势：清晰、易理解、对模型友好。适合：单镜头连贯打斗 / 短段对决。

**B. 八点 Shot Grammar（适合精细控制 / 长段动作戏）**
每个镜头按 8 个维度展开：
1. Subject（谁）
2. Emotion（情绪状态：杀气 / 凝视 / 决绝 / 惊愕）
3. Optics（景别 + 镜头类型：中景 / 近景特写 / 浅景深 / 广角）
4. Motion（人物动作 + 摄影机运动：A 推刀 + 横移跟拍）
5. Lighting（光线：冷光 / 逆光 / 顶光勾边）
6. Style（风格：写实硬派 / 写意飘逸 / 暴力美学）
7. Audio（声音节奏感：金属摩擦 / 衣袂破空 / 重击闷响——写在文本里给模型理解节奏）
8. Continuity（连续性锚点：与前一镜头如何衔接）

适合：高潮决战、复杂多镜头、需要专业级精度的场景。

**C. 时间戳分镜式（适合多镜头精确节奏控制）**
```
[00:00-00:03] 远景仰拍，A 持刀立于雨中，B 徒手立于对面，眼神锁定
[00:03-00:06] 中景横移跟拍，A 进步斜斩，B 上身侧倾闪过，雨珠飞溅
[00:06-00:09] 360 度环绕近景，B 下潜抓 A 持刀腕拧转，关节阻力
[00:09-00:12] Whip pan 转镜，B 翻腕反夺短刀，A 失重踉跄
[00:12-00:15] 低角度推近，两人相隔三步喘息凝望，凝固定格
```
优势：精确控制节奏 / 不会丢镜头 / 给模型清晰的时间锚点。适合：完整戏剧弧线 / 多镜头连贯爆发。

**节拍化动作叙事（v9.3 关键写作技巧）**：

无论选哪种结构，**叙事中用「节拍」标记每招**——这是 Sora 类模型推荐的动作戏写法：

```
节拍 1：A 起势，眼神锁定 → 建立赌注
节拍 2：A 进步斜斩，B 闪过 → 第一次接触
节拍 3：B 下潜抱腰，A 提膝阻挡 → 缠斗启动
...
```

每个节拍 = 一个清晰的动作单元 + 对手反应 + 时间锚点。比纯叙事段落更精确、模型更容易理解节奏。

**Continuity 连续性 4 维（v9.3 新增，每段 prompt 都要保证）**：

动作戏最怕"动作不连贯 / 角色漂移 / 道具消失"。明确以下 4 维 continuity 锚点：
- **角色 continuity**：外貌 / 服装 / 武器形态 / 体型 / 气质 全程一致，每个镜头都重申关键锚点
- **空间 continuity**：场景方位 / 光线方向 / 环境元素 / 距离关系 一致——A 在左 B 在右，不能突然换位
- **道具 continuity**：武器使用 / 道具状态合理传递——刀被夺走后不能凭空回到原主、衣袂破损后不能复原
- **时间 continuity**：天气 / 光照 / 雨雪 / 衣饰湿润度 / 汗水累积 合理推进——开场干爽到收尾湿透

**视频 prompt 输出格式（v8.4 严格分两部分 + 相对节奏 + 忠于参考图）**：

⚠️ 三条关键原则：

1. **正文与使用建议分离**：视频 prompt 正文（用户复制喂给视频模型的）与使用建议（用户看的工具配置说明）必须明确分离。「建议时长」「运动幅度档位」「宽高比」「帧率」这些是工具的 UI 参数 / 用户配置层信息，**不能塞进视频 prompt 正文**——模型读到只会困惑或忽略，反而稀释正文有效信息密度。
2. **节奏用相对描述，不写绝对秒数（v8.4 新增）**：视频生成模型的**总时长是用户在工具 UI 里选的参数**（5/10/15 秒），prompt 里写「1.5 秒完整演」「0.6 秒凝固定格」会与工具实际时长冲突——5 秒视频总长里塞不下"1.5 秒 × 16 招"。改用**相对节奏词**让模型按用户选定的总时长自动分配比例：
   - 「较长定格 / 短促一击 / 凝固瞬间 / 一笔带过 / 浓缩并击」（强度档）
   - 「起势段较长 / 中段紧凑 / 高潮拉长定格 / 收势缓慢」（曲线档）
   - 「关键招与过渡招的时间比约为 3:1」（相对比例）
3. **忠于参考图，禁止凭空添加（v8.4 新增）**：视频生成模型经常在 i2v 时"自由发挥"，添加图里没有的人物、武器、特效、桌椅家具、围观角色、未指定的烟雾血迹等。视频 prompt 必须**显式声明「忠于参考图原则」**：人物数量 / 武器形态 / 场景元素 / 调性 / 服装细节都以参考图为准，**不增不减**；动态元素（衣袂残影、粒子）只能是 prompt 中明确列出的种类。

输出时按下面两个独立块输出，标题清晰区分。Prompt 正文目标长度 **约 450-750 中文字符**。

```
═══ 视频 prompt 正文（直接复制此块喂给视频模型）═══

[参考图阅读协议（v9.6 强制必出，写在视频 prompt 最前段）]：参考图是一份 4×4 = 16 格分镜表（武指工作单），**不是多场景拼贴、不是单一画面**。请按以下方式读图并生成视频：
- **格序 = 时间序**：从左上第 1 格开始，按行优先顺序（先从左到右、然后下一行、依次到右下第 16 格），每一格代表一个连续动作时间点
- **15 秒视频 = 16 格动作的完整连贯演绎**：按 1→2→3→...→16 顺序演完所有 16 格的动作，构成单一连贯电影画面，**不要漏任何一格、不要合并任何两格、不要添加图外动作**
- **排除 UI 注释层**：图中编号 / 中文招式标题 / 中文要点说明 / 动作箭头 / 重心轨迹线 / 格子边框 / 网格分隔线 / 任何文字标注 全部是分镜表的注释（武指工作单标记），**不要渲染到视频中**。视频是单一连贯电影画面，**不存在格子分隔**
- **角色与场景一致性锚点**：每一格中的人物外貌、服装、武器、场景元素必须在视频全程保持一致（图就是这些信息的视觉锚点，agent 直接以图为准）
- **线稿还原声明（v10.0 强制必出）**：参考图是高清写实线稿（黑线白底、排线表达体积），其中已编码 8K IMAX 院线真人实拍所需的全部真实结构信息。请把线稿结构**还原渲染为电影级写实真人画面**（真实皮肤质感、布料材质、电影级布光、自然焦外虚化）再让其动起来——视频不是线稿动画，而是按线稿结构还原出的写实影像；线稿只是结构蓝图，不要在视频中保留线条 / 排线 / 白底等线稿外观。
- **每格转下一格用动作惯性自然衔接**：不机械跳剪，前一格的发力余势带出下一格的起势，像水流不像 PPT 翻页

[分镜执行清单（v9.7 强制必出，时间戳逐格清单 — 杜绝丢镜头的核心机制）]：紧跟「参考图阅读协议」之后，必须用**时间戳分镜清单**逐格独立列出 16 格的执行指令。这是确保视频模型不丢镜头的最强约束——比纯自然语言叙事段落更不容易被模型自动取舍。格式：

```
[00:00-00:01] 第 01 格｜招式名｜动作要点（精炼一句）｜镜头标签
[00:01-00:02] 第 02 格｜招式名｜动作要点｜镜头标签
[00:02-00:03] 第 03 格｜招式名｜动作要点｜镜头标签
...
[00:14-00:15] 第 16 格｜招式名｜动作要点｜镜头标签
```

**时长分配原则（agent 根据题材戏剧弧线灵活分配）**：
- 总时长 15 秒精分到 16 格，**每格平均约 0.9 秒**，但不必完全均分
- **必演核心格分配更长**（约 1.2-1.5 秒）：第 1 格起势 / 戏剧反转格 / 决定性瞬间格 / 第 16 格收势——这四格用「凝固定格 + 慢推」拉长
- **过渡 / 试探格压缩**（约 0.5-0.8 秒）：用快剪 / 残影 / 一笔带过
- **关键约束**：所有 16 格的时长之和必须 = 15 秒，**不允许任何一格被分配 0 秒（即跳过）**

**自检要求（写在分镜执行清单末尾）**：「在生成视频前，请确认：清单中 16 格是否全部出现在视频中？每格是否有至少 0.3 秒以上的画面呈现？如有任何一格被跳过，请重新规划时间分配确保全覆盖。」

[忠于参考图原则]：本视频严格以参考图为视觉锚点。人物数量、武器形态、服装细节、场景元素、光感色调、调性风格全部以参考图为准，**不要添加参考图中没有的人物 / 武器 / 道具 / 家具 / 围观角色 / 烟雾 / 血迹 / 任何额外元素**。动态元素仅限本 prompt 显式列出的几类（如衣袂残影 / 粒子 / 灯光氛围 / 速度线 / 虚化对手剪影），不要自由发挥。

[动作连贯性原则（v8.5 强制）]：本视频追求好莱坞大片级打斗（参考《疾速追杀》《伯恩谍影》《突袭》《卧虎藏龙》《一代宗师》《杀死比尔》《盗梦空间》《老男孩》等经典）。动作之间**不是切换、不是跳剪、不是 PowerPoint 翻页**——是**惯性带动下的自然过渡**：前一招的发力余势直接带出下一招的起势，身体重心连续流动，像水流不像分镜。每一击都有**物理重量感**（拳头落下的肉感反作用、衣袂随发力鼓荡、重心被冲击时的崩溃），让观众感受到力的传导。整段必须有**至少 1 处决定性瞬间（Decisive Moment）**——让观众屏息的电影海报级一帧（剑光及肤 / 兵器交锋 / 眼神锁定 / 凝视对手）；以及**至少 1 处人物极限状态**——眼神特写或喘息表情，体现身体被推到极限。

[院线大片实时节奏原则（v8.6 强制）]：本视频是**院线大片实时打斗**，不是教学示范、不是套路演示、不是 pre-vis 慢动作回放。**默认全程正常速度（实时搏击节奏）**——招招到位、连消带打、招式不留余地、爆发与反应都在真实速度内完成。慢镜与凝固定格**只允许在 1-2 处使用**（仅决定性瞬间或戏剧反转），其余 80%+ 时长保持正常速度。**反例排除**：不要"逐招分解的教学回放"、不要"全程 0.5x 慢镜"、不要"每招都凝视聚焦"、不要"武术套路演示节奏"——参考的是《疾速追杀》连续过肩摔接抢射的实时连贯爆发、《伯恩谍影》肌肉记忆式的真实搏击速度、《突袭》连绵不绝近乎实时的打斗。

[海报 UI 元素排除]：参考图为多宫格 pre-vis 武指工作单，图中的阿拉伯数字编号 / 中文招式标题 / 中文要点说明 / 动作方向箭头 / 重心轨迹线 / 格子边框 / 网格分隔线 / 任何文字标注均为海报注释层，**不要渲染到视频中**。视频是单一连贯的电影画面，不是多宫格拼贴，不存在格子分隔。

[场景与人物开场]：2-3 句开场画面描述，与 Step 1 人物锚定卡严格一致。

[镜头覆盖叙事（v8.3 强制必出，N 格全覆盖；v8.4 改用相对节奏）]：以一段流畅的电影旁白式动作描述（10-16 句，一气呵成、不要分段编号），按时间顺序覆盖图中 N 格 keypose 全部动作；叙事中用『接着』『随即』『紧接』『下一刻』等时间连接词把每一格动作串起来；每个动作后用**相对节奏标签**标注处理强度（不写具体秒数）：
- **较长定格 / 完整演**——核心招、起势、收势、高潮决招（占比最重）
- **凝固瞬间 / 凝视聚焦**——节奏停顿点、关键定格、特写慢镜推近
- **短促一击**——爆发主攻、单击发力（节奏中等）
- **一笔带过 / 残影叠化**——过渡招、连接动作（节奏最快）
- **浓缩并击**——多招合并成连击（适合时长紧张时）

整段必须按「起势凝神 → 试探 / 第一次接触 → 爆发主攻 → 反转 / 转守为攻 → 高潮决招 → 收势凝望」六阶段戏剧弧线推进；关键招式要带具体身体动作 / 武器轨迹 / 衣袂飘动 / 对手反应（含虚化对手剪影）；**N 格全部串起来不能跳过任何一格**。

[节奏比例提示]：1-2 句指引模型如何按用户选定的总时长分配——例如「起势与收势两段较长（合计约占 1/3 时长），中段连招紧凑，高潮决招处拉长成凝固定格（约占 1/4 时长），其余过渡招快剪一笔带过」。**不写具体秒数**，让模型按工具选定的总时长按比例缩放。

[镜头语言]：整段中的镜头切换与运动节奏，3-4 句（如低角度仰拍推进 / 横移跟拍 / whip pan 转场 / 360 度环绕 / 慢推拉远 等）。

[速度曲线]：起势 / 连招 / 高潮 / 收势各段的相对速度感，1-2 句（如「起势缓慢蓄势，中段正常速度推进，高潮处超慢镜叠凝固定格交替，收势缓慢拉远」）— **不写具体倍数**。

[环境互动]：贯穿全段的环境元素（粒子 / 衣袂 / 残影 / 雾气 / 灯光氛围 等，**只限本 prompt 列出的种类**），1-2 句。

═══ 使用建议（仅供你参考，不要复制进 prompt）═══

【建议总时长】根据镜头覆盖叙事的密度，建议在工具 UI 里选 **5s / 10s / 15s** 之一——N 格全演 + 密度高 → 选 10-15s；只演核心连招 → 选 5s。模型会按你选的总时长，结合 prompt 中的相对节奏标签自动分配每招比例。

【视频模型参数建议（平台中立，不点具体模型 / 平台名）】根据你手头工具的 UI 设置自行匹配：运动幅度档位（小 / 中 / 大）/ 一致性档位（保人物 / 保风格 / 双重保留）/ 宽高比（16:9 横屏 / 9:16 竖屏 / 1:1 方形）/ 帧率（24 fps 电影感 / 30 fps 流畅）/ 风格关键词（写实人体动力学 / 飘逸特效 / 长镜头慢镜 / 多角色互动 等，按本视频实际特征列 2-3 个）。

【一致性档位选择窍门】为了减少模型自由发挥添加图里没有的元素，建议**优先选「保风格 + 保人物」双重保留**，运动幅度选「中」而非「大」（运动幅度太大模型容易脑补额外内容）。

【配套图片】使用 Step 3 生成的多宫格海报作为视觉参考图（first frame / style reference）。

【图生视频工作链质量硬约束（v9.3 新增）】用户喂给视频模型的参考图必须满足：
- **分辨率**：建议 1024×1024 以上（视频模型对低质量首帧会"放大瑕疵"）
- **三层纵深**：图中有清晰的前景 / 中景 / 背景，让视频模型有空间做镜头运动（推 / 拉 / 横移 / 环绕）
- **角色面部 + 手部清晰**：模糊的面部 / 抖动的手指会在视频中被加倍放大
- **充足负空间**：主体周围留出空间让模型做镜头运动而不必凭空生成新内容
- **短段更稳**：建议视频时长 ≤15 秒（行业实测：>15 秒首帧"记忆"开始衰退、角色 / 场景一致性下降）
- **统一光线方向**：图中光线方向贯穿全图，避免视频生成时光线"飘移"
```

**写作要点**：

1. **整段叙事流畅**：写成一段电影旁白，而不是分段编号的清单
2. **N 格全覆盖（v8.3 强制）**：镜头覆盖清单中 N 格全部列出，每格在视频里都有处理方式（完整演 / 一笔带过 / 凝视聚焦 / 浓缩并击），**不能跳过任何一格**；时长不够就压缩单格时间，不能丢镜头
3. **保留关键 keypose**：起势仪式感 + 1-2 个高潮定格 + 收势仪式感 必须用「完整演」处理
4. **保留虚化对手剪影**：如果原 N 招里有对手参照招，视频 prompt 中至少保留 1 处虚化对手剪影
5. **承接 Step 3 的人物 / 服装 / 兵器 / 场景**：避免视频与图片人物漂移；同时**显式排除海报 UI 元素**（编号 / 箭头 / 中文标题 / 重心轨迹线 / 格子边框 / 网格分隔线）
6. **好莱坞大片打斗 7 要素必含（v8.5 升级，缺一即重写）**：对标《疾速追杀》《伯恩谍影》《突袭》《老男孩》《疯狂麦克斯狂暴之路》《卧虎藏龙》《一代宗师》《盗梦空间》旋转走廊、《黑客帝国》《杀死比尔》《角斗士》等国际经典——不是堆砌招式，而是用电影级语法讲打斗故事：
   - **决定性瞬间（Decisive Moment）**：至少 1 处让观众屏息的视觉锚点——剑光及肤的瞬间 / 拳头逼近上身要害定格 / 兵器交锋火花溅起 / 眼神锁定对手的电影海报级 frame；这是观众最终会记住的那一帧（参考：杀死比尔黄衣新娘剪影 / 角斗士最终对决凝望 / 盗梦空间走廊翻转那一刻）
   - **物理重量感（Impact Weight）**：每一击都有重量——拳头落下时的肉感反作用力、刀刃斩入的阻滞感、身体被撞击时的衣袂鼓荡 + 重心崩溃；不是漂浮的 CG 招式（参考：突袭 / 伯恩谍影的肌肉记忆实战感、叶问寸劲爆发）
   - **运动惯性与自然过渡（Momentum Carry）**：动作之间**不是切换，是惯性带动下的自然延续**——前一招的发力余势带出下一招的起势，像水流而不是 PowerPoint 翻页（参考：一代宗师叶底藏花的"形未到劲先到"、疾速追杀连绵不断的过肩摔接抢射）
   - **节奏对比（Tempo Contrast）**：慢镜 + 正常速 + 凝固定格 至少包含两档；尤其要有「**快慢交替的呼吸感**」——长段连续打 + 突然减速凝固 + 再加速（参考：黑客帝国子弹时间 / 杀死比尔慢镜定格 / 疾速追杀战术换弹的呼吸点）
   - **空间立体纵深（Spatial Depth）**：地面低桩 + 中段贴身 + 腾空高位 至少出现两层；同时画面要有**前景 / 中景 / 背景**三层调度，避免动作只在一个高度 / 一个景深平面（参考：盗梦空间旋转走廊三层重力空间、突袭 2 厨房战的纵深）
   - **环境作为参与者（Environment as Actor）**：墙 / 桌 / 灯 / 门 / 雨水 / 雪花 / 尘土 / 碎玻璃成为打斗的一部分，不只是背景板——招式与环境互相塑造（参考：成龙体系道具化招、疯狂麦克斯狂暴之路的车体即武器、老男孩走廊的墙体反弹、突袭的厨房用具）
   - **人物极限状态（Character at Limit）**：眼神 / 表情 / 喘息 / 微表情体现身体极限与心理压力——观众感受到的不只是动作，是一个人被推到极限的状态；至少 1 处眼神特写或表情凝望（参考：伯恩谍影的疲惫眼神、突袭的累积疲劳、角斗士目视斜上方的觉悟瞬间）
7. **图视频耦合性（连贯性核心）**：Step 3 图片 prompt 中每一格 keypose 都要写成「**运动中的瞬间**」——例如"剑刚劈到一半"、"拳头正向上身要害推进中"、"脚刚离地腾空起跳"、"长枪正在出手前的蓄势"等纯动作过程描述——而**不是"已经完成的最终定格姿态"**。这样视频 prompt 的运动过程才能从图的瞬间自然延续下去；如果图是死姿态，视频开场会"重新启动"，造成动作脱节。**注意**：写"运动中的瞬间"时严禁用"距脸 X cm"、"距喉 X cm"等具体距离致命点描述（违反 B 类暴力软化），改用"正向 X 推进中"、"逼近上身要害"等戏剧性表达
8. **戏剧弧线**：视频 prompt 的叙事必须符合「**起势凝神 → 试探 / 第一次接触 → 爆发主攻 → 反转 / 转守为攻 → 高潮决招 → 收势凝望**」的打斗故事结构，每个阶段对应一段连贯动作；不是把 N 招按编号一字排开，而是讲一个有起承转合的打斗段落

---

**版权脱敏改写（视频 prompt 强制要求）**：

视频生成模型（Sora 2 / Kling / 即梦 / Seedance / Veo / Runway）对版权关键词有严格的内容过滤。Step 4 的视频 prompt 必须**把所有专有名词替换为视觉特征描述**——否则会被 filter 拒绝、强制改写成 generic 角色、或生成结果失去预期辨识度。

**判断准则（agent 自主识别专有名词，不套硬编码清单）**：

每写一段 prompt，扫描其中是否含以下**任何一类专有名词**：

1. **角色名**：任何具体动漫 / 影视 / 小说 / 游戏作品中的命名角色（无论是中文还是外文）
2. **作品名**：任何具体动漫 / 影视 / 小说 / 游戏的名称（《XX》《XX 大陆》《XX 之歌》等）
3. **武器 / 技能 / 武魂 / 法术 / 招式专名**：作品中独有的命名（带专属词的"XX 锤"、"XX 诀"、"XX 拳"、"XX 印"等）
4. **门派 / 组织 / 势力名**：作品中虚构或现实门派的具体名称
5. **特定地点名**：作品中虚构或现实可识别地点（"XX 山"、"XX 森林"、"XX 城"——可识别即风险）
6. **真实人物名**：现实中知名武术家 / 演员 / 导演的本名

**任意一类命中 → 必须脱敏**（A 模式 IP 题材 / B 模式桥段还原 都适用）。

**脱敏方向（agent 自主用视觉特征代替）**：

- **去名留形**：去掉可识别的专有名词，保留视觉特征（年龄 + 性别 + 体型 + 服装 + 武器 + 气质 + 武修身份）。例如不写角色名，改写"一位约 25 岁的清秀少年武修，黑色立领长衫束发，手持暗金色巨锤"——视觉信息齐全，但 AI 模型推测不出具体 IP
- **武器用视觉描述替代专名**：写"颜色 + 材质 + 形态 + 光效"（如"银白长剑剑身泛冷光"、"暗金色巨锤雷光环绕"、"蓝银色发光藤蔓"），而非招式专名
- **作品调性用泛化风格词替代**：写"国漫玄幻 3D CG 风"、"中式修真动画风"、"写实武侠电影风"、"日式赛璐璐战斗动画风"等**通用风格关键词**，而非具体作品名
- **门派用服装气质替代**：写"黑色立领武修长衫"、"暗红色法袍金色滚边"、"灰布僧袍剃度"，而非门派名
- **地点用环境调性替代**：写"暗夜幽蓝灵气古战场森林"、"古风高耸石塔屋顶"、"云雾缭绕道观山门"，而非具体地名
- **首次出现用视觉锚点**：避免开篇用"他 / 她"，首次出场写"一位约 25 岁的中国男性武修，眉宇带杀气、持灰白短刀"等带完整视觉锚点的描述，再用代词延续

**核心原则（v9.4 反硬编码 + 保识别度）**：

agent 写完每段 prompt 后**逐句自检**：
- 是否含任何"读者一看就知道是哪个 IP / 哪部作品 / 哪个角色"的可识别专名？
- 如果有，能否用视觉特征 + 风格调性 + 武修身份 重写，让画面同样有辨识度但不暴露专名？
- 重写后视觉一致性是否还在？（图片 prompt 与视频 prompt 中的人物 / 武器 / 场景描述必须严格对得上）

**简记**：A 类合规的判断由 agent 动态完成，软化方向由 agent 灵活选择，**不存在固定对照表**——因为不同题材的脱敏需求差异很大，硬编码反而限制 agent 判断力。

**合规化适用范围（v8.2 升级）**：

- **类别 A 版权脱敏**：Step 3 图片 prompt **按工具严格度自行决定**（中文绘图工具对中文版权词较宽松，可保留部分增强辨识度；国际工具较严需脱敏）；**Step 4 视频 prompt 零容忍含专有名词**。**例外（v10.2）**：当用户**自带角色参考图**时，按 Step 3 规范 13b，图片与视频 prompt 的角色块**引用「参考图挂载名」**（如 `@女主`，不是参考图人物的真实角色名 / IP 名）——因为引用的是参考图标签而非真实身份名，本身不触发脱敏问题；其余 IP 专名（作品名 / 武器专名 / 门派名 / 地点名）仍按脱敏规则处理。
- **类别 B 暴力软化**：Step 3 + Step 4 **都强制必出**——主流图片绘图模型（即梦 / Seedream / Midjourney / DALL-E / 通义万相 等）也都有暴力 / 血腥 / 致命描述过滤，会拒绝 prompt 或强制改写成 generic。图片虽然是静态、单张冲击可控，但"距喉 X cm"、"锁住颈部"、"刀刃逼近咽喉"、"血珠悬空"等仍会被拦截。
- **类别 C 平台中立**：Step 3 + Step 4 **都强制必出**——结尾不点具体绘图 / 视频工具名，统一用"主流 AI 绘图工具" / "主流 AI 视频生成工具"中性描述。

**简记**：A 看绘图工具决定，B 和 C 在 Step 3 和 Step 4 都零容忍。

---

**类别 B：暴力 / 血腥 / 致命描述软化（强制必出，与版权脱敏并列）**

视频与图片审核都会拦截过于直白的暴力 / 致命 / 窒息描述，必须做戏剧性软化。但 **agent 不应套硬编码对照表机械替换**——而是按以下**判断准则 + 软化方向**，自主审查 prompt 中每一个动作动词，找到既合规又保留戏剧张力的表达。

**判断准则（agent 自主识别"过直白"）**：

每写一个动作动词，问自己：
1. **是否直接描述武器命中身体？**（如"斩腕"、"刺胸"、"砍腿"、"贯穿要害"——直接动词 + 具体身体部位）
2. **是否有具体距离致命点的数字？**（如"距喉 1cm"、"刀尖距脸 3cm"——任何具体距离单位 cm/寸/厘米）
3. **是否有血腥词？**（血 / 血珠 / 染血 / 喷血 / 溅血 / 渗血——pre-vis 与电影武指语言中都不出现）
4. **是否明确死亡 / 致命结果？**（毙命 / 取性命 / 致命 / 决死 / 死亡威胁 / 杀至）
5. **是否有窒息 / 物理压迫直白词？**（锁喉 / 勒颈 / 绞杀 / 窒息 / 扼颈）
6. **是否含具体未成年岁数？**（16/17 等具体未成年数字——所有角色默认 18+）
7. **是否含真实枪械描述？**（手枪 / 步枪 / 突击步枪 / 狙击枪——武术题材不建议使用）

**任意一条命中 → 必须软化。** 但软化不是阉割张力，是用**电影武指语言**重新表达同样的戏剧冲击。

**软化方向（agent 自主选择合适的替代表达）**：

- **强调过程而非结果**：把"命中"/"贯穿"改为"推进中"/"逼近中"/"擦过"——动作过程描述比结果描述更有电影感
- **强调反应而非伤害**：把"斩腕"改为"震开持械腕、武器脱手"——结果通过对手反应传达，不直接描述伤害
- **环境与物理反馈替代血腥**：用"衣袂破损"/"火星溅起"/"重心崩溃"/"雪沫飞溅"/"金属碰撞"——观众从环境反馈感知冲击力
- **氛围词保留张力**：用"决胜瞬间"/"凝固定格"/"屏息时刻"/"剑指要害位置"——保留戏剧紧张感而不写具体血腥
- **武指美学语言替代直白动词**：剑势压向 / 剑光擦过 / 招式被格挡 / 锋芒所指 / 劲道贯穿 / 力透甲胄——电影武指本身就有这套成熟的间接表达词典，agent 应灵活调用而非套清单
- **格挡 / 闪避主导叙事**：写"被格挡"/"闪过"/"招架"——让招式始终处于"未命中"状态，戏剧张力反而更足

**核心原则（v9.4 反硬编码 + 保质）**：

> **合规不是阉割，是更精致的表达。** 真正高级的电影武指本来就不靠血腥取胜——《一代宗师》的桥手细节、《英雄》的衣袂雪花、《卧虎藏龙》的剑光弧线，都没有任何直白暴力词，但戏剧张力满到溢出。

agent 写完每段 prompt 后，**逐句自检**：
- 这句话有没有上面 7 条命中？
- 如果有，能不能用过程 / 反应 / 环境 / 武指美学语言重写，让它既合规又**比原版更有电影感**？
- 软化后，戏剧张力是不是还在？（如果张力消失了，说明软化方向选错了，重选）

**18+ 与冷兵器优先（硬约束）**：所有角色默认 18+，严禁具体未成年岁数；武术题材优先冷兵器（剑 / 刀 / 棍 / 锤 / 暗器 等），需要远程武器时用"机械装置"/"投射工具"/"远程能量"等抽象表达，不写真实枪械型号。

---

**类别 C：平台中立（视频 / 图片模型不点名，强制必出）**

Step 4 视频 prompt 中**严禁出现具体视频模型 / 平台名**（无 sora / kling / 即梦 / seedance / veo / runway / midjourney 等具体平台或产品名），改成通用参数维度描述：运动幅度（小 / 中 / 大）/ 一致性档位（保人物 / 保风格 / 双重保留）/ 宽高比 / 帧率 / 风格关键词。理由三条：
1. **模型迭代极快**——写死会过时
2. **平台中立**——避免商业敏感与广告嫌疑
3. **用户可能用任何工具**——由用户自行匹配手头资源

Step 3 图片 prompt 同理：结尾"建议复制到 XX / XX / XX 工具"改成中性描述如"建议复制到主流 AI 绘图工具，画面比例 1:1 或 4:3"。

```
═══ 第 N 格 / 招式名 ═══

【A. 单格高清图提示词】（150-250 中文字符，纯文本，可直接喂主流 AI 绘图工具）

一段连贯的中文描述，融合：高清写实线稿风格锚定（黑线白底、排线 / 影线表达体积明暗、不上色、可还原 8K IMAX 写实）+ 人物锚定卡完整描述（避免漂移）+ 该招的具体动作（朝向 / 重心 / 肢体）+ 镜头景别与角度 + 光线方向（以线条疏密表达明暗）+ 兵器状态（如有）+ 环境互动（简洁结构线表透视纵深）+ 风格关键词；排除色彩填充 / 照片级上色 / CG / 二次元 / 水印。

【B. 图生视频提示词】（基于 A 生成的图作为起始帧；可直接喂即梦 / Kling / Seedance / Sora / Runway）

- 起始帧：[描述图片中的初始定格姿态，2-3 句，必须严格对应 A 生成的画面]
- 运动过程：[动作如何展开——肢体轨迹 / 武器轨迹 / 衣袂飘动 / 特效延展 / 对手反应，3-5 句]
- 结束帧：[动作收束的姿态，2-3 句，与下一格的起始帧自然衔接]
- 镜头运动：[固定 / 推 / 拉 / 跟随 / 环绕 / 横移 / whip pan / 慢镜推进 — 必须明确选一种]
- 速度曲线：[示例：0-2s 慢镜起势 → 2-4s 正常速度 → 4-5s 末段定格凝固]
- 环境互动：[雪花飞起 / 血珠飞溅 / 刀光残影 / 灵气粒子 / 落叶 / 尘土 等]
- 建议时长：[5s / 8s / 10s — 多数模型 5s 是甜蜜点]
- 推荐视频模型：[即梦 4.0 / Kling 1.6 / Seedance / Sora 2 / Runway Gen-4 — 必须给出理由：写实硬派 → X，飘逸特效 → Y，慢镜暴力 → Z]
```

每格独立成段，段间空一行，便于复制粘贴。

**B 部分写作要点**：

1. **起始帧严格对应 A**：B 的起始帧描述必须能在 A 生成的图里找到对应，不能脱节
2. **结束帧考虑衔接**：除最后一格外，结束帧应能自然过渡到下一格的起始帧（剪辑成连贯打斗）
3. **速度曲线服务于戏剧节奏**：进攻招用快、定格瞬间用凝固、起势收势可用慢镜
4. **模型推荐有依据**：根据该招的视觉特征匹配模型擅长项——写实人体优先 Kling / Sora 2，二次元玄幻优先即梦 / Seedance，运动幅度大优先 Kling，长镜头慢动作优先 Sora 2

**整段连续打斗视频的剪辑提示**：N 格视频片段产出后，按编号顺序拼接，关键招式之间可加 0.5s 跳切或 whip pan 转场；起势与收势用全长慢镜，中段进攻用快剪。

---

### Step 5｜质量自检

输出主提示词前对照 checklist，不通过则改完再输出：

- [ ] **角色命名分流正确（v10.2 必查）**：有角色参考图 → 角色块引用「参考图挂载名」（如 `@女主`，不是参考图人物的真实角色名 / IP 名）、未堆泛化外貌（无"一位古典神话风格的女战士"式描述）；无参考图 → 用泛化视觉描述、未出现任何名字；图片 / 视频 / 单格图三处一致
- [ ] **线稿风格已强制嵌入（v10.0 必查）**：主提示词含线稿核心关键词（黑色线条 + 干净白底、排线 / 影线 hatching/cross-hatching 表达体积明暗、不上色、保持纯线稿质感、可由 AI 从线稿还原为 8K IMAX 院线真人实拍写实风格）；并显式排除色彩填充 / 照片级上色 / 卡通 / 动漫 / 二次元 / 插画 / 游戏 CG / 塑料材质 / 水印 / Logo；线稿仍声明精确还原真实人体结构 / 皮肤纹理 / 布料褶皱 / 透视纵深等写实结构信息；唯一保留的非线稿元素是多宫格功能性工作单注释
- [ ] 人物锚定卡的所有字段都已融入主提示词
- [ ] N 招招式名全部出现且无重复
- [ ] 调性定语与 Step 1 风格一致
- [ ] 服装描述包含材质 + 颜色 + 款式三要素
- [ ] 主提示词在 700-1050 中文字符之间
- [ ] 没有 `{{变量名}}` 字面残留
- [ ] 兵器（如有）在主提示词中至少出现 2 次
- [ ] 整段读起来流畅、像写给真正的武术指导团队的工作单
- [ ] 没有 markdown 装饰符号（无 `#`、`-`、`**` 等）
- [ ] **姿态配额达标**（N=16 时：≥3 低桩、≥2 腾空高位、≥3 转身侧身、≥2 近景特写）
- [ ] **景别多样性**：主提示词显式包含「特写 / 仰拍 / 俯拍」中至少一项
- [ ] **4 类强化关键词就位**：动态招式→残影/速度线 ｜ 法术招式→灵气方向 ｜ 手部招式→清晰手指 ｜ 对手招式→目标高度 + 虚化对手剪影
- [ ] **起势 / 收势仪式感**：第 1 格和第 N 格已从仪式感动作池中选择，且两者明显不同（不是默认正面站姿）
- [ ] **动态生成自查**：本次招式列表与所选骨架的差异度 ≥ 30%（替换、改写或重组）；如本题材之前生成过，本次描述与上次有可观察差异（人物锚点 / 招式名 / 姿态分配 / 要点描述 至少有 1-2 项明显不同）
- [ ] **B 模式（桥段还原）专项**：如走还原模式，AI 对作品的"印象"已主动告知用户并获得确认，未自由发挥；招式列表完全来自用户描述，未调用骨架库
- [ ] **Step 4 视频提示词配套（标准必查，不能跳过）**：一整段视频 prompt 已输出（不是 N 段碎片）；与 Step 3 的图片 prompt 在人物锚点 / 服装 / 兵器 / 场景上严格一致；包含「场景开场 / 完整打斗叙事 / 镜头语言 / 速度曲线 / 环境互动 / 时长 / 推荐模型」7 个块；招式编排按推荐模型时长上限做了精简（不要把 N 招全塞进 5s）；保留了起势仪式感 + 高潮定格 + 收势仪式感 + 至少 1 处虚化对手剪影（如原 N 招里有对手参照招）
- [ ] **Step 3 图片 prompt 合规化（强制必查，B + C 类零容忍）**：
  - **B 暴力软化**：零血腥词（无血 / 血珠 / 喷血 / 染血）；零「距喉 X cm」/「锁住颈部」/「刀刃逼近咽喉」等具体致命点描述；动作过程描述用「剑刚劈到一半」/「拳头正向上身要害推进中」/「脚刚离地」等纯运动描述，**严禁**用「拳头距脸 3cm」等具体距离致命点；所有角色默认 18+ 不写具体未成年岁数；不用真实枪械
  - **C 平台中立**：图片 prompt 结尾不点具体绘图工具名（无即梦 / Seedream / Midjourney / 通义万相 / DALL-E 等具体名称），改用「主流 AI 绘图工具」中性描述
  - **A 版权脱敏**：根据用户使用的绘图工具严格度自行决定（中文工具宽松可保留部分专有词增强辨识度；国际工具较严需脱敏）
- [ ] **Step 4 视频 prompt 三重合规化（强制必查，A+B+C 全部零容忍，缺一即重写）**：
  - **A 版权脱敏**：视频 prompt 中所有专有名词已替换为视觉特征描述——零角色名 / 零作品名 / 零武器专名 / 零门派名 / 零特定地点名；脱敏后视觉特征与 Step 3 图片 prompt 严格一致；首次出现角色用了带视觉锚点的描述
  - **B 暴力软化**：零血腥词；零致命 / 决死 / 锁喉 / 绞杀 / 窒息直白词（用「决胜瞬间」「颈部控制」「逼近上身要害」「劲道贯穿」等戏剧性替代）；不写「刀尖距喉 X cm」等具体距离致命点；所有角色默认 18+ 不写具体未成年岁数；不用真实枪械描述
  - **C 平台中立**：视频 prompt 中**零具体模型 / 平台 / 产品名**（无 sora / kling / 即梦 / seedance / veo / runway / midjourney 等具体名称），改用通用参数维度（运动幅度 / 一致性档位 / 宽高比 / 帧率 / 风格关键词）
- [ ] **大片打斗 5 元素齐全（强制必查，缺一即重写）**：✓ 冲击瞬间（招招到肉 / 剑光及肤 / 死亡威胁感至少 1 处）✓ 节奏对比（慢镜 / 正常 / 凝固 至少 2 档）✓ 空间立体调度（地面低桩 / 中段贴身 / 腾空高位 至少 2 层）✓ 环境破坏（尘土 / 碎石 / 衣袂残影 / 灵气粒子 至少 2 种贯穿）✓ 凝视停顿（眼神特写 / 喘息凝视 / 收势凝望 至少 1 处）— 缺一项视频会缺少大片武指应有的视觉冲击
- [ ] **图视频耦合性（动作连贯性核心）**：Step 3 图片 prompt 中每一格 keypose 都是「**运动中的瞬间**」（如"剑刚劈到一半"、"拳头正向上身要害推进中"、"脚刚离地"），不是"已完成的最终定格姿态"；视频 prompt 起始帧能从图自然延续，开场不需要"重新启动"；对比检查：把 Step 3 第一格描述念出来 + Step 4 起始帧描述念出来，如果"接得上"就 OK
- [ ] **戏剧弧线完整（打斗故事感）**：视频 prompt 的叙事符合「起势凝神 → 试探 / 第一次接触 → 爆发主攻 → 反转 / 转守为攻 → 高潮决招 → 收势凝望」六阶段（可合并相邻阶段但不能跳过起势 / 高潮 / 收势）；不是"招式 A → 招式 B → 招式 C"的平铺，是讲一个有起承转合的打斗故事
- [ ] **线稿还原声明已显式给出（v10.0 强制必查）**：视频 prompt「参考图阅读协议」中已声明参考图是高清写实线稿、需把线稿结构还原渲染为电影级写实真人画面（真实皮肤 / 布料 / 布光 / 焦外虚化）再动起来，视频中不保留线条 / 排线 / 白底等线稿外观
- [ ] **海报 UI 元素显式排除（v8.3 强制必查，缺一即重写）**：视频 prompt 最前段已显式声明「图中编号 / 中文招式标题 / 中文要点说明 / 动作方向箭头 / 重心轨迹线 / 格子边框 / 网格分隔线 / 任何文字标注均为 pre-vis 海报注释层，严禁出现在视频画面中」；视频画面应只包含演武主体 + 武器 + 环境 + 灯光 + 残影粒子，不存在格子分隔
- [ ] **镜头覆盖清单完整（v8.3 强制必查，缺一即重写）**：视频 prompt 中已显式列出 N 格 keypose 的处理方式（完整演 / 一笔带过 / 凝视聚焦 / 浓缩并击），N 格全部覆盖、不能跳过任何一格；处理时长之和与「建议时长」字段匹配；高潮决招用「完整演」+「凝视聚焦」组合；起势 / 收势用「完整演」
- [ ] **角色描述模块化（v8.3 强制必查）**：Step 3 提示词中「演武者外貌 + 服装」描述写成自成一段的角色块（开头「演武者为同一位 ...」结尾「全程保持同一人物」），便于用户后续替换；提示词中没有把人物特征零散散布在多个招式要点里
- [ ] **正文与使用建议严格分离（v8.4 强制必查，缺一即重写）**：视频 prompt 输出严格分两块：「视频 prompt 正文」（用户复制喂给视频模型）+「使用建议」（用户看的工具配置说明），标题清晰区分；正文里**零工具 UI 参数**——无「建议总时长 X 秒」/ 无「运动幅度档位」/ 无「宽高比 16:9」/ 无「帧率 24 fps」/ 无「风格关键词」等用户配置层信息；这些必须放在「使用建议」块
- [ ] **节奏用相对描述，不写绝对秒数（v8.4 强制必查，缺一即重写）**：视频 prompt 正文中**零具体秒数 / 倍数**（无「1.5 秒」/「0.6 秒」/「0.3 倍超慢镜」/「0.1 倍凝固」等绝对时长）；改用相对节奏词（较长定格 / 短促一击 / 凝固瞬间 / 一笔带过 / 浓缩并击 / 起势段较长 / 中段紧凑 / 高潮拉长 / 收势缓慢 / 关键招与过渡招比例约为 X:Y）；让模型按用户在工具 UI 里选定的总时长按比例自动分配
- [ ] **忠于参考图原则显式声明（v8.4 强制必查，缺一即重写）**：视频 prompt 正文最前段（与「海报 UI 元素排除」并列，或紧靠其前）已显式声明「忠于参考图原则」——人物数量 / 武器形态 / 服装细节 / 场景元素 / 光感色调 / 调性风格全部以参考图为准，**严禁添加图中没有的人物 / 武器 / 道具 / 家具 / 围观角色 / 烟雾 / 血迹 / 文字 / 标识 / 任何额外元素**；动态元素仅限本 prompt 显式列出的几类（衣袂残影 / 粒子 / 灯光 / 速度线 / 虚化对手剪影），不能自由发挥

---

## 角色替换工作流（白模 → 用户上传人物图，v8.3 新增）

**适用场景**：用户已经按白模 pre-vis 出了一张多宫格海报（Step 3）+ 视频 prompt（Step 4），现在想用自己上传的角色图替换白模——可能是：
- 真人模特照片
- 自定义虚拟角色（动漫风 / 写实风 / 风格化）
- 已有 IP 角色图（用户自己拥有授权的）
- 之前生成过的人物图（保持系列一致性）

**核心思路**：动作 / 场景 / 调性 / 镜头设计**全部保留**，只替换「角色块」。本 skill 在 Step 3 提示词里已经把「演武者描述」写成了一段自成一段的角色块（写作规范第 13 条），就是为了让这一步替换变得简单。

---

### 三种替换路径（按工具能力分档）

**路径 A｜文字替换（最简单，所有绘图工具都支持）**

直接把 Step 3 提示词中的「演武者为同一位 ... 全程保持同一人物」整段替换为用户人物的具体描述（外貌 + 服装 + 体型 + 三个特征锚点），其余动作 / 镜头 / 场景 / 调性段落原封不动。

替换前（白模）：
```
演武者为同一位纯白色 3D 白模人形 / 表面无纹理 / 关节线条清晰，修长精瘦男性体型，
头束简洁布带 / 腰系窄腰带 / 持械护手等极简符号，全程保持同一人物。
```

替换后（用户人物）：
```
演武者为同一位{{用户人物外貌：如约 28 岁中国男性 / 短黑发利落分头 / 剑眉星目 / 修长精瘦
体型}}，穿{{用户人物服装：如黑色立领暗纹武修长衫 + 灰色束腰带 + 黑布靴}}，
{{三个特征锚点：如左眉骨有浅疤 / 右手腕缠护腕 / 沉稳冷峻气质}}，全程保持同一人物。
```

**适用场景**：用户已知人物的外貌特征但**没有现成参考图**，或工具不支持图像参考输入。

---

**路径 B｜图像参考（i2i / character reference，主流 AI 绘图工具普遍支持）**

如果绘图工具支持「角色一致性参考图」「character reference」「i2i 主体融合」「主体 LoRA」等功能，更高效的做法：
1. 把路径 A 的「文字角色块」简化为短描述（不必写得太细，让参考图说话）
2. 上传用户人物图作为「角色参考」
3. 同时上传 Step 3 生成的白模海报作为「构图 / 动作参考」（如果工具支持双图参考）
4. 或者把角色参考权重调高（70-90%）+ 海报作为风格参考权重低（30-50%）

**简化后角色块写法（让图像参考接管细节）**：
```
演武者为同一位中国男性武修（参考用户上传图），全程保持参考图人物特征不漂移；
穿黑色立领武修长衫，姿态体格按下方动作描述演绎。
```

**适用场景**：用户有具体参考图、希望角色辨识度高、保持系列一致性。

---

**路径 C｜分两步出图（最稳定，适合复杂或动漫风角色）**

当用户角色风格特殊（比如二次元、特定画风、有独特配饰），路径 A、B 都可能漂移，更稳的做法：
1. **第一步**：用 Step 3 提示词原样跑一张白模海报（确认动作 / 镜头 / 场景设计正确）
2. **第二步**：把白模海报 + 用户人物图同时输入到「主体替换 / inpaint / character swap」类工具中，单独跑一次「保留构图 + 替换角色」
3. 如果工具不支持 N 格批量替换，可以**逐格替换**（或先剪裁出每一格白模 + 用户人物图 → 单格替换 → 拼回 N 宫格）

**适用场景**：动漫角色、特殊画风、保持精确动作但角色风格差异大。

---

### Step 4 视频 prompt 的角色替换

视频 prompt 同样模块化处理：
- 找到视频 prompt 中「[场景与人物开场]」段落里的人物视觉描述
- 用相同的逻辑替换（路径 A 文字替换 / 路径 B 给视频模型上传角色参考图 + 海报）
- 「镜头覆盖清单」「完整打斗叙事」「镜头语言」「速度曲线」「环境互动」等其他段落**全部保留**
- 大部分视频生成工具支持「reference image / first frame」——把替换后的多宫格海报或单张角色图作为 first frame，视频 prompt 描述会自动按新角色演绎

---

### 替换工作流的 3 条注意事项

1. **服装与动作的兼容性**：用户人物的服装如果是宽袍 / 长裙 / 高跟 / 紧身机能，需要回看原 N 招的姿态配额——比如低桩仆步 + 高跟会卡顿，腾空踢 + 长裙会画得很糟。提醒用户：「该套动作的最低桩 / 最大腾空在 X 招，如果你的角色服装是 Y，建议 ...」
2. **调性兼容性**：暴力美学 + 萌系动漫角色、写意武侠 + cyberpunk 机能服 这种调性冲突，会让 AI 风格分裂。建议用户在替换角色前确认调性匹配
3. **保留 Step 3 + Step 4 原版本**：替换前先备份原始白模海报和视频 prompt，方便对比效果或回退

---

## 红线

1. **不调任何 API 实际生成图片**——本 skill 只产出文本提示词，由用户拿去喂给绘图工具
2. **不做"轻微换姿势"**——如果检查发现两格视觉差异不足，必须重选其中一招
3. **不省略人物描述**——多宫格里 AI 是把每一格当独立画面渲染的，主提示词中人物特征必须以"全程保持同一人物"硬性要求出现
4. **不发明武术流派**——只用 `references/martial-arts-systems.md` 中已列出的体系；用户给的体系不在词典内时，先告知并请其确认
5. **不混用调性**——一份海报只能一种调性（写意 vs 暴力美学不能混），调性不一致会让 AI 出图风格分裂
6. **不发明用户没指定的桥段细节**——B 模式（桥段还原）下，AI 对原作品的"训练记忆"必须先告知用户并请求确认；如无可靠记忆直接告知用户并请其详细描述。绝不能编造自己没把握的招式或情节
7. **视频提示词必须配套图片，且必须是一整段连贯描述**——Step 4 的视频 prompt 是「一整段从起势到收势的连贯电影叙事」，**严禁拆成 N 段碎片让用户自己拼接**；视频 prompt 要与 Step 3 的图片 prompt 在人物 / 服装 / 兵器 / 场景上严格一致，让视频模型把图里的人物"活过来"按 prompt 演一段完整连贯的视频；必须根据推荐视频模型的时长上限做"招式精简编排"，不要把 N 招全塞进 5s
8. **视频 prompt 必须三重合规化（版权 + 暴力 + 平台中立，零容忍）**——视频生成模型的 content filter 极严，会从三个维度同时拦截。
   - **类别 A 版权脱敏**：所有专有名词（角色名 / 作品名 / 武器名 / 武魂名 / 技能名 / 门派名 / 特定地点名）必须替换为视觉特征描述（颜色 + 材质 + 形态 + 光效）
   - **类别 B 暴力软化**：血 / 锁喉 / 绞杀 / 致命 / 决死 / 距喉 X cm 等过直白描述必须戏剧性软化（替换为"颈部控制"、"决胜瞬间"、"逼近上身要害"、"劲道贯穿"等）；保留张力但不写血腥与具体致命点；**默认所有角色 18+，严禁出现具体未成年岁数**；不用真实枪械描述
   - **类别 C 平台中立**：严禁出现具体视频 / 图片模型 / 平台 / 产品名（无 sora / kling / 即梦 / seedance / veo / runway / midjourney 等具体名称），改成通用参数维度（运动幅度 / 一致性档位 / 宽高比 / 帧率 / 风格关键词）
   - 三类映射表与原则见 Step 4「Prompt 合规化改写」模块。**Step 3 图片 prompt 强制遵守 B + C 两类**（图片审核同样严格，"距喉 X cm" / "锁住颈部" / "血珠悬空" / 平台名 等都会被拦截或强制改写；A 类版权脱敏可视绘图工具严格度自行决定）；**Step 4 视频 prompt 三类全部零容忍**
9. **视频 prompt 必须显式排除海报 UI 元素（v8.3 强制必出，零容忍）**——图片中的「编号 / 中文招式标题 / 中文要点说明 / 动作方向箭头 / 重心轨迹线 / 格子边框 / 网格分隔线 / 任何文字标注」是 pre-vis 武指工作单的注释层，**不是画面内容**。视频 prompt 必须在最前段显式声明排除这些 UI，否则视频会带着箭头 / 编号 / 文字一起渲染，毁掉电影感。视频画面应只包含：演武主体 + 武器 + 环境 + 灯光 + 残影粒子。
10. **视频 prompt 必须包含镜头覆盖清单（v8.3 强制必出）**——N 格全部列出，每格在视频中都有处理方式（完整演 / 一笔带过 / 凝视聚焦 / 浓缩并击），**严禁跳过任何一格导致视频镜头缺失**；时长不够就压缩单格时间，不能丢镜头
11. **角色描述模块化（v8.3 强制必出）**——Step 3 提示词中的「演武者外貌 + 服装」必须写成自成一段的角色块（开头「演武者为同一位 ...」结尾「全程保持同一人物」），便于用户后续替换为自己的角色图；禁止把人物特征零散散布在多个招式要点里
12. **正文与使用建议必须严格分离（v8.4 强制必出）**——视频 prompt 必须输出两个独立块：「视频 prompt 正文」（用户复制喂给视频模型）+「使用建议」（用户看的工具配置说明）。「建议总时长」「运动幅度档位」「宽高比」「帧率」「风格关键词」等是工具 UI 参数，**严禁塞进 prompt 正文**——模型读到只会困惑或忽略，反而稀释正文有效信息密度。Step 3 图片 prompt 同理：「整体效果参考」是给模型看的（可保留），「建议复制到 XX 工具」「画面比例 1:1」等是给用户看的（必须放外部说明）。
13. **节奏用相对描述，不写绝对秒数（v8.4 强制必出）**——视频生成模型的总时长是工具 UI 参数（5/10/15 秒），prompt 里写「1.5 秒完整演」「0.6 秒凝固定格」「0.3 倍超慢镜」会与工具实际时长冲突或被模型忽略。必须改用**相对节奏词**（较长定格 / 短促一击 / 凝固瞬间 / 一笔带过 / 浓缩并击 / 起势段较长 / 中段紧凑 / 高潮拉长 / 收势缓慢 / 关键招与过渡招比例约为 X:Y），让模型按用户选定的总时长按比例自动分配。
14. **忠于参考图，禁止凭空添加（v8.4 强制必出）**——视频生成模型在 i2v 时容易"自由发挥"添加图里没有的人物 / 武器 / 道具 / 桌椅家具 / 围观角色 / 烟雾血迹 / 文字标识 / 未指定特效。视频 prompt 必须**显式声明「忠于参考图原则」写在正文最前段**：人物数量、武器形态、场景元素、调性、服装细节都以参考图为准，不增不减；动态元素仅限 prompt 中明确列出的几类（如衣袂残影 / 粒子 / 灯光氛围 / 速度线 / 虚化对手剪影），不能自由发挥
15. **好莱坞大片打斗 7 要素 + 动作连贯性（v8.5 强制必出，缺一即重写）**——本 skill 的最终输出对标好莱坞 / 国际经典打斗（《疾速追杀》《伯恩谍影》《突袭》《卧虎藏龙》《一代宗师》《杀死比尔》《盗梦空间》《老男孩》《疯狂麦克斯》《角斗士》等），不只是国产武指底线。视频 prompt 必须包含：
   - **决定性瞬间（屏息 frame）**：至少 1 处让观众屏息的电影海报级一帧
   - **物理重量感**：每一击有肉感反作用力 / 衣袂随发力鼓荡 / 重心崩溃感
   - **运动惯性自然过渡**：动作之间不是切换是惯性带动，前招余势带出后招起势，像水流不像 PPT 翻页（本要素是「动作连贯性」的核心）
   - **节奏对比**：慢镜 / 正常 / 凝固 至少两档；尤其要有"快慢交替的呼吸感"
   - **空间立体纵深**：地面 / 中段 / 腾空 至少两层；前景 / 中景 / 背景 至少两层
   - **环境作为参与者**：墙 / 桌 / 灯 / 雨水 / 雪花 / 尘土 / 碎玻璃 与招式互相塑造
   - **人物极限状态**：眼神特写或表情凝望体现身体极限与心理压力

