# Outfit Director

> 为女性、男性或宠物设计“同一主体多套造型拼贴首帧 + 换装视频”，输出参数锁定、图片提示词、完整时间轴、精简视频提示词和负面约束。用户提到换装导演、人物或宠物换装、穿搭拼贴、悬浮贴纸、点击/飞入换装、8–10 秒卡点变装、15 秒换装舞蹈、7 套造型、上传参考图延展，或先推荐服装方案时使用。

- Skill: `liyue-aigc/outfit-director` (Agent Skill, multi-file: 5 files)
- Install (CLI): `npx skillmds@latest add liyue-aigc/outfit-director`
- Raw SKILL.md: https://api.skillmd.com/api/skills/liyue-aigc/outfit-director/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: liyue-aigc (https://skillmd.com/u/liyue-aigc)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/liyue-aigc/outfit-director

---


# 换装导演

## 目标

把一次换装需求转换为彼此联动的：

1. 路由判定与参数锁定
2. 拼贴首帧图片提示词
3. 完整视频时间轴
4. 可直接复制的精简视频提示词
5. 负面提示词与强制约束

图片是视频的结构母图。视频必须继承主体身份、全部造型、侧边贴图位置、画面布局与摄影质感。

## 工作流程

1. 先执行主体路由：女性、男性、宠物或混合合集；判断复杂、涉及宠物或混合合集时读取 `references/subject-routes.md`。
2. 再执行视频路由：卡点换装或换装舞蹈。
3. 锁定用户明确给出的参数；只补全低风险缺失项。
4. 需要服装方案时读取 `references/parameter-presets.md`。
5. 需要选择或改造转场时读取 `references/transition-library.md`。
6. 生成首帧提示词，再依据首帧结构生成视频时间轴。
7. 最后执行数量、时长、贴图消失、身份一致性检查。

不要重复询问已知信息。仅在主体类别、造型方向或互相冲突的高影响参数完全无法推断时，问一个简短问题。

## 主体路由

按以下优先级判定：

1. 用户明确指定的主体类别
2. 上传参考图中清晰可见的主体
3. 用户文本中的角色、性别、物种或品种
4. 均缺失时默认原创中国成年女性

### 女性路线

- 无参考图且未指定国籍 / 族裔外观时，默认原创中国成年女性，视觉年龄 22–28 岁，自然真实的东亚面部特征。
- 明确锁定脸型、五官、肤色、妆容、眼睛、发型、发色、身材比例与整体气质。
- 不使用服装或文化符号代替族裔外观，不自动生成欧美面孔。

### 男性路线

- 无参考图且未指定国籍 / 族裔外观时，默认原创中国成年男性，视觉年龄 22–30 岁，自然真实的东亚面部特征。
- 明确锁定脸型、五官、肤色、胡须状态、发型、发色、体型比例与整体气质。
- 服装和动作可阳光、都市、学院、商务、运动、国风或用户指定，不套用女性妆容与姿态模板。

### 宠物路线

- 锁定物种、品种或混种特征、成年/幼年阶段、体型、毛色、花纹、眼睛、耳形、口鼻、尾巴和项圈等识别锚点。
- 不写国籍、族裔、妆容或人类身材比例。
- 默认保持真实动物解剖与四足运动；除非用户明确要求，不拟人化站立或舞蹈。
- 服装必须适体、安全，不遮挡眼睛、鼻子、嘴巴，不束缚颈部、胸腔、四肢与尾巴。
- 宠物“舞蹈”默认解释为节拍化转圈、抬爪、侧步、坐立、歪头等自然动作组合。

### 混合合集路线

- 用户明确要求女性、男性与宠物合集时，分别生成独立子方案；不得把人物身份一致性强行跨主体套用。
- 每个子方案独立执行主体锚点、首帧、时间轴和负面约束。
- 未明确要求同框时，默认分成多个独立视频，避免一条视频中主体数量和造型路由冲突。

## 视频模式路由

### 模式 K｜卡点换装

触发词：卡点、点击换装、贴纸飞入、快速变装、8 秒、9 秒、10 秒。

- 时长限定 8–10 秒；用户未指定具体值时使用 9 秒。
- 默认 5 套造型：中央初始造型 + 4 个侧边造型。
- 默认固定机位，优先保证换装因果与动作连续。
- 默认加入有清晰重拍的卡点背景音乐；必要转场音效可轻量叠加。用户说“仅背景音乐”时禁止额外音效。
- 用户明确指定 3–7 套造型时可调整数量与布局，但时长仍保持 8–10 秒。
- 默认完成点（9 秒）：1.35、3.05、4.85、6.85 秒；最后至少保留 1.5 秒展示最终造型。

### 模式 D｜15 秒换装舞蹈

触发词：换装舞蹈、跳舞、舞蹈编排、dance、15 秒。

- 时长固定 15 秒。
- 造型固定正好 7 套：中央初始造型 1 套 + 左侧 3 套 + 右侧 3 套。
- 中央主体必须全身站在画面中间，双脚活动区稳定，不漂移出中心区域。
- 左侧上 / 中 / 下各放 1 个完整主体贴图；右侧上 / 中 / 下各放 1 个完整主体贴图。
- 六个侧边贴图分别穿不同服装并采用不同舞蹈关键姿势；脸、发型、体型或宠物识别锚点始终一致。
- 默认激活顺序为左上 → 右上 → 左中 → 右中 → 左下 → 右下，以保持视觉平衡。
- 默认换装完成点为 2.0、4.1、6.3、8.5、10.8、13.0 秒；13.0–15.0 秒展示最终造型并完成收尾动作。
- 每次在舞蹈动作峰值换装，连续完成六次变装；不得切成七段彼此无关的独立动作。
- 默认只使用卡点背景音乐，不加点击声、飞入声或换装音效；用户明确要求时再添加。
- 默认固定正面全身机位；可轻微呼吸式推近，但不得影响七个主体的首帧识别和中央舞蹈连续性。

当“卡点”和“舞蹈”同时出现时：若用户强调连续舞蹈或 15 秒，选择模式 D；否则选择模式 K。用户明确要求两版时分别输出，不混成一条时间轴。

## 工作模式

### 直接生成

已有参考图、角色设定或足够服装信息时，直接输出完整结果，不重复提问。

### 参数推荐

用户说“原创推荐”“先给方案”“推荐几组”时，读取 `references/parameter-presets.md`，先输出 4–8 组差异明显的参数组合；用户选定后再生成完整提示词和脚本。

### 参考图提取

- 提取可见主体身份、年龄阶段、外貌或动物识别锚点、造型、位置、比例、朝向、背景和光线。
- 参考图优先于默认值；看不清的非核心细节可标记 `系统补全`。
- 不用文字模板覆盖图片中已经明确存在的设定。

### 换装机制改造

用户已有脚本而只想更换变装方式时，保留主体、服装、镜头、时长和布局，只替换触发与相应动作。先读取 `references/transition-library.md`；需要备选时提供 3–6 个方案。

## 参数锁定

用户明确给出的参数均为锁定参数，不得擅自替换、弱化或删除。只列本次真正使用的字段：

- 主体路线与基础身份
- 成年年龄感；宠物则写生命阶段
- 国籍 / 族裔外观；宠物则写物种 / 品种
- 外貌或动物识别锚点
- 发型、头饰、耳饰；宠物则写毛色、花纹、项圈
- 初始造型及其余全部造型
- 画幅、布局、背景、光线与主色系
- 视频模式、时长、比例、机位与运镜
- 动作基调、换装机制、完成卡点、声音与结尾动作
- 系统补全项

## 默认图片布局

### 卡点模式：五主体拼贴

- 中央：大型主体，约占画面宽度 55%–62%。
- 四个侧边贴图：左上、右上、左下、右下。
- 正好 5 个同一主体版本；中央最大，侧边明显更小。

### 舞蹈模式：七主体对称拼贴

- 中央：全身主体，约占画面宽度 42%–48%，完整露出头顶和双脚。
- 左侧：左上、左中、左下三个完整主体贴图。
- 右侧：右上、右中、右下三个完整主体贴图。
- 正好 7 个同一主体版本；侧边六个贴图不遮挡中央脸、手臂、腰胯与双脚活动区。
- 六个侧边造型和姿势均不同；左右视觉重量均衡。

通用硬规则：

- 侧边贴图必须沿真实身体或宠物轮廓裁切，不得使用矩形缩略图。
- 每个侧边贴图使用独立白色虚线或用户指定描边；中央主体不描边。
- 同一视频中的所有版本必须是同一主体，只改变服装、配饰和动作姿势。
- 人物必须全身完整；宠物必须完整保留耳、爪和尾巴。

## 首帧图片提示词

按此顺序编写：

1. 画幅、摄影风格与主体路线
2. 统一身份和识别锚点
3. 明确“正好 5 个”或“正好 7 个”同一主体版本
4. 中央主体的位置、构图、姿态与初始造型
5. 每个侧边贴图的精确位置、姿态与对应造型
6. 轮廓裁切和描边效果
7. 背景、光线、镜头、皮肤 / 毛发、发丝与服装面料
8. 主色系和画面气质
9. 数量、完整肢体、身份一致性等硬限制
10. 负面提示词

为视频兼容：姿势不得极端扭曲；头、肩、腰、手臂或宠物四肢结构清晰；服装边缘完整；中央姿势要给后续动作留空间。

## 默认换装机制

卡点拼贴默认使用“完整主体飞入重合”：

1. 激活目标侧边贴图。
2. 复制出相同的完整主体轮廓作为飞入副本。
3. 原位置目标贴图在飞入启动的同一帧立即消失，原位留空，之后不再出现。
4. 飞入副本沿斜线移动到中央并放大，描边始终贴合主体轮廓。
5. 副本与中央主体的头、肩、腰和姿态对齐；宠物则对齐头、躯干与四肢支点。
6. 对齐瞬间切换服装，飞入副本和描边同时彻底消失。
7. 中央只保留一个主体，继续原动作，不产生双影。

舞蹈模式优先使用“侧边贴图激活 + 舞蹈动作峰值换装”：侧边贴图按规定顺序激活并立即从原位消失，在中央人物转身、踏步、手势或身体线条的动作峰值完成服装替换。六次换装后，六个侧边位置全部留空。

若用户指定其它机制，严格使用。详细选择见 `references/transition-library.md`。

## 时间轴要求

每一段都必须写明：

- 时间范围与当前造型
- 主体动作和空间位置
- 眼神 / 表情；宠物则写视线、耳朵和尾巴状态
- 舞蹈模式中的舞步、手势与动作峰值
- 被激活的侧边贴图及其原位消失时刻
- 换装运动方向、完成时刻与动作延续方式
- 发丝、袖摆、裙摆、流苏或宠物毛发的自然物理
- 背景音乐节拍；仅在允许时写音效

## 动作与物理连续性

- 换装前后保持重心、旋转方向、手臂轨迹、头部朝向和视线因果连续。
- 不因换衣重置姿势，不瞬移，不突然改变身体比例。
- 15 秒舞蹈必须是一段连续编舞，每次换装承接上一拍动作。
- 长裙、长袖、披帛、流苏和宠物毛发具有重力、惯性延迟与自然回落。
- 换装瞬间不中断物理状态，不穿模、不粘连、不僵硬漂浮。

## 强制一致性与负面约束

完整输出必须明确：

- 同一主体身份、脸或动物面部特征、年龄阶段、肤色 / 毛色、发型 / 毛纹与身体比例。
- 只改变服装、配饰和编排姿势，不重做主体。
- 卡点模式默认正好 5 个版本；舞蹈模式正好 7 个版本。
- 已激活的侧边贴图原位置立即清空，之后不保留、不弹回、不复现。
- 中央始终只保留一个主体，不出现双影、残影或身体融合。
- 不出现矩形卡片、额外人物 / 宠物、服装叠穿、错误肢体、多余手指 / 爪、头脚裁切、背景突变或无故运镜。
- 宠物服装不遮挡感官与呼吸，不束缚自然运动。

## 输出协议

完整生成任务按以下顺序输出：

### 1）路由判定

- 主体路线：女性 / 男性 / 宠物 / 混合合集
- 视频模式：K 卡点换装 / D 15 秒换装舞蹈
- 判定依据：只写一句

### 2）参数锁定结果

列出本次使用的身份、造型、布局、时长、卡点、镜头、动作、声音和系统补全项。舞蹈模式必须逐项列出中央造型、左侧 3 套和右侧 3 套，共 7 套。

### 3）首帧图片提示词

输出一段可直接用于图像模型的完整中文提示词。

### 4）视频时间轴脚本

按连续时间段覆盖完整 8–10 秒或 15 秒，不得遗漏空档；把每次换装完成时刻精确到 0.1 秒。

### 5）精简视频提示词

输出一段可直接复制到视频模型的整合提示词，包含主体、镜头、动作、六次或四次换装、贴图消失规则、BGM 与一致性约束。

### 6）负面提示词

输出逗号分隔的精简负面提示词，覆盖数量错误、身份漂移、贴图残留、双影、肢体错误、服装叠穿、镜头漂移和背景突变。

## 交付前检查

- 主体路由是否正确，参考图是否覆盖默认值。
- 卡点模式是否为 8–10 秒；舞蹈模式是否严格为 15 秒。
- 舞蹈模式是否正好 7 套、中央 1 套、左右各 3 套。
- 时间轴是否覆盖全时长，完成点是否与造型数量一致。
- 每个被激活贴图是否立即从原位消失且永不复现。
- 人物或宠物是否始终为同一主体，中央是否始终只有一个。
- 音频是否符合：舞蹈默认仅卡点 BGM；卡点模式按用户要求决定是否加音效。

