# Fanren Xiuxianzhuan 2d Zhuanhui

> 按用户指定的视觉风格，先通过代表性片段小样实验和用户确认锁定风格，再将原始影视片段批量转绘为统一的原创二维动画视频；适用于 GPT Image 2 故事板、MiniMax H3 Ref2VA、ComfyUI 串行生成、原声音轨替换和全量 QC。

- Skill: `602387193c/fanren-xiuxianzhuan-2d-zhuanhui` (Agent Skill, multi-file: 11 files)
- Install (CLI): `npx skillmds@latest add 602387193c/fanren-xiuxianzhuan-2d-zhuanhui`
- Raw SKILL.md: https://api.skillmd.com/api/skills/602387193c/fanren-xiuxianzhuan-2d-zhuanhui/raw
- Safety review: pending (external: skill-scanner PASS, skillspector PASS)
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: 602387193c (https://skillmd.com/u/602387193c)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/602387193c/fanren-xiuxianzhuan-2d-zhuanhui

---


# 凡人修仙传2d转绘

这是一个可迁移到不同项目目录、不同视觉风格的“原视频 → 风格化故事板 → H3 视频 → 原声音轨成片”工作流。风格由用户指定，可以是某种二维动画、绘画、版画、纸片、手绘或其他明确的视觉方向；Skill 不预设 Paprika、某个电影或某个固定色板。默认输出为 768p（1376×768、24fps），不把原视频送入 H3，只使用原视频做内容分析、抽帧和取回原音。

## 什么时候使用

当用户希望把一批影视片段统一转成用户指定的原创二维风格时使用。用户可以引用某部作品作为气质参考，也可以直接描述线条、色彩、材质、光线、构图和运动方式；引用作品只作为高层视觉启发，不复制其人物、具体镜头或画面。实际内容、人物、动作和镜头顺序必须来自用户自己的素材。

开始前先读：

- [标准流程](references/01_标准流程.md)：输入、目录、故事板、H3、音轨和交付规则。
- [提示词模板](references/02_提示词模板.md)：GPT Image 2 故事板和 H3 Ref2VA 的通用模板。
- [风格测试与锁定](references/04_风格测试与锁定.md)：如何做小样、记录反馈、确认风格并切换到全量生产。
- 批量任务再读 [批处理与 QC](references/03_批处理与QC.md)。

## 不可改变的核心约束

1. 原视频只用于盘点、ffprobe、关键帧/内容网格分析和最终音频来源；禁止把原视频、原始关键帧或内容网格作为 H3 的视频参考或图像参考。
2. H3 只接收当前片段的“无台词、无水印、无乱码”的风格化故事板。
3. H3 生成的声音全部丢弃；最终音频来自对应源视频，优先 stream copy，并用 PCM SHA256 核对。
4. 默认按源片段完整时长生成：`H3 length = round(source_duration × 24) + 2`。不能因为超过 15 秒就硬裁或拆段；只有节点上限、OOM 或同一完整时长连续失败时才拆段。
5. H3 必须串行提交，一段完成、合成、QC 后再提交下一段，避免显存抢占和 prompt_id 混淆。
6. 画面必须服从“已锁定的用户风格规范”。如果用户没有明确指定，先提出 2–3 个可执行的风格方向并用小样确认；不要把本 Skill 的示例色板或明亮留白误当成硬性风格。无论何种风格，都禁止无意义密集细节、生成式乱码、字幕、水印和 logo。
7. 不覆盖源视频、描述文本、原工作流或既有成片；新文件使用版本化文件名。

## 推荐执行顺序

确认用户风格需求 → 选择代表性片段做小样 → GPT Image 2/H3 试验 → 展示小样并收集反馈 → 记录并锁定 style lock → 盘点全部输入 → 解析 Shot 时间 → 原片抽帧做内容网格 → 按锁定风格生成无台词故事板 → 生成准确台词查看版 → 编写六段 H3 Ref2VA prompt → 注入 768p API workflow → 串行提交 H3 → 用源视频音轨合成最终片 → 抽帧视觉 QC → 技术/音频/清单 QC → 可选地串联所有最终片段。

## 本 Skill 的脚本

脚本位于 `scripts/`，都使用绝对路径参数，不依赖某个项目的盘符或中文目录名：

- `build_h3_assets.py`：读取源描述文本，生成六段 H3 prompt，并把 prompt、768p 参数、种子和故事板路径注入 API workflow。
- `submit_and_wait_h3.py`：向本地 ComfyUI `/prompt` 提交一个 API workflow，并轮询 `/history/<prompt_id>`。
- `finalize_video.py`：把 H3 画面按源片段时长校正，替换为源音频，生成 12 帧 QC 图并写技术 JSON。
- `batch_qc.py`：检查一批最终片段的尺寸、帧率、可解码性、音频存在性和源/最终 PCM 哈希。
- `concat_videos.py`：按数字顺序把已通过 QC 的最终片段拼接成长视频，使用无损封装合并，不重新编码。

使用这些脚本前，必须先根据 [标准流程](references/01_标准流程.md) 准备好故事板和 API workflow；脚本不会替代人工确认镜头内容、风格和台词准确性。

## 完成定义

只有在以下条件全部满足时才报告“完成”：所有目标片段都有最终文件；每段为 1376×768/24fps；最终视频能完整解码；音频是源音频且哈希匹配；12 帧 QC 没有故事板边框、字幕、乱码、水印、黑尾或严重角色崩坏；manifest 中没有未解释的 pending/h3_submitted 状态。若用户要求全集，再额外检查拼接后的长视频。

