File contents MV Generator — 音乐视频生成管线
MediaClaw 内置的音乐视频端到端生成技能。
触发词
生成MV
MV制作
音乐视频
mv generator
虚拟歌手MV
管线流程
音频文件 + 歌词 + 角色卡
│
▼
┌────────────────────────────┐
│ Step 1: 音频分析 │
│ scripts/audio-analyzer.py │
│ → 时长、BPM、场景时间线 │
└────────────┬───────────────┘
│
▼
┌────────────────────────────┐
│ Step 2: 歌词解析 │
│ scripts/lyrics-parser.py │
│ → 段落结构、情绪曲线 │
└────────────┬───────────────┘
│
▼
┌────────────────────────────┐
│ Step 3: 场景+帧设计 │
│ scripts/scene-design.py │
│ → 场景类型、运镜、首尾帧prompt │
└────────────┬───────────────┘
│
▼
┌────────────────────────────┐
│ Step 4: 帧图像生成 │
│ qingyun gpt-image-1 API │
│ → 每场景 first+last frame │
└────────────┬───────────────┘
│
▼
┌────────────────────────────┐
│ Step 5: 视频片段生成 │
│ kling-2 / veo-3.1 / etc │
│ → 首帧→尾帧 5s 视频片段 │
└────────────┬───────────────┘
│
▼
┌────────────────────────────┐
│ Step 6: 最终合成 │
│ FFmpeg merge │
│ → 音轨对齐+转场+字幕 │
└────────────────────────────┘
输入
参数
必填
说明
audio_file
✅
音频文件路径 (.mp3/.wav/.m4a)
lyrics
✅
歌词文本
character_card
✅
角色卡 JSON(外貌、声音、风格)
style
❌
cinematic / realistic / anime / ethereal
num_scenes
❌
分镜数(默认 9)
output_dir
❌
输出目录(默认: MediaClaw/output/<project>/)
输出目录结构
output/<project-name>/
├── README.md ← 项目概要 + 时间轴
├── frames/ ← 首尾帧图像
│ ├── 01_first.png
│ ├── 01_last.png
│ └── ...
├── audio/ ← 音频文件(多版本)
│ └── song_v1.mp3
├── script/ ← MV 剧本
│ ├── mv_final.json ← 精准时间轴 JSON
│ ├── mv_final.md ← 人类可读剧本
│ └── character.json ← 角色卡
├── docs/ ← 文档和参考素材
│ └── avatar.png
└── video/ ← 生成的视频片段(Step 5 产出)
├── scene_01.mp4
└── ...
经验总结(来自 Chloe《樱花落尽时》项目)
图像生成最佳实践
项目
推荐
备注
模型
qingyun gpt-image-1
成功率最高
API
/v1/images/generations
比 edits 更稳定
尺寸
1024x1536(竖版)
必须用规定尺寸
并发
2-3 并发
过多会 SSL EOF
重试
失败单独重试
不整批重跑
角色一致性技巧
统一 prompt prefix : 包含角色核心外貌特征
参考图 : 用 edits API 传入角色头像(但成功率低)
场景限定词 : 每帧 prompt 固定前缀 + 场景变量
音频同步
用 mutagen 读 MP3 时长(无需 ffprobe)
场景时间按歌曲结构比例分配
BPM 检测需 librosa(可选)
视频模型选择
情绪
模型
场景类型
≤ 6.0
kling-1.6
静态/自然/国风
6.0-8.0
kling-1.6 或 kling-2
过渡
≥ 8.0
kling-2
爆发/力量
360°旋转
veo-3.1
特殊运镜
依赖
Python: mutagen, requests
外部 API: qingyun (图像), xingjiabi (视频), Google (veo-3.1)
可选: librosa (BPM), ffmpeg (合成)
参考
audio-analyzer.py — 音频分析
Chloe 项目完整输出
virtual-singer-mv-script — 独立 MV 剧本 skill
1 --- 2 name: mv-generator 3 description: MV Generator — 音乐视频生成管线 4 --- 5 6 # MV Generator — 音乐视频生成管线 7 8 MediaClaw 内置的音乐视频端到端生成技能。 9 10 ## 触发词 11 - 生成MV 12 - MV制作 13 - 音乐视频 14 - mv generator 15 - 虚拟歌手MV 16 17 ## 管线流程 18 19 ``` 20 音频文件 + 歌词 + 角色卡 21 │ 22 ▼ 23 ┌────────────────────────────┐ 24 │ Step 1: 音频分析 │ 25 │ scripts/audio-analyzer.py │ 26 │ → 时长、BPM、场景时间线 │ 27 └────────────┬───────────────┘ 28 │ 29 ▼ 30 ┌────────────────────────────┐ 31 │ Step 2: 歌词解析 │ 32 │ scripts/lyrics-parser.py │ 33 │ → 段落结构、情绪曲线 │ 34 └────────────┬───────────────┘ 35 │ 36 ▼ 37 ┌────────────────────────────┐ 38 │ Step 3: 场景+帧设计 │ 39 │ scripts/scene-design.py │ 40 │ → 场景类型、运镜、首尾帧prompt │ 41 └────────────┬───────────────┘ 42 │ 43 ▼ 44 ┌────────────────────────────┐ 45 │ Step 4: 帧图像生成 │ 46 │ qingyun gpt-image-1 API │ 47 │ → 每场景 first+last frame │ 48 └────────────┬───────────────┘ 49 │ 50 ▼ 51 ┌────────────────────────────┐ 52 │ Step 5: 视频片段生成 │ 53 │ kling-2 / veo-3.1 / etc │ 54 │ → 首帧→尾帧 5s 视频片段 │ 55 └────────────┬───────────────┘ 56 │ 57 ▼ 58 ┌────────────────────────────┐ 59 │ Step 6: 最终合成 │ 60 │ FFmpeg merge │ 61 │ → 音轨对齐+转场+字幕 │ 62 └────────────────────────────┘ 63 ``` 64 65 ## 输入 66 67 | 参数 | 必填 | 说明 | 68 |------|------|------| 69 | `audio_file` | ✅ | 音频文件路径 (.mp3/.wav/.m4a) | 70 | `lyrics` | ✅ | 歌词文本 | 71 | `character_card` | ✅ | 角色卡 JSON(外貌、声音、风格) | 72 | `style` | ❌ | cinematic / realistic / anime / ethereal | 73 | `num_scenes` | ❌ | 分镜数(默认 9) | 74 | `output_dir` | ❌ | 输出目录(默认: `MediaClaw/output/<project>/`) | 75 76 ## 输出目录结构 77 78 ``` 79 output/<project-name>/ 80 ├── README.md ← 项目概要 + 时间轴 81 ├── frames/ ← 首尾帧图像 82 │ ├── 01_first.png 83 │ ├── 01_last.png 84 │ └── ... 85 ├── audio/ ← 音频文件(多版本) 86 │ └── song_v1.mp3 87 ├── script/ ← MV 剧本 88 │ ├── mv_final.json ← 精准时间轴 JSON 89 │ ├── mv_final.md ← 人类可读剧本 90 │ └── character.json ← 角色卡 91 ├── docs/ ← 文档和参考素材 92 │ └── avatar.png 93 └── video/ ← 生成的视频片段(Step 5 产出) 94 ├── scene_01.mp4 95 └── ... 96 ``` 97 98 ## 经验总结(来自 Chloe《樱花落尽时》项目) 99 100 ### 图像生成最佳实践 101 | 项目 | 推荐 | 备注 | 102 |------|------|------| 103 | 模型 | qingyun `gpt-image-1` | 成功率最高 | 104 | API | `/v1/images/generations` | 比 edits 更稳定 | 105 | 尺寸 | `1024x1536`(竖版) | 必须用规定尺寸 | 106 | 并发 | 2-3 并发 | 过多会 SSL EOF | 107 | 重试 | 失败单独重试 | 不整批重跑 | 108 109 ### 角色一致性技巧 110 - **统一 prompt prefix**: 包含角色核心外貌特征 111 - **参考图**: 用 edits API 传入角色头像(但成功率低) 112 - **场景限定词**: 每帧 prompt 固定前缀 + 场景变量 113 114 ### 音频同步 115 - 用 `mutagen` 读 MP3 时长(无需 ffprobe) 116 - 场景时间按歌曲结构比例分配 117 - BPM 检测需 `librosa`(可选) 118 119 ### 视频模型选择 120 | 情绪 | 模型 | 场景类型 | 121 |------|------|---------| 122 | ≤ 6.0 | kling-1.6 | 静态/自然/国风 | 123 | 6.0-8.0 | kling-1.6 或 kling-2 | 过渡 | 124 | ≥ 8.0 | kling-2 | 爆发/力量 | 125 | 360°旋转 | veo-3.1 | 特殊运镜 | 126 127 ## 依赖 128 - Python: mutagen, requests 129 - 外部 API: qingyun (图像), xingjiabi (视频), Google (veo-3.1) 130 - 可选: librosa (BPM), ffmpeg (合成) 131 132 ## 参考 133 - [audio-analyzer.py](scripts/audio-analyzer.py) — 音频分析 134 - [Chloe 项目完整输出](../../output/chloe-sakura-mv/) 135 - [virtual-singer-mv-script](~/clawd/skills/virtual-singer-mv-script/) — 独立 MV 剧本 skill
aAAaqwq/AGI-Super-Skills/tree/main/skills/mv-generator commit 07c0c6d0cb
Frequently asked questions How do I install the Mv Generator skill? Run npx skillmds@latest add aaaaqwq/mv-generator in your terminal (requires Node.js), paste this page's agent-chat prompt into Claude, Cursor, or any MCP-connected agent, or download the SKILL.md file and copy it into your agent's skills directory.
What does the Mv Generator skill do? MV Generator — 音乐视频生成管线 It is listed under Coding & Dev Tools on SkillMD.
Is Mv Generator safe to use? This skill has not completed SkillMD's automated safety review yet. SkillMD never runs a skill's scripts for you; review the SKILL.md before installing.
Which AI agents work with Mv Generator? This skill is tagged as working with Claude Code, Claude.ai, OpenAI Codex. SKILL.md is an open format, so most agents that read a skills directory can load it too.
Is Mv Generator free to use? Yes. Installing skills from SkillMD is free, and the skill stays under its author's original license.
Who published Mv Generator? aAAaqwq (@aaaaqwq) published this skill. Their other Agent Skills are listed on their SkillMD profile.