Seed Audio

用自然语言描述生成目标音频。把一段场景描述(人声对话、环境声、音效、背景音乐等复合音频)一次性生成成音频。当用户描述一个声音场景、要求生成/合成/制作一段音频或声音、给出形如"角色:台词"的对话脚本要转成音频、或要按参考音频的音色说话时使用。支持两种模式:纯文本描述生成(T2A)和带参考音频生成(A2A,在描述中引用参考音频指定角色音色)。如果用户的主要意图或目标产物是生成或编辑视频,应使用视频生成或编辑 skill,不得加载或使用本 skill,也不得自行将视频需求扩展为旁白、配乐或音效生成。

ahang1598 Updated 9 repo stars

File contents

ahang1598/doubao-workbuddy-qwenwork-skills/tree/main/doubao/skills/seed-audio commit 00ff49f2c2

Frequently asked questions

npx skillmds@latest add ahang1598/seed-audio-2