Thinksound Audio Generation Reasoning

Generates high-quality audio through three-stage CoT reasoning pipeline: foundational foley synthesis, object-focused refinement, and instruction-guided editing. Uses fine-tuned VideoLLaMA for reasoning and flow-matching audio foundation model. Apply for professional audio design workflows or video-to-audio applications.

adu2021 1089c06 17.7 KB Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/thinksound-audio-generation-reasoning commit 1089c06568

Frequently asked questions

npx skillmds@latest add adu2021/thinksound-audio-generation-reasoning