Diffusion Perf Opt

Diagnose and optimize vLLM Omni diffusion workloads, especially Wan/Qwen/Flux-style image and video generation. Use when Codex is asked to analyze profiling traces, choose parallel strategies, inspect torch profiler trace.json or trace.json.gz timelines, estimate optimization ROI, investigate GPU idle/free bubbles, compare USP/CFG/HSDP/VAE parallelism, or design operator/host/quantization optimizations for vLLM Omni.

vllm-project 0d1b714 4 files · 38.7 KB Updated

File contents

vllm-project/vllm-omni/tree/main/.claude/skills/diffusion-perf-opt commit 0d1b714fde

Frequently asked questions

npx skillmds add vllm-project-vllm-omni/diffusion-perf-opt