Inference Optimizer

Launches and monitors Hyperloom's multi-agent inference optimizer for LLM serving on AMD GPUs. Use when the user asks to optimize an inference model, run Magpie benchmarks/profiles, resume an inference_optimizer session, tune SGLang/vLLM serving parameters, run TraceLens/kernel-agent, or validate end-to-end throughput gains in a new inference environment.

AMD-AGI 971fa24 588 files · 9.2 MB Updated

File contents

AMD-AGI/Hyperloom/tree/main/src/hyperloom/inference_optimizer commit 971fa24f97

Frequently asked questions

npx skillmds@latest add amd-agi/inference-optimizer