Speculative Decoding Acceleration

Accelerates LLM inference throughput using speculative decoding and Medusa multi-head draft prediction.

robertoatila Updated

File contents

robertoatila/jarvis-skill-registry/tree/main/skills/speculative-decoding-acceleration commit 1ce685cf4a

Frequently asked questions

npx skillmds@latest add robertoatila/speculative-decoding-acceleration