Hybrid Benchmarking

Benchmark a hybrid-attention model across the LMCache performance ladder (vLLM no-hybrid-allocator → hybrid allocator + prefix caching → hybrid allocator + LMCache) and produce a decode-throughput / TTFT / cache-hit-rate comparison. Use when asked to benchmark, demo, or quantify the value of LMCache caching for a hybrid model.

lmcache c324a5c 11.6 KB Updated

File contents

lmcache/lmcache/tree/main/.claude/skills/hybrid-benchmarking commit c324a5ced7

Frequently asked questions

npx skillmds@latest add lmcache/hybrid-benchmarking