Turboquant Pytorch

PyTorch implementation of TurboQuant for LLM KV cache compression using two-stage vector quantization (random rotation + Lloyd-Max + QJL residual correction).

om-scogo db8c41c 4 files · 40.6 KB Updated 0 repo stars

File contents

om-scogo/skillsh-scraper/tree/main/data/skills/aradotso-trending-skills/turboquant-pytorch commit db8c41c0df

Frequently asked questions

npx skillmds add om-scogo/turboquant-pytorch