Hqq Quantization

Quantize large language models to 8/4/3/2/1-bit precision without calibration data, using multiple optimized backends and integrations with HuggingFace Transformers, vLLM, and PEFT/LoRA.

majiayu000 Updated 567 repo stars

File contents

majiayu000/claude-skill-registry/tree/main/skills/ai-ml/hqq commit 4a73b9b1a5

Frequently asked questions

npx skillmds@latest add majiayu000/hqq-quantization