Hqq Quantization

Half-Quadratic Quantization for LLMs without calibration data. Use when quantizing models to 4/3/2-bit precision without needing calibration datasets, for fast quantization workflows, or when deploying with vLLM or HuggingFace Transformers. Use when this capability is needed.

tomevault-io 7e0021b 2 files · 11.9 KB Updated

File contents

tomevault-io/skills-registry/tree/main/davila7--claude-code-templates--optimization-hqq commit 7e0021b840

Frequently asked questions

npx skillmds@latest add tomevault-io/hqq-quantization