Hqq Quantization

Half-Quadratic Quantization for LLMs without calibration data. Use when quantizing models to 4/3/2-bit precision without needing calibration datasets, for fast quantization workflows, or when deploying with vLLM or HuggingFace Transformers.

synthetic-sciences 23d6fe8 3 files · 35.6 KB Updated

File contents

synthetic-sciences/openscience/tree/main/backend/cli/skills/ml-training/hqq commit 23d6fe8b60

Frequently asked questions

npx skillmds@latest add synthetic-sciences/hqq-quantization