Hqq Fast Kernel Weight Quantization

Half-Quadratic Quantization for fast 2/3/4-bit LLM compression without calibration data.

robertoatila Updated

File contents

robertoatila/jarvis-skill-registry/tree/main/skills/hqq-fast-kernel-weight-quantization commit 3fa01aed3d

Frequently asked questions

npx skillmds@latest add robertoatila/hqq-fast-kernel-weight-quantization