Awq Quantization

Quantize large language models to 4-bit precision using activation-aware weight quantization, reducing memory footprint and speeding up inference with minimal accuracy loss.

majiayu000 Updated 567 repo stars

File contents

majiayu000/claude-skill-registry/tree/main/skills/ai-ml/awq commit f3b5b8049a

Frequently asked questions

npx skillmds@latest add majiayu000/awq-quantization