Bitsandbytes 8bit Nf4 Quantization

Quantizes LLMs to 8-bit or 4-bit NormalFloat for memory-efficient GPU inference.

robertoatila Updated

File contents

robertoatila/jarvis-skill-registry/tree/main/skills/bitsandbytes-8bit-nf4-quantization commit fd1bcd270e

Frequently asked questions

npx skillmds@latest add robertoatila/bitsandbytes-8bit-nf4-quantization