Model Quantization

Expert skill for AI model quantization and optimization. Covers 4-bit/8-bit quantization, GGUF conversion, memory optimization, and quality-performance tradeoffs for deploying LLMs in resource-constrained JARVIS environments.

martinholovsky e23dffa 3 files · 26.1 KB Updated

File contents

martinholovsky/claude-skills-generator/tree/main/skills/model-quantization commit e23dffabc0

Frequently asked questions

npx skillmds@latest add martinholovsky/model-quantization