Model Pruning

Compress large language models by 40-60% with minimal accuracy loss using one-shot pruning techniques like Wanda and SparseGPT, enabling faster inference and deployment on constrained hardware.

Orchestra Research Updated 10.4k repo stars

File contents

Orchestra-Research/AI-Research-SKILLs/tree/main/19-emerging-techniques/model-pruning commit 773a52944b

Frequently asked questions

npx skillmds@latest add orchestra-research/model-pruning