Model Optimization Guide

Optimisation de modèles ML pour l'inférence (quantization, pruning, distillation, ONNX) — guide opérationnel avec snippets copiables, critères de choix et anti-patterns. Se déclenche avec \"quantization\", \"pruning\", \"distillation\", \"ONNX\", \"optimiser un modèle\", \"inférence rapide\". Se déclenche avec "quantization", "pruning", "distillation", "ONNX", "optimiser un modèle", "inférence rapide". Also triggers on "optimize inference", "quantize a model", "faster model serving".

khalilbenaz Updated

File contents

khalilbenaz/claude-skills-collection/tree/main/ai-ml-skills/model-optimization-guide commit 8b20d03996

Frequently asked questions

npx skillmds@latest add khalilbenaz/model-optimization-guide