AI Ml Model Optimization Guide

Optimisation de modèles ML pour l'inférence (quantization, pruning, distillation, ONNX) — guide opérationnel avec snippets copiables, critères de choix et anti-patterns. Se déclenche avec \"quantization\", \"pruning\", \"distillation\", \"ONNX\", \"optimiser un modèle\", \"inférence rapide\". Se déclenche avec "quantization", "pruning", "distillation", "ONNX", "optimiser un modèle", "inférence rapide". Also triggers on "optimize inference", "quantize a model", "faster model serving".

khalilbenaz Updated

File contents

khalilbenaz/claude-skills-collection/tree/main/skills/ai-ml-model-optimization-guide commit 1bd7ea4a98

Frequently asked questions

npx skillmds@latest add khalilbenaz/ai-ml-model-optimization-guide