Model Evaluation

This skill focuses on comprehensive evaluation of machine learning models across the entire ML lifecycle. It covers metric selection, validation strategies, fairness assessment, training debugging, hyperparameter tuning, LLM evaluation, A/B testing, and production monitoring for ensuring model quality and reliability.

majiayu000 Updated 567 repo stars

File contents

majiayu000/claude-skill-registry-data/tree/main/ai-ml/model-evaluation commit 97b89fa1b0

Frequently asked questions

npx skillmds@latest add majiayu000/model-evaluation-3