Model Evaluation

Generates python code that evaluates SageMaker models. Supports two evaluation types: LLM-as-Judge and Custom Scorer. Use when the user says "evaluate my model", "run a benchmark", "test model performance", "how did my model perform", "compare models", or other similar requests.

gabrielmoreira Updated 17 repo stars

File contents

gabrielmoreira/agent-skills-mirror/tree/main/mirrors/repos/awslabs@agent-plugins/plugins/sagemaker-ai/skills/model-evaluation commit c1f7c723d3

Frequently asked questions

npx skillmds@latest add gabrielmoreira/model-evaluation