AI Evals

Designs trustworthy LLM/agent evals and optimization loops. Use when building graders, calibrating judges, choosing eval/fine-tune methods, thresholds, or fixing noisy scores.

majiayu000 5251d45 2 files · 18.0 KB Updated 567 repo stars

File contents

majiayu000/claude-skill-registry-data/tree/main/ai-llm/ai-evals-vasilyu1983-ai-agents-public commit 5251d45b02

Frequently asked questions

npx skillmds add majiayu000/ai-evals