Advanced Evaluation

This skill should be used when the user asks to "implement LLM-as-judge", "compare model outputs", "create evaluation rubrics", "mitigate evaluation bias", or mentions direct scoring, pairwise comparison, position bias, evaluation pipelines, or automated quality assessment.

newmindsgroup 6fe2487 17.4 KB Updated

File contents

newmindsgroup/ai-agent-skills-library/tree/main/sources/sickn33-antigravity-awesome-skills/skills/advanced-evaluation commit 6fe2487e56

Frequently asked questions

npx skillmds@latest add newmindsgroup/advanced-evaluation