Advanced Evaluation

ALWAYS use this when the request matches Advanced Evaluation: This skill should be used when the user asks to "implement LLM-as-judge", "compare model outputs", "create evaluation rubrics", "mitigate evaluation bias", or mentions direct scoring, pairwise comparison, position bias, evaluation pipelines, or automated quality assessment.

anhvu1107 6d89c78 6 files · 22.0 KB Updated

File contents

anhvu1107/all-agent-skill/tree/main/.agent/skills/advanced-evaluation commit 6d89c7825c

Frequently asked questions

npx skillmds@latest add anhvu1107/advanced-evaluation