Advanced Evaluation

This skill should be used when the user asks to "implement LLM-as-judge", "compare model outputs", "create evaluation rubrics", "mitigate evaluation bias", or mentions direct scoring, pairwise comparison, position bias, evaluation pipelines, or automated quality assessment.

luokai0 Updated 10 repo stars

File contents

luokai0/ai-agent-skills-by-luo-kai/tree/main/ai-agent-skills/18-ai-agents-and-automation (by Luo Kai)/03-context-engineering/ctx-advanced-evaluation commit 595021f09c

Frequently asked questions

npx skillmds@latest add luokai0/advanced-evaluation-2