Eval Agents

Score a review agent (Rex/Hakim/Tariq) against a labeled PR corpus — ground-truth defect-set overlap, never a prose rubric. Headline metric is approve-precision.

me2resh f3b06a5 5 files · 44.6 KB Updated

File contents

me2resh/apexyard/tree/main/.claude/skills/eval-agents commit f3b06a56a3

Frequently asked questions

npx skillmds@latest add me2resh/eval-agents