Output Eval Validate Judge

Validate LLM judges against human labels using TPR/TNR metrics and train/dev/test splits. Use after writing a judge prompt to verify it agrees with human judgment.

growthxai Updated

File contents

growthxai/output/tree/main/coding_assistants/claude/plugins/outputai/skills/output-eval-validate-judge commit 86b53689ec

Frequently asked questions

npx skillmds@latest add growthxai/output-eval-validate-judge