Agent Evaluation

LLM-as-judge evaluation framework with 5-dimension rubric (accuracy, groundedness, coherence, completeness, helpfulness) for scoring AI-generated content quality with weighted composite scores and evidence citations

oimiragieo Updated 0 repo stars

File contents

oimiragieo/agent-studio/tree/main/.claude/skills/agent-evaluation commit 8e0fb5aa48

Frequently asked questions

npx skillmds@latest add oimiragieo/agent-evaluation