AI Eval Scorer

Take an AI feature spec and produce a full eval harness - extracted behaviors, golden + edge + adversarial test cases, a judge rubric, and a scorecard. Use before shipping any LLM-powered feature, when "it works on my examples" isn't enough, or when stakeholders ask "how do you know it's good". Triggers on phrases like "build evals for this feature", "score this AI feature", "test cases for LLM feature", "eval rubric", "AI quality scorecard", "оцени AI-фичу", "сделай эвалы".

euroconic Updated

File contents

euroconic/pm-claude-skills/tree/main/SKILLS/ai-eval-scorer commit cb2bb4006e

Frequently asked questions

npx skillmds@latest add euroconic/ai-eval-scorer