AI Eval Plan

Design an evaluation plan for an LLM or AI feature before shipping it. Use when asked how to evaluate a prompt/model/agent, set up an eval harness, define quality metrics for an AI feature, or build a regression gate. Produces an eval plan — task definition, datasets, metrics & rubrics, baselines, automated + human evals, a pass bar, and a regression gate.

gabrielmoreira Updated 17 repo stars

File contents

gabrielmoreira/agent-skills-mirror/tree/main/mirrors/repos/mohitagw15856@pm-claude-skills/exports/openclaw/ai-eval-plan commit 725c2469f7

Frequently asked questions

npx skillmds@latest add gabrielmoreira/ai-eval-plan