Evals Router

Use when evaluating LLM or RAG outputs: audit eval coverage, analyze failed traces, write binary judge prompts, validate judges against labels, generate targeted synthetic cases, evaluate retrieval quality, or plan review tooling. Do not use for ordinary software test implementation.

jscraik Updated

File contents

jscraik/Agent-Skills/tree/main/Skills/agent-ops/evals-router commit 7eeb6f118e

Frequently asked questions

npx skillmds@latest add jscraik/evals-router