Agentv Eval Analyzer

Analyze evaluation results for quality improvements — identify LLM-judge evaluators replaceable with deterministic assertions, flag weak/vague assertions, and surface cost/quality opportunities. Use after running evals to improve your evaluation config.

majiayu000 efd0cfa 2 files · 5.2 KB Updated 567 repo stars

File contents

majiayu000/claude-skill-registry-data/tree/main/analysis/agentv-eval-analyzer commit efd0cfa38b

Frequently asked questions

npx skillmds add majiayu000/agentv-eval-analyzer