Agentic Eval

Patterns and techniques for evaluating and improving AI agent outputs. Use this skill when implementing self-critique and reflection loops, building evaluator-optimizer pipelines for quality-critical generation, creating test-driven code refinement workflows, designing rubric-based or LLM-as-judge evaluation systems, adding iterative improvement to agent outputs (code, reports, analysis), or measuring and improving agent response quality.

majiayu000 6b1f3fc 2 files · 6.7 KB Updated 567 repo stars

File contents

majiayu000/claude-skill-registry-data/tree/main/ai-llm/agentic-eval-haseeb243-detrust commit 6b1f3fc34d

Frequently asked questions

npx skillmds add majiayu000/agentic-eval