Agentic Eval

Design evaluator-optimizer, reflection, rubric, LLM-as-judge, and test-driven refinement loops for AI agent outputs. Use when implementing self-critique, iterative improvement, quality gates, agent response evaluation, code refinement, or rubric-based scoring for generated code, reports, or analysis.

paulasilvatech 0dae951 6.8 KB Updated

File contents

paulasilvatech/awesome-harness-primitives/tree/main/harness/claude-code/plugins/azure-ai-foundry/skills/agentic-eval commit 0dae9511f7

Frequently asked questions

npx skillmds@latest add paulasilvatech/agentic-eval-3