Agentic Eval

Design evaluator-optimizer, reflection, rubric, LLM-as-judge, and test-driven refinement loops for AI agent outputs. Use when implementing self-critique, iterative improvement, quality gates, agent response evaluation, code refinement, or rubric-based scoring for generated code, reports, or analysis.

paulasilvatech 1b2d016 6.6 KB Updated

File contents

paulasilvatech/awesome-harness-primitives/tree/main/harness/github-copilot/skills/agentic-eval commit 1b2d01653d

Frequently asked questions

npx skillmds@latest add paulasilvatech/agentic-eval-2