Agent Health

Evaluate, benchmark, and improve an AI agent with the Agent Health CLI and server APIs. Use when the user wants to run evaluations/benchmarks, interpret judge results (matcherResults / improvementStrategies), diagnose eval-vs-reality gaps, or raise an agent's pass rate. Mirror of docs/skills/AGENT_HEALTH.md.

opensearch-project Updated

File contents

opensearch-project/agent-health/tree/main/.claude/skills/agent-health commit ae481bb763

Frequently asked questions

npx skillmds@latest add opensearch-project/agent-health