Eval

Evaluate and rank agent results by metric or LLM judge for an AgentHub session.

Alireza Rezvani 2fb75e1 2.3 KB Updated 20.4k repo stars

File contents

alirezarezvani/claude-skills/tree/main/engineering/agenthub/skills/eval commit 2fb75e1af3

Frequently asked questions

npx skillmds@latest add alirezarezvani/eval