Agent Eval

在自定义任务上对编码智能体(Claude Code、Aider、Codex 等)进行头对头比较,包含通过率、成本、时间和一致性指标 Use when this capability is needed.

tomevault-io Updated

File contents

tomevault-io/skills-registry/tree/main/aaione--everything-claude-code-zh--agent-eval commit c02fd01eb9

Frequently asked questions

npx skillmds@latest add tomevault-io/agent-eval-17