Agent Evals And Prompt Governance

Design, implement, review, and operate evaluations and release governance for production AI agents and prompts. Use for golden datasets, regression tests, prompt/model/tool versioning, structured-output validation, retrieval grounding, tool-call correctness, memory quality, routing and fallback evaluation, cost/latency budgets, canary releases, rollback gates, and comparing agent versions with reproducible evidence.

xhalilbey Updated

File contents

xhalilbey/cursor-skills/tree/main/agent-evals-and-prompt-governance commit f2670bf5bb

Frequently asked questions

npx skillmds@latest add xhalilbey/agent-evals-and-prompt-governance