Bounded Evaluation

Design small evaluation gates for agent outputs, skill changes, prompts, and tool contracts. Use when a change needs rubric checks, pairwise comparison, position-bias mitigation, regression fixtures, or LLM-as-judge discipline without building a heavy eval platform.

markoblogo e860ec7 3 files · 4.0 KB Updated

File contents

markoblogo/abvx-agent-skills/tree/main/skills/bounded-evaluation commit e860ec7b8b

Frequently asked questions

npx skillmds@latest add markoblogo/bounded-evaluation