Prompt Eval

Self-improvement framework for Claude Code prompts. Pass a profile name to evaluate variations of that target prompt via a 3-level cascade (stability via embeddings, decision-consistency via parsing, and pairwise quality via a judge bracket). The skill itself is the team lead — it dispatches all runner teammates directly at the top level (no nested teams), so every parallel agent is visible in the Claude Code Agent Teams tmux split. Use when this capability is needed.

tomevault-io edf5163 2 files · 22.8 KB Updated

File contents

tomevault-io/skills-registry/tree/main/bfernandez31--prompt-eval--prompt-eval commit edf51631ce

Frequently asked questions

npx skillmds@latest add tomevault-io/prompt-eval