Bare Eval

Run isolated eval and grading calls using CC 2.1.81 --bare mode. Constructs claude -p --bare invocations for skill evaluation, trigger testing, and LLM grading without plugin/hook interference. Use when running eval pipelines, grading skill outputs, benchmarking prompt quality, or testing trigger accuracy in isolation.

yonatangross 5c22eaa 10 files · 27.7 KB Updated

File contents

yonatangross/orchestkit/tree/main/src/skills/bare-eval commit 5c22eaa27b

Frequently asked questions

npx skillmds add yonatangross/bare-eval