← all publishers

hagestedt

@hagestedt source repo

2 published skills

  1. Model Effort Benchmark · hagestedt
    Use when measuring cost vs quality by re-running a frozen past-work pack across models and effort/thinking levels on any LLM provider. Provider-agnostic harness; no vendor CLI required.
    0 installs
  2. Claude Model Effort Benchmark · hagestedt
    Use when benchmarking model×effort on Anthropic Claude Platform/Claude Code and you want /claude-api prompt-audit, cost-optimize, and hillclimb on top of the generic frozen-pack harness.
    0 installs