hagestedt
- 2 skills
- 0 followers
- 16 hours ago last updated
- ▌ Model Effort Benchmark · hagestedtUse when measuring cost vs quality by re-running a frozen past-work pack across models and effort/thinking levels on any LLM provider. Provider-agnostic harness; no vendor CLI required.
- ▌ Claude Model Effort Benchmark · hagestedtUse when benchmarking model×effort on Anthropic Claude Platform/Claude Code and you want /claude-api prompt-audit, cost-optimize, and hillclimb on top of the generic frozen-pack harness.