LLM Cost Optimizer

Use when you need to reduce LLM API spend, control token usage, route between models by cost/quality, implement prompt caching, or build cost observability for AI features. Triggers: 'my AI costs are too high', 'optimize token usage', 'which model should I use', 'LLM spend is out of control', 'implement prompt caching'. NOT for RAG pipeline design (use rag-architect). NOT for prompt writing quality (use senior-prompt-engineer).

futurediffusion 344f7a0 2 files · 10.4 KB Updated

File contents

futurediffusion/claudebot/tree/main/skills/.codex/skills/llm-cost-optimizer commit 344f7a01d9

Frequently asked questions

npx skillmds@latest add futurediffusion/llm-cost-optimizer