LLM Caching Patterns

Multi-level caching strategies for LLM applications - semantic caching (Redis), prompt caching (Claude/OpenAI native), cache hierarchies, cost optimization, and Langfuse cost tracking with hierarchical trace rollup for 70-95% cost reduction Use when this capability is needed.

tomevault-io add9a28 2 files · 32.6 KB Updated

File contents

tomevault-io/skills-registry/tree/main/yonatangross--create-yg-app--llm-caching-patterns commit add9a286cc

Frequently asked questions

npx skillmds@latest add tomevault-io/llm-caching-patterns