LLM Evaluation

LLM evaluation and testing patterns including prompt testing, hallucination detection, benchmark creation, and quality metrics. Use when testing LLM applications, validating prompt quality, implementing systematic evaluation, or measuring LLM performance. Use when this capability is needed.

tomevault-io Updated

File contents

tomevault-io/skills-registry/tree/main/applied-artificial-intelligence--claude-code-toolkit--llm-evaluation commit cca948532a

Frequently asked questions

npx skillmds@latest add tomevault-io/llm-evaluation-5