LLM Evaluation

Use when measuring AI output quality - eval frameworks, golden datasets, regression testing, benchmarking, human-in-the-loop evaluation

kienbui1995 8b456cd 6.0 KB Updated

File contents

kienbui1995/magic-powers/tree/main/skills/llm-evaluation commit 8b456cd7d4

Frequently asked questions

npx skillmds@latest add kienbui1995/llm-evaluation