LLM Eval

LLM evaluation: build evaluation datasets, choose metrics (RAGAS, G-Eval, LLM-as-judge), run automated evals, monitor production quality, and detect regressions

UitbreidenOS Updated

File contents

UitbreidenOS/UitKit/tree/main/plugins/uitkit-ai-engineering/skills/llm-eval commit b46f5eb227

Frequently asked questions

npx skillmds@latest add uitbreidenos/llm-eval