RAG Evaluator

Use when designing, building, or operating RAG evaluation — golden sets, retrieval metrics (Recall@K, NDCG, MRR), answer metrics (faithfulness, citation accuracy), LLM-as-judge setup, CI gates for RAG, eval at scale, drift detection. Triggers on phrases like "evaluate RAG", "golden set", "RAG metrics", "RAGAS", "faithfulness evaluation", "regression test RAG", "RAG CI".

kumaran-is e28cee3 10.4 KB Updated

File contents

kumaran-is/claude-code-onboarding/tree/main/.claude/skills/rag-evaluator commit e28cee3eb5

Frequently asked questions

npx skillmds@latest add kumaran-is/rag-evaluator