Search Quality Evaluation

Evaluate the quality of a search or information-retrieval system: choose the right ranking metrics, build a relevance-judgment (qrels) set, and turn the scores into ship / no-ship decisions. Use when measuring search, retrieval, or RAG-retrieval quality; comparing retrieval variants (embeddings, rerankers, filters, chunking); choosing between Precision@K, Recall@K, MRR, MAP, and NDCG; building a golden / labeled query set; or diagnosing why offline scores and online behavior disagree. Trigger on "evaluate search quality", "which IR metric", "measure retrieval relevance", "build qrels / a golden set", "NDCG / MRR / MAP", "is my RAG retrieval good", or any review of a search-evaluation harness.

jordangaston Updated

File contents

jordangaston/claude-plugins/tree/main/plugins/powertools/skills/search-quality-evaluation commit 544a2be880

Frequently asked questions

npx skillmds@latest add jordangaston/search-quality-evaluation