Rank LLM Eval

Use when analyzing rank_llm evaluation outputs across runs or models. Covers aggregated trec_eval JSONL files, response-analysis metrics, retrieval-cache handoff files, and side-by-side comparison of stored evaluation artifacts.

castorini 239d9f8 3 files · 6.4 KB Updated

File contents

castorini/rank_llm/tree/main/.claude/skills/rank-llm-eval commit 239d9f8eaf

Frequently asked questions

npx skillmds@latest add castorini/rank-llm-eval