Evaluation Methodology

Methods for evaluating AI model outputs - exact match, semantic similarity, LLM-as-judge, comparative evaluation, ELO ranking. Use when measuring AI quality, building eval pipelines, or comparing models. Use when this capability is needed.

tomevault-io 69bdcde 2 files · 3.2 KB Updated

File contents

tomevault-io/skills-registry/tree/main/doanchienthangdev--omgkit--evaluation-methodology commit 69bdcded7f

Frequently asked questions

npx skillmds@latest add tomevault-io/evaluation-methodology