Build Eval Dataset

Use this to build a good evaluation dataset for an LLM app, the part everyone underestimates. Trigger on "make an eval set", "what should I test my LLM on", "I don't have test data for my prompt", "build a golden dataset", or before setting up evals. A great eval set beats a great metric; garbage-in means your evals lie to you.

ContextJet-ai f196851 3.5 KB Updated

File contents

ContextJet-ai/awesome-llm-observability/tree/main/skills/build-eval-dataset commit f196851b01

Frequently asked questions

npx skillmds@latest add contextjet-ai/build-eval-dataset