Evaluating Llms Harness

lm-eval-harness: benchmark LLMs (MMLU, GSM8K, etc.).

nativ3ai ab0325b 5 files · 56.8 KB Updated

File contents

nativ3ai/hermes-agent-camel/tree/main/skills/mlops/evaluation/lm-evaluation-harness commit ab0325bd4f

Frequently asked questions

npx skillmds@latest add nativ3ai/evaluating-llms-harness