LLM Eval Router

Shadow-test local Ollama models against a cloud baseline with a multi-judge ensemble. Automatically promotes models when statistically proven equivalent — reducing API costs with evidence, not hope.

dvcrn Updated 32 repo stars

File contents

dvcrn/openclaw-skills-marketplace/tree/main/plugins/nissan--llm-eval-router/skills/llm-eval-router commit 331866d917

Frequently asked questions

npx skillmds@latest add dvcrn/llm-eval-router