Openclaw Eval Harness Shared

Use when evaluating the quality, accuracy, or safety of a legal AI skill against a standardized benchmark. The shared eval harness provides community-maintained datasets (NDA, employment, real estate, research), rubrics for legal soundness and hallucination detection, multi-judge scoring to reduce bias, and a public leaderboard for comparing skill quality across providers and versions.

sboghossian Updated

File contents

sboghossian/mini-claude-for-legal/tree/main/skills/openclaw/openclaw-eval-harness-shared commit 3646cd1092

Frequently asked questions

npx skillmds@latest add sboghossian-mini-claude-for-legal/openclaw-eval-harness-shared