Traigent Eval Audit

Audit evaluator reliability before trusting Traigent optimization decisions. Use when users ask: is my LLM judge reliable, audit my evaluator, judge agreement, evaluator calibration, calibrate thresholds, parse-failure policy, repeated-judge stability, bias probes, or when optimization results depend on an LLM-as-judge metric.

Traigent 2a539cb 3 files · 42.4 KB Updated

File contents

Traigent/traigent-skills/tree/main/skills/traigent-eval-audit commit 2a539cb1ac

Frequently asked questions

npx skillmds@latest add traigent/traigent-eval-audit