Reward Hackability Auditor

Audit reinforcement learning (RL) environment verifiers, reward functions, and grading rubrics for reward-hacking vulnerabilities before training or publishing. Use when inspecting, designing, testing, or hardening RL environments in OpenEnv, Prime Intellect verifiers-spec, or Gymnasium formats.

FreakyAdy Updated

File contents

FreakyAdy/Reward-Hackability-Auditor--CLI---Claude-Skill-/tree/main/ commit 04afe50d88

Frequently asked questions

npx skillmds@latest add freakyady/reward-hackability-auditor