Dr Mas

Enable stable multi-agent reinforcement learning by normalizing advantages per-agent rather than globally, preventing gradient-norm inflation in heterogeneous multi-agent systems.

adu2021 b70b317 10.0 KB Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/dr-mas commit b70b3170b5

Frequently asked questions

npx skillmds@latest add adu2021/dr-mas