Aria Intention Reward

Reduce policy gradient variance in language agent training by aggregating rewards in semantic intention space, enabling 9.95% average performance gains across downstream tasks without exponential action space explosion.

adu2021 3142c63 6.0 KB Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/aria-intention-reward commit 3142c632d5

Frequently asked questions

npx skillmds@latest add adu2021/aria-intention-reward