Sage Rl Agent

Enable agents to continuously improve by accumulating reusable skills across sequential task chains. Train via GRPO across task sequences where skills persist and compound, provide dual rewards for both task completion and skill generation/reuse—improving completion rates 8.9% while reducing token costs by 59% compared to non-skill baselines.

adu2021 8bb8421 5.4 KB Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/sage-rl-agent commit 8bb84214d9

Frequently asked questions

npx skillmds@latest add adu2021/sage-rl-agent