Parallel R1 Parallel Thinking Rl

Train language models to explore multiple reasoning paths simultaneously via reinforcement learning. Uses progressive curriculum learning to address cold-start problems, enabling 8.4% accuracy gains over sequential reasoning on complex mathematical tasks.

adu2021 318ba7f 17.9 KB Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/parallel-r1-parallel-thinking-rl commit 318ba7f78a

Frequently asked questions

npx skillmds@latest add adu2021/parallel-r1-parallel-thinking-rl