D Core Task Decomposition

Mitigate lazy reasoning in Large Reasoning Models via self-distillation teaching task decomposition, followed by Diversity-Aware GRPO with entropy-based advantage functions, enabling effective decomposition without external teachers while balancing structured reasoning with diversity.

adu2021 5980f9f 11.3 KB Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/d-core-task-decomposition commit 5980f9f6be

Frequently asked questions

npx skillmds@latest add adu2021/d-core-task-decomposition