Slime

slime: LLM Post-Training Framework for RL Scaling

ComeOnOliver Updated 61 repo stars

File contents

ComeOnOliver/skillshub/tree/main/skills/Orchestra-Research/AI-Research-SKILLs/slime commit 2a277c777e

Frequently asked questions

npx skillmds@latest add comeonoliver/slime