Trl Training

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.

lingxling Updated 253 repo stars

File contents

lingxling/awesome-skills-cn/tree/main/antigravity-awesome-skills/skills/trl-training commit 0f5375b820

Frequently asked questions

npx skillmds@latest add lingxling/trl-training