Trl Training

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning) with support for SFT, DPO, GRPO, KTO, RLOO, and reward model training via CLI commands.

Hugging Face Updated 10.8k repo stars

File contents

huggingface/skills/tree/main/skills/trl-training commit 79512173c9

Frequently asked questions

npx skillmds@latest add huggingface/trl-training