Trl Training

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.

Hugging Face Updated 10.8k repo stars

File contents

huggingface/skills/tree/main/skills/trl-training commit a89ae0d1da

Frequently asked questions

npx skillmds@latest add huggingface/trl-training-2