Trl Training

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands. Use when this capability is needed.

tomevault-io Updated

File contents

tomevault-io/skills-registry/tree/main/huggingface--trl--trl-training commit a566cd4351

Frequently asked questions

npx skillmds@latest add tomevault-io/trl-training-2