Trl Training

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.

waybarrios 191752c 8.6 KB Updated

File contents

waybarrios/opencode-power-pack/tree/main/skills/trl-training commit 191752cc8a

Frequently asked questions

npx skillmds add waybarrios/trl-training