Hugging Face Model Trainer

Train/fine-tune LLMs using TRL on Hugging Face Jobs infrastructure. Covers SFT, DPO, GRPO, reward modeling, GGUF conversion, dataset validation, hardware selection, cost estimation, Trackio monitoring, and model persistence. Invoke for cloud GPU training or GGUF conversion.

lidge-jun c3b2628 19 files · 141.9 KB Updated

File contents

lidge-jun/cli-jaw-skills/tree/main/hugging-face-model-trainer commit c3b2628c39

Frequently asked questions

npx skillmds@latest add lidge-jun/hugging-face-model-trainer