Nemo Customizer

Fine-tune models on NeMo Platform with `automodel`, `unsloth`, or `rl` (all `submit`-only): HF dataset conversion, filesets, model entities, and job JSON (hyperparameters, batch, schedule, optimizer) + job polling. `automodel`/`unsloth` run SFT/LoRA as Docker GPU jobs; `rl` runs DPO (preference) or GRPO (NeMo Gym environment + reward) on a Ray cluster (Kubernetes). Covers building and converting NeMo Gym environment packages (native-v1, wheels-v1, adapter-wheels-v1) and Gym rollout-row datasets. Use for train, fine-tune, customize, SFT, LoRA, DPO, GRPO, RLHF, reinforcement learning, reward environment, NeMo Gym, verifiers, Prime Intellect, preference optimization, learning rate, epochs, or nemo customization.

NVIDIA NeMo c5bc988 17 files · 273.3 KB Updated

File contents

nvidia-nemo/nemo-platform/tree/main/plugins/nemo-customizer/src/nemo_customizer/skills/nemo-customizer commit c5bc988e69

Frequently asked questions

npx skillmds@latest add nvidia-nemo/nemo-customizer