Miles Rl Training

Provides guidance for enterprise-grade RL training using miles, a production-ready fork of slime. Use when training large MoE models with FP8/INT4, needing train-inference alignment, or requiring speculative RL for maximum throughput.

synthetic-sciences c038c80 3 files · 18.6 KB Updated

File contents

synthetic-sciences/openscience/tree/main/backend/cli/skills/ml-inference/miles commit c038c800fd

Frequently asked questions

npx skillmds@latest add synthetic-sciences/miles-rl-training