Simplevla Rl Scaling Vla Training

Apply reinforcement learning to Vision-Language-Action models for robotic control, achieving 99% LIBERO task success and discovering novel manipulation strategies (pushcut) without task-specific reward engineering. Scales efficiently via parallelized trajectory sampling and outcome-based rewards.

adu2021 Updated

File contents

adu2021/skillxiv/tree/main/skills/skillxiv-v0.0.2-claude-opus-4.6/simplevla-rl-scaling-vla-training commit fc9e3b8c13

Frequently asked questions

npx skillmds@latest add adu2021/simplevla-rl-scaling-vla-training