Verl Hybrid Engine Reinforcement Learning

Reinforcement learning framework (PPO, GRPO) for post-training large language models.

robertoatila Updated

File contents

robertoatila/jarvis-skill-registry/tree/main/skills/verl-hybrid-engine-reinforcement-learning commit b53c04ab3e

Frequently asked questions

npx skillmds@latest add robertoatila/verl-hybrid-engine-reinforcement-learning