Stable Baselines3

Use this skill for reinforcement learning tasks including training RL agents (PPO, SAC, DQN, TD3, DDPG, A2C, etc.), creating custom Gym environments, implementing callbacks for monitoring and control, using vectorized environments for parallel training, and integrating with deep RL workflows. This skill should be used when users request RL algorithm implementation, agent training, environment design, or RL experimentation.

tomevault-io 2be4564 2 files · 10.1 KB Updated

File contents

tomevault-io/skills-registry/tree/main/davila7--claude-code-templates--stable-baselines3 commit 2be4564046

Frequently asked questions

npx skillmds@latest add tomevault-io/stable-baselines3