Pufferlib

Essa habilidade deve ser usada ao trabalhar com tarefas de reinforcement learning, incluindo treinamento RL de alto desempenho, desenvolvimento de ambientes customizados, simulação paralela vetorizada, sistemas multi-agent ou integração com ambientes RL existentes (Gymnasium, PettingZoo, Atari, Procgen, etc.). Use essa habilidade para implementar treinamento PPO, criar ambientes PufferEnv, otimizar desempenho em RL ou desenvolver políticas com CNNs/LSTMs.

artubss Updated 10 repo stars

File contents

artubss/SKILLS-CLAUDE-CODE/tree/main/skills/skills/scientific/pufferlib commit e5c66905dc

Frequently asked questions

npx skillmds@latest add artubss/pufferlib