Co Scientist Reinforcement Learning

Reinforcement learning skill. Policy gradient methods, Q-learning, actor-critic architectures, environment design, reward shaping, and RL experiment management. Use when working with policy gradient methods, q-learning, actor-critic architectures.

nahisaho Updated

File contents

nahisaho/coreclaw-marketplace/tree/main/coreclaw-skills-hub/skills/co-scientist/skills/co-scientist-reinforcement-learning commit b26e19c708

Frequently asked questions

npx skillmds@latest add nahisaho/co-scientist-reinforcement-learning