cleanrl:基于深度学习的强化学习算法实现项目

High-quality single file implementation of Deep Reinforcement Learning algorithms with research-friendly features (PPO, DQN, C51, DDPG, TD3, SAC, PPG)

分支126Tags19

项目介绍

高品质的单文件实现深度强化学习算法,具备研究友好的特性(PPO、DQN、C51、DDPG、TD3、SAC、PPG)。【此简介由AI生成】

定制我的领域
4710.14 K1.14 K访问 GitHub