C
cleanrl
vwxyzjn/cleanrl
高质量单文件实现的深度强化学习算法,具有研究友好特性(PPO、DQN、C51、DDPG、TD3、SAC、PPG)
★10.2kstars
Python
NOASSERTION
更新: 今天
📋 项目速览
点击展开
这是什么?开源学习与资源项目,用Python构建、核心能力在a2c/actor-critic
作者是谁?由 vwxyzjn 团队维护,GitHub 10.2K⭐,在 学习与资源 分类 3640 个项目中排名第 255
为什么诞生?学习与资源领域快速发展,a2c场景缺乏高效方案,cleanrl应运而生,专注于简化actor-critic相关工作流程。
能干什么?核心场景:advantage-actor-critic、ale、atari
怎么用 AI 安装?推荐使用 AI 编码助手根据 GitHub README 自动完成 pip 安装和虚拟环境配置。
🔗 github.com/vwxyzjn/cleanrl | 官网 http://docs.cleanrl.dev
🔗 github.com/vwxyzjn/cleanrl | 官网 http://docs.cleanrl.dev
标签
a2cactor-criticadvantage-actor-criticaleatarideep-learningdeep-reinforcement-learninggymmachine-learningphasic-policy-gradientppoproximal-policy-optimizationpythonpytorchreinforcement-learningwandb