多码网
返回 编程语言
编程语言libraryPython

cleanrl

High-quality single file implementation of Deep Reinforcement Learning algorithms with research-friendly features (PPO, DQN, C51, DDPG, TD3, SAC, PPG)

9,620 stars1,058 forks98 issuesNOASSERTION更新于 2026/4/21
a2cactor-criticadvantage-actor-criticaleatarideep-learningdeep-reinforcement-learninggymmachine-learningphasic-policy-gradientppoproximal-policy-optimizationpythonpytorchreinforcement-learningwandb
暂无详细内容

同类推荐