跳到主要内容
buildradar
Sign in
主题 · proximal-policy-optimization

proximal-policy-optimization

标记 proximal-policy-optimization 主题、收录中的开源项目,按星标数排序。

项目数
7
总星标数
34,133
平均星标数
4,876
占比
0.00%

常跟 proximal-policy-optimization 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 proximal-policy-optimization 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • cleanrl@vwxyzjn

    高质量单文件实现深度强化学习算法,具研究友好特性(PPO、DQN、C51、DDPG、TD3、SAC、PPG)

    10,358+19近 7 天星标变化
  • OpenRLHF@OpenRLHF

    一个易于使用、可扩展且高效能的 Agentic RL 框架,基于 Ray(PPO、DAPO、REINFORCE++、VLM、TIS、vLLM、Ray、Async RL)

    9,969+9近 7 天星标变化
  • 简单的强化学习教学,莫烦Python 中文AI教学

    9,508-2近 7 天星标变化
  • PPO-PyTorch@nikhilbarhate99

    在 PyTorch 中最小化实现截断目标的近端策略优化(PPO)

    2,381+6近 7 天星标变化
  • 此仓库包含大多数基于经典深度强化学习算法的 PyTorch 实现,包含:DQN、DDQN、Dueling Network、DDPG、SAC、A2C、PPO、TRPO。(更多算法持续开发中)

    697+1近 7 天星标变化
  • 用于构建深度强化学习智能体的 PyTorch 库

    657+0近 7 天星标变化
  • 自动驾驶(Carla)中的深度强化学习(PPO)[从零开始]

    563-1近 7 天星标变化
← 返回主题列表