主题 · proximal-policy-optimization
proximal-policy-optimization
标记 proximal-policy-optimization 主题、收录中的开源项目,按星标数排序。
项目数
7
总星标数
34,133
平均星标数
4,876
占比
0.00%
相关主题
常跟 proximal-policy-optimization 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 proximal-policy-optimization 主题的项目。
近 90 天内还没有新项目标记这个主题。
- #1★ 10,358+19近 7 天星标变化
- #2
一个易于使用、可扩展且高效能的 Agentic RL 框架,基于 Ray(PPO、DAPO、REINFORCE++、VLM、TIS、vLLM、Ray、Async RL)
★ 9,969+9近 7 天星标变化 - #3
简单的强化学习教学,莫烦Python 中文AI教学
★ 9,508-2近 7 天星标变化 - #4
在 PyTorch 中最小化实现截断目标的近端策略优化(PPO)
★ 2,381+6近 7 天星标变化 - #5
此仓库包含大多数基于经典深度强化学习算法的 PyTorch 实现,包含:DQN、DDQN、Dueling Network、DDPG、SAC、A2C、PPO、TRPO。(更多算法持续开发中)
★ 697+1近 7 天星标变化 - #6
用于构建深度强化学习智能体的 PyTorch 库
★ 657+0近 7 天星标变化 - #7
自动驾驶(Carla)中的深度强化学习(PPO)[从零开始]
★ 563-1近 7 天星标变化