跳到主要內容
buildradar
Sign in
主題 · proximal-policy-optimization

proximal-policy-optimization

標記 proximal-policy-optimization 主題、收錄中的開源專案,依星數排序。

專案數
7
總星數
34,133
平均星數
4,876
佔比
0.00%

常跟 proximal-policy-optimization 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 proximal-policy-optimization 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • cleanrl@vwxyzjn

    高品質單檔實作深度強化學習演算法,具研究友好功能(PPO、DQN、C51、DDPG、TD3、SAC、PPG)

    10,358+19近 7 天星數變化
  • OpenRLHF@OpenRLHF

    一個易於使用、可擴展且高效能的 Agentic RL 框架,基於 Ray(PPO、DAPO、REINFORCE++、VLM、TIS、vLLM、Ray、Async RL)

    9,969+9近 7 天星數變化
  • 簡單的強化學習教學,莫煩Python 中文AI教學

    9,508-2近 7 天星數變化
  • PPO-PyTorch@nikhilbarhate99

    在 PyTorch 中最小化實作截斷目標的近端策略最佳化(PPO)

    2,381+6近 7 天星數變化
  • 此儲存庫包含大多數基於經典深度強化學習演算法的 PyTorch 實作,包含:DQN、DDQN、Dueling Network、DDPG、SAC、A2C、PPO、TRPO。(更多演算法持續開發中)

    697+1近 7 天星數變化
  • 用於建構深度強化學習代理人的 PyTorch 圖書館

    657+0近 7 天星數變化
  • 自動駕駛(Carla)中的深度強化學習(PPO)[從零開始]

    563-1近 7 天星數變化
← 返回主題列表