主題 · proximal-policy-optimization
proximal-policy-optimization
標記 proximal-policy-optimization 主題、收錄中的開源專案,依星數排序。
專案數
7
總星數
34,133
平均星數
4,876
佔比
0.00%
相關主題
常跟 proximal-policy-optimization 一起出現在同一個專案上的主題。
近期新秀
近 90 天內建立、標記 proximal-policy-optimization 主題的專案。
近 90 天內還沒有新專案標記這個主題。
- #1★ 10,358+19近 7 天星數變化
- #2
一個易於使用、可擴展且高效能的 Agentic RL 框架,基於 Ray(PPO、DAPO、REINFORCE++、VLM、TIS、vLLM、Ray、Async RL)
★ 9,969+9近 7 天星數變化 - #3
簡單的強化學習教學,莫煩Python 中文AI教學
★ 9,508-2近 7 天星數變化 - #4
在 PyTorch 中最小化實作截斷目標的近端策略最佳化(PPO)
★ 2,381+6近 7 天星數變化 - #5
此儲存庫包含大多數基於經典深度強化學習演算法的 PyTorch 實作,包含:DQN、DDQN、Dueling Network、DDPG、SAC、A2C、PPO、TRPO。(更多演算法持續開發中)
★ 697+1近 7 天星數變化 - #6
用於建構深度強化學習代理人的 PyTorch 圖書館
★ 657+0近 7 天星數變化 - #7
自動駕駛(Carla)中的深度強化學習(PPO)[從零開始]
★ 563-1近 7 天星數變化