ppo
標記 ppo 主題、收錄中的開源專案,依星數排序。
相關主題
常跟 ppo 一起出現在同一個專案上的主題。
近期新秀
近 90 天內建立、標記 ppo 主題的專案。
近 90 天內還沒有新專案標記這個主題。
- #1★ 14,600+8近 7 天星數變化
- #2★ 10,955+10近 7 天星數變化
- #3★ 10,358+19近 7 天星數變化
- #4
簡單的強化學習教學,莫煩Python 中文AI教學
★ 9,508-2近 7 天星數變化 - #5
Deep Reinforcement Learning Nanodegree 课程的仓库
★ 5,176+0近 7 天星數變化 - #6★ 4,359+2近 7 天星數變化
- #7
🚀 一個開源、實作導向的課程,彌合基礎 RL 概念與 LLM 對齊、RLVR 及進階代理系統之間的差距
★ 4,199+54近 7 天星數變化 - #8
FinRL‑X:面向量化交易的 AI 原生模組化基礎設施
★ 3,657+50近 7 天星數變化 - #9★ 3,452+3近 7 天星數變化
- #10
乾淨、穩健且統一的 PyTorch 實作,涵蓋熱門深度強化學習(DRL)演算法(Q-learning、Duel DDQN、PER、C51、Noisy DQN、PPO、DDPG、TD3、SAC、ASL)
★ 3,440+3近 7 天星數變化 - #11
在 PyTorch 中最小化實作截斷目標的近端策略最佳化(PPO)
★ 2,381+6近 7 天星數變化 - #12★ 2,088+1近 7 天星數變化
- #13★ 1,362+0近 7 天星數變化
- #14
一個簡單且風格良好的 PPO 實作。基於我的 Medium 系列文章:https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8
★ 1,269+1近 7 天星數變化 - #15
使用強化學習訓練人形機器人進行移動
★ 1,210+3近 7 天星數變化 - #16★ 1,103+2近 7 天星數變化
- #17★ 1,085+4近 7 天星數變化
- #18★ 909-1近 7 天星數變化
- #19
RL 入門檔案,無需編寫任何程式碼即可立即訓練、視覺化與評估代理程式
★ 728+0近 7 天星數變化 - #20
此儲存庫包含大多數基於經典深度強化學習演算法的 PyTorch 實作,包含:DQN、DDQN、Dueling Network、DDPG、SAC、A2C、PPO、TRPO。(更多演算法持續開發中)
★ 697+1近 7 天星數變化 - #21★ 669-1近 7 天星數變化
- #22
用於建構深度強化學習代理人的 PyTorch 圖書館
★ 657+0近 7 天星數變化 - #23
RLAnything (ICML 2026) 與 AutoTool (ICML 2026),DemyAgent:用於 LLM 與 Agent 場景的開源強化學習
★ 634+9近 7 天星數變化 - #24
簡單且高效的 LLM 微調工具(支援 LLaMA、LLaMA2、LLaMA3、Qwen、Baichuan、GLM、Falcon),大模型高效量化訓練與部署。
★ 621+0近 7 天星數變化 - #25
關於影片生成強化學習的精選論文列表。
★ 591+1近 7 天星數變化 - #26
自動駕駛(Carla)中的深度強化學習(PPO)[從零開始]
★ 563-1近 7 天星數變化