跳到主要內容
buildradar
Sign in
主題 · ppo

ppo

標記 ppo 主題、收錄中的開源專案,依星數排序。

專案數
26
總星數
86,263
平均星數
3,318
佔比
0.00%

常跟 ppo 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 ppo 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • easy-rl@datawhalechina

    強化學習中文教程(蘑菇書🍄),線上閱讀地址:https://datawhalechina.github.io/easy-rl/

    14,600+8近 7 天星數變化
  • tianshou@thu-ml

    優雅的 PyTorch 深度強化學習函式庫

    10,955+10近 7 天星數變化
  • cleanrl@vwxyzjn

    高品質單檔實作深度強化學習演算法,具研究友好功能(PPO、DQN、C51、DDPG、TD3、SAC、PPG)

    10,358+19近 7 天星數變化
  • 簡單的強化學習教學,莫煩Python 中文AI教學

    9,508-2近 7 天星數變化
  • deep-reinforcement-learning@udacity

    Deep Reinforcement Learning Nanodegree 课程的仓库

    5,176+0近 7 天星數變化
  • ElegantRL@AI4Finance-Foundation

    大規模平行深度強化學習。🔥

    4,359+2近 7 天星數變化
  • hands-on-modern-rl@walkinglabs

    🚀 一個開源、實作導向的課程,彌合基礎 RL 概念與 LLM 對齊、RLVR 及進階代理系統之間的差距

    4,199+54近 7 天星數變化
  • FinRL-Trading@AI4Finance-Foundation

    FinRL‑X:面向量化交易的 AI 原生模組化基礎設施

    3,657+50近 7 天星數變化
  • DeepRL@ShangtongZhang

    PyTorch 深度 RL 算法模組化實作

    3,452+3近 7 天星數變化
  • DRL-Pytorch@XinJingHao

    乾淨、穩健且統一的 PyTorch 實作,涵蓋熱門深度強化學習(DRL)演算法(Q-learning、Duel DDQN、PER、C51、Noisy DQN、PPO、DDPG、TD3、SAC、ASL)

    3,440+3近 7 天星數變化
  • PPO-PyTorch@nikhilbarhate99

    在 PyTorch 中最小化實作截斷目標的近端策略最佳化(PPO)

    2,381+6近 7 天星數變化
  • on-policy@marlbenchmark

    這是 Multi-Agent PPO (MAPPO) 的官方實作。

    2,088+1近 7 天星數變化
  • SLM-Lab@kengz

    基於 PyTorch 的模組化深度強化學習框架。《Foundations of Deep Reinforcement Learning》一書的配套函式庫。

    1,362+0近 7 天星數變化
  • PPO-for-Beginners@ericyangyu

    一個簡單且風格良好的 PPO 實作。基於我的 Medium 系列文章:https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8

    1,269+1近 7 天星數變化
  • LearningHumanoidWalking@rohanpsingh

    使用強化學習訓練人形機器人進行移動

    1,210+3近 7 天星數變化
  • purejaxrl@luchris429

    極速的端對端 Jax RL 實作

    1,103+2近 7 天星數變化
  • xuance@agi-brain

    XuanCe:一個全面且統一的深度強化學習函式庫

    1,085+4近 7 天星數變化
  • HALOs@ContextualAI

    一個具有 DPO、KTO、PPO、ORPO 及其他人類意識損失函數(HALO)可擴充實作的程式庫。

    909-1近 7 天星數變化
  • rl-starter-files@lcswillems

    RL 入門檔案,無需編寫任何程式碼即可立即訓練、視覺化與評估代理程式

    728+0近 7 天星數變化
  • 此儲存庫包含大多數基於經典深度強化學習演算法的 PyTorch 實作,包含:DQN、DDQN、Dueling Network、DDPG、SAC、A2C、PPO、TRPO。(更多演算法持續開發中)

    697+1近 7 天星數變化
  • oat@sail-sg

    🌾 OAT:一個對研究友善的 LLM 線上對齊框架,包含強化學習、偏好學習等。

    669-1近 7 天星數變化
  • 用於建構深度強化學習代理人的 PyTorch 圖書館

    657+0近 7 天星數變化
  • Open-AgentRL@Gen-Verse

    RLAnything (ICML 2026) 與 AutoTool (ICML 2026),DemyAgent:用於 LLM 與 Agent 場景的開源強化學習

    634+9近 7 天星數變化
  • LLamaTuner@jianzhnie

    簡單且高效的 LLM 微調工具(支援 LLaMA、LLaMA2、LLaMA3、Qwen、Baichuan、GLM、Falcon),大模型高效量化訓練與部署。

    621+0近 7 天星數變化
  • 關於影片生成強化學習的精選論文列表。

    591+1近 7 天星數變化
  • 自動駕駛(Carla)中的深度強化學習(PPO)[從零開始]

    563-1近 7 天星數變化
← 返回主題列表