跳到主要內容
buildradar
登入
主題 · deep-reinforcement-learning

deep-reinforcement-learning

標記 deep-reinforcement-learning 主題、收錄中的開源專案,依星數排序。

共 62 個專案
  • snake@chynl

    使用 AI 玩貪吃蛇遊戲。

    1,789+0近 7 天星數變化
  • Top-Deep-Learning@mbadry1

    依 Star 數排序的前 200 名深度學習 Github 儲存庫

    1,775+0近 7 天星數變化
  • d3rlpy@takuseno

    一個離線深度強化學習函式庫

    1,684+0近 7 天星數變化
  • 強化學習中擴散模型(Diffusion Model)資源精選列表(持續更新)。

    1,635+0近 7 天星數變化
  • hands-on-rl@Paulescu

    免費課程,帶你從零基礎邁向強固學習 PRO 🦸🏻‍🦸🏽

    1,570+0近 7 天星數變化
  • awesome-deep-rl@tigerneil

    致力於深度強化學習與 AI 的未來。

    1,513+0近 7 天星數變化
  • DI-star@opendilab

    StarCraft II 的人工智慧平台,具備大規模分散式訓練與大師級代理。

    1,393+0近 7 天星數變化
  • DRL-robot-navigation@reiniscimurs

    在 ROS Gazebo 模擬器中用於移動機器人導航的深度強化學習。利用雙延遲深度確定性策略梯度 (TD3) 神經網路,機器人在模擬環境中學習導航至隨機目標點,同時避開障礙物。

    1,362+0近 7 天星數變化
  • SLM-Lab@kengz

    基於 PyTorch 的模組化深度強化學習框架。《Foundations of Deep Reinforcement Learning》一書的配套函式庫。

    1,362+0近 7 天星數變化
  • MARLlib@Replicable-MARL

    多代理人強化學習(MARL)只需一個儲存庫就夠了

    1,345+0近 7 天星數變化
  • 使用 Keras 實作的極簡深度 Q 學習(DQN 與 DDQN)

    1,329+0近 7 天星數變化
  • omnisafe@PKU-Alignment

    JMLR:OmniSafe 是用於加速 SafeRL 研究的基礎設施框架。

    1,150+0近 7 天星數變化
  • purejaxrl@luchris429

    極速的端對端 Jax RL 實作

    1,103+2近 7 天星數變化
  • DexterousHands@PKU-MARL

    這是一個透過 Isaac Gym 提供雙手靈巧操作任務的函式庫。

    1,094+3近 7 天星數變化
  • sumo-rl@LucasAlegre

    使用 SUMO 進行交通號誌控制的強化學習環境。相容於 Gymnasium、PettingZoo 以及熱門的 RL 函式庫。

    1,075+2近 7 天星數變化
  • rl-book@ZhiqingXiao

    《Reinforcement Learning: Theory and Python Implementation》一書的原始碼。

    1,033+1近 7 天星數變化
  • AgileRL@AgileRL

    以 RLOps 簡化強化學習。搭載最先進的 RL 演算法與工具,透過進化式超參數最佳化實現快 10 倍的訓練速度。

    951+3近 7 天星數變化
  • GibsonEnv@StanfordVL

    Gibson 環境:具身代理的真實世界感知

    947+0近 7 天星數變化
  • mushroom-rl@MushroomRL

    用於強化學習的 Python 函式庫

    944+0近 7 天星數變化
  • 精選的深度強化學習(Deep Reinforcement Learning)資源清單。

    900+0近 7 天星數變化
  • Neural-SLAM@devendrachaplot

    ICLR-20 論文「Learning to Explore using Active Neural SLAM」的 Pytorch 程式碼

    851+0近 7 天星數變化
  • 此儲存庫包含大多數基於經典深度強化學習演算法的 PyTorch 實作,包含:DQN、DDQN、Dueling Network、DDPG、SAC、A2C、PPO、TRPO。(更多演算法持續開發中)

    697+1近 7 天星數變化
  • 用於建構深度強化學習代理人的 PyTorch 圖書館

    657+0近 7 天星數變化
  • ReinforcementLearning.jl@JuliaReinforcementLearning

    適用於 Julia 的強化學習套件。

    652-1近 7 天星數變化
  • phillip@vladfi1

    SSBM "Phillip" AI

    591+0近 7 天星數變化
  • imitation-learning@Kaixhin

    模仿學習演算法

    573-1近 7 天星數變化
  • hutb@OpenHUTB

    人車模擬器

    569+2近 7 天星數變化
  • -chanlun@tomcat123a

    文件「筆和線段的一種劃分.py」,只需輸入 K 線的 high 與 low 數據,即可自動實現筆、線段、中樞、買賣點與走勢類型的劃分。

    568+0近 7 天星數變化
  • 自動駕駛(Carla)中的深度強化學習(PPO)[從零開始]

    563-1近 7 天星數變化
  • DI-sheep@opendilab

    羊了個羊 + 深度強化學習

    519+0近 7 天星數變化
← 返回主題列表