跳到主要內容
buildradar
登入
主題 · reinforcement-learning

reinforcement-learning

標記 reinforcement-learning 主題、收錄中的開源專案,依星數排序。

共 305 個專案
  • 超級瑪利歐兄弟的非同步優勢演員-評論家(A3C)演算法

    1,111+0近 7 天星數變化
  • purejaxrl@luchris429

    極速的端對端 Jax RL 實作

    1,103+2近 7 天星數變化
  • skrl@Toni-SM

    模組化強化學習(RL)函式庫(使用 PyTorch、JAX 與 NVIDIA Warp 實作),支援 Gymnasium/Gym、NVIDIA Isaac Lab、MuJoCo Playground 等環境。

    1,095+0近 7 天星數變化
  • DexterousHands@PKU-MARL

    這是一個透過 Isaac Gym 提供雙手靈巧操作任務的函式庫。

    1,094+3近 7 天星數變化
  • xuance@agi-brain

    XuanCe:一個全面且統一的深度強化學習函式庫

    1,086+4近 7 天星數變化
  • 離線強化學習 (offline-rl) 演算法索引。

    1,078+0近 7 天星數變化
  • Stable-Retro@Farama-Foundation

    gym-retro 的分支版本,包含額外的遊戲、模擬器與支援的平台

    1,077+398近 7 天星數變化
  • sumo-rl@LucasAlegre

    使用 SUMO 進行交通號誌控制的強化學習環境。相容於 Gymnasium、PettingZoo 以及熱門的 RL 函式庫。

    1,075+2近 7 天星數變化
  • Books@Rishabh-creator601

    各個程式設計領域的書籍 / PDF / EPUB。閱讀、成長並享受 😊😊😊😊

    1,066+0近 7 天星數變化
  • 掌握 AI/ML/DL/CV 的必備指南

    1,063+0近 7 天星數變化
  • judgeval@JudgmentLabs

    面向 Agent 的持續改進堆疊。我們的環境資料與評估為 Agent 的改進和監控提供動力。

    1,060+1近 7 天星數變化
  • Agent工程師最全學習路徑 · 從零精通 AI 工程 · 20 階段 503 課 · 中文全量翻譯 + 配套站點 + 動畫講解視頻 · 如何成為 AI Agent 工程師的修成指南

    1,047+21近 7 天星數變化
  • Online-3D-BPP-PCT@alexfrom0815

    「Learning Efficient Online 3D Bin Packing on Packing Configuration Trees」的程式碼實作。我們提出透過在階層式裝箱組態樹上進行學習,來增強線上三維裝箱問題 (BPP) 的實際適用性,這使得深度強化學習 (DRL) 模型能夠輕鬆應對實際限制,即使在連續解空間中也能表現良好。

    1,047+1近 7 天星數變化
  • GPTSwarm@metauto-ai

    🐝 透過 RL / 提示詞最佳化實現的第一批自我改進 Agent

    1,043+1近 7 天星數變化
  • rl-tools@rl-tools

    最快速的深度強化學習函式庫

    1,033+1近 7 天星數變化
  • rl-book@ZhiqingXiao

    《Reinforcement Learning: Theory and Python Implementation》一書的原始碼。

    1,033+1近 7 天星數變化
  • rl-mpc-locomotion@silvery107

    用於四足機器人 locomotion MPC 控制的深度強化學習

    1,024+2近 7 天星數變化
  • sample-factory@alex-petrenko

    高吞吐量同步與非同步強化學習

    1,022+0近 7 天星數變化
  • DeepRec@imsheridan

    推薦、廣告工業界經典以及最前沿的論文、資料集合

    1,016+0近 7 天星數變化
  • overcooked_ai@HumanCompatibleAI

    一個用於完全協同之人機協作效能的基準測試環境。

    1,003+3近 7 天星數變化
  • verl-omni@verl-project

    針對擴散與全能模型的多模態 RL 訓練框架

    983+49近 7 天星數變化
  • 多代理強化學習的精彩遊戲 AI 素材

    980+1近 7 天星數變化
  • Step-Audio-EditX@stepfun-ai

    強大的 3B 參數、基於 LLM 的強化學習音訊編輯模型,擅長編輯情感、說話風格與副語言學,並具備強大的零樣本文字轉語音功能

    973+1近 7 天星數變化
  • Gymnasium-Robotics@Farama-Foundation

    用於強化學習的機器人模擬環境集合

    963+0近 7 天星數變化
  • 機器學習開源大學

    955+0近 7 天星數變化
  • 使用生成式 AI 與深度學習進行分子與材料設計的列表。

    952+1近 7 天星數變化
  • AgileRL@AgileRL

    以 RLOps 簡化強化學習。搭載最先進的 RL 演算法與工具,透過進化式超參數最佳化實現快 10 倍的訓練速度。

    951+3近 7 天星數變化
  • GibsonEnv@StanfordVL

    Gibson 環境:具身代理的真實世界感知

    947+0近 7 天星數變化
  • tdmpc2@nicklashansen

    「TD-MPC2: Scalable, Robust World Models for Continuous Control」的程式碼

    946+6近 7 天星數變化
  • Shimmy@Farama-Foundation

    PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama

    945近 7 天星數變化
← 返回主題列表