跳到主要內容
buildradar
登入
主題 · reinforcement-learning

reinforcement-learning

標記 reinforcement-learning 主題、收錄中的開源專案,依星數排序。

共 305 個專案
  • mushroom-rl@MushroomRL

    用於強化學習的 Python 函式庫

    944+0近 7 天星數變化
  • UniRL@Tencent-Hunyuan

    UniRL 是一個統一多模態模型強化學習框架

    939+15近 7 天星數變化
  • Mava@instadeepai

    🦁 適用於 JAX 中多智慧體強化學習快速實驗的研究友善程式碼庫

    934+1近 7 天星數變化
  • UniLab@Motphys

    UniLab:超越 GPU 主導範式的機器人 RL 異質架構

    926+18近 7 天星數變化
  • maro@microsoft

    多代理資源最佳化(MARO)平台是用於現實世界資源最佳化問題的「即服務強化學習」(RaaS)實例。

    923+1近 7 天星數變化
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    922+783近 7 天星數變化
  • 關於擴散模型的關鍵論文與部落格總結,以便學習該主題。包含所有已發布擴散機器人論文的詳細清單。

    920+0近 7 天星數變化
  • safe-control-gym@learnsyslab

    用於基於學習的控制和 RL 的 PyBullet CartPole 與 Quadrotor 環境(具備 CasADi 符號先驗動力學)

    917+4近 7 天星數變化
  • 精選的 Decision Transformer 資源清單(持續更新)

    917+1近 7 天星數變化
  • 👉 CARLA 相關資源,包含教學、部落格、程式碼等 https://github.com/carla-simulator/carla

    915-1近 7 天星數變化
  • hok_env@tencent-ailab

    騰訊王者榮耀 AI 開源環境

    905+0近 7 天星數變化
  • rl4co@ai4co

    一個用於組合優化(CO)強化學習(RL)全方位功能的 PyTorch 函式庫

    900+0近 7 天星數變化
  • 精選的深度強化學習(Deep Reinforcement Learning)資源清單。

    900+0近 7 天星數變化
  • iris@eloialonso

    Transformer 是具備樣本效率的世界模型。ICLR 2023,入選前 5% 卓越論文。

    899-1近 7 天星數變化
  • TienKung-Lab@Open-X-Humanoid

    天工實驗室:針對雙足機器人的 Direct IsaacLab 工作流程

    884+6近 7 天星數變化
  • jumanji@instadeepai

    🕹️ 一套在 JAX 中具備可擴展性的多元強化學習環境套件

    861+1近 7 天星數變化
  • REINVENT4@MolecularAI

    用於從頭設計、骨架跳躍、R 基團替換、連接子設計和分子最佳化的 AI 分子設計工具。

    854+2近 7 天星數變化
  • humanplus@MarkFzp

    [CoRL 2024] HumanPlus: 人形機器人 shadowing 與來自人類的模仿

    849-1近 7 天星數變化
  • JaxMARL@bold-lab-ai

    基於 JAX 的多智能體強化學習

    848+1近 7 天星數變化
  • openrl@OpenRL-Lab

    統一的強化學習框架

    841+0近 7 天星數變化
  • 🌟 精選的高品質 AI 工具 🤖、API 🔗、資料集 📊 與學習資源 🧠 集合,涵蓋機器學習 🧠、深度學習 🧩、生成式 AI 🎨、NLP 💬 與資料科學 📈。旨在幫助開發人員 👩‍💻、研究人員 🔬 和創作者 ✨ 更快地探索並使用 AI 進行建構 ⚡。

    841+12近 7 天星數變化
  • contextualbandits@david-cortes

    情境多臂強盜演算法的 Python 實作

    839+2近 7 天星數變化
  • 安全強化學習基準儲存庫。

    814+1近 7 天星數變化
  • 🚀🚀🚀 收集一些關於大型語言模型(LLM)、視覺語言模型(VLM)、視覺語言動作(VLA)、AI 生成內容(AIGC)以及相關資料集與應用的優秀公開專案。

    813-1近 7 天星數變化
  • 大型語言模型策略內蒸餾(OPD)的精選論文、技術報告、框架與工具集合

    803+32近 7 天星數變化
  • awesome-isaac-gym@robotlearning123

    精選的優秀 NVIDIA Isaac Gym 框架、論文、軟體與資源列表

    797+1近 7 天星數變化
  • mobilegym@Purewhiter

    MobileGym:用於 Mobile GUI Agent 研究的可驗證高並行模擬平台 · 瀏覽器裡運行的安卓模擬器 · Browser-hosted Android Simulator · 可驗證評估 · 可擴展的線上 RL 訓練

    787+5近 7 天星數變化
  • BFM-Zero@LeCAR-Lab

    BFM_Zero:使用非監督式強化學習的人形機器人控制提示式行為基礎模型

    779+5近 7 天星數變化
  • POMDPs.jl@JuliaPOMDP

    Julia 中的 MDP 與 POMDP——一個用於在離散與連續空間中定義、求解及模擬完全與部分可觀測馬可夫決策過程的介面。

    767+2近 7 天星數變化
  • panda-gym@qgallouedec

    基於 PyBullet 物理引擎與 gymnasium 的機器人環境集合。

    766+1近 7 天星數變化
← 返回主題列表