跳到主要內容
buildradar
登入
主題 · reinforcement-learning

reinforcement-learning

標記 reinforcement-learning 主題、收錄中的開源專案,依星數排序。

共 305 個專案
  • Rainbow 就是你所需要的一切!從 DQN 到 Rainbow 的逐步教學

    2,032+0近 7 天星數變化
  • AgentFlow@lupantech

    AgentFlow:流程中的 Agent 系統最佳化

    2,025+0近 7 天星數變化
  • 使用 Keras 進行進階深度學習,由 Packt 出版

    2,023+0近 7 天星數變化
  • Nemotron@NVIDIA-NeMo

    NVIDIA Nemotron 開發者資產中心 — 用於建構 Nemotron 模型的訓練方法、使用手冊、資料集與完整端對端參考範例的一站式資源。

    2,015+0近 7 天星數變化
  • 🚀 免費 AI 資源 - 🎓 課程、👷 工作、📝 部落格、🔬 AI 研究等,應有盡有!

    1,975+0近 7 天星數變化
  • PhySO@WassimTenachi

    物理符號最佳化

    1,972+0近 7 天星數變化
  • all-rl-algorithms@FareedKhan-dev

    以更簡單的方式實現所有強化學習(RL)演算法

    1,929+0近 7 天星數變化
  • TradingGym@Yvictor

    用於訓練強化學習代理程式或簡單規則基礎演算法的交易與回測環境。

    1,915+0近 7 天星數變化
  • RoboVerse@RoboVerseOrg

    RoboVerse:邁向可擴充且具泛化能力的機器人學習統一平台、資料集與基準測試

    1,851+0近 7 天星數變化
  • awesome-AI-books@zslucky

    一些可用於學習與下載的實用 AI 相關書籍與 PDF,同時也應用了一些用於學習的 playground 模型。

    1,799+0近 7 天星數變化
  • snake@chynl

    使用 AI 玩貪吃蛇遊戲。

    1,789+0近 7 天星數變化
  • tnt@meta-pytorch

    用於 PyTorch 訓練工具與實用程式的輕量級函式庫

    1,722+0近 7 天星數變化
  • agibot_x1_train@AgibotTech

    AgiBot X1 的強化學習訓練程式碼。

    1,698+0近 7 天星數變化
  • bindsnet@BindsNET

    使用 PyTorch 模擬脈衝神經網路(SNN)。

    1,695+0近 7 天星數變化
  • deep-neuroevolution@uber-research

    深度神經進化

    1,666+0近 7 天星數變化
  • LightZero@opendilab

    [NeurIPS 2023 Spotlight] LightZero:一般序列決策情境中蒙地卡羅樹搜尋的統一基準(精選 MCTS 資源)。

    1,642+0近 7 天星數變化
  • safe-rlhf@PKU-Alignment

    Safe RLHF:透過來自人類回饋的安全強化學習進行受約束的價值對齊

    1,613+0近 7 天星數變化
  • NavRL@Zhefan-Xu

    [IEEE RA-L'25] NavRL:動態環境下的安全飛行學習(NVIDIA Isaac/Python/ROS1/ROS2)

    1,599+0近 7 天星數變化
  • godot_rl_agents@edbeeching

    一個開源套件,讓電子遊戲創作者、AI 研究人員與愛好者能為其非玩家角色(NPC)或 Agent 學習複雜行為

    1,578+0近 7 天星數變化
  • hands-on-rl@Paulescu

    免費課程,帶你從零基礎邁向強固學習 PRO 🦸🏻‍🦸🏽

    1,570+0近 7 天星數變化
  • AgentEvolver@modelscope

    AgentEvolver:邁向高效的自我演化 Agent 系統

    1,552+0近 7 天星數變化
  • Mortal@Equim-chan

    🚀🀄️ 由 Rust 和深度強化學習驅動的高速強大日式麻將 AI。

    1,539+0近 7 天星數變化
  • ai_all_resources@nivu

    精選的最佳人工智慧資源清單

    1,522+0近 7 天星數變化
  • envpool@sail-sg

    基於 C++ 的通用強化學習(RL)環境高效能平行環境執行引擎(向量化環境)。

    1,513+0近 7 天星數變化
  • awesome-deep-rl@tigerneil

    致力於深度強化學習與 AI 的未來。

    1,513+0近 7 天星數變化
  • reasoning-gym@open-thought

    [NeurIPS 2025 Spotlight] 具備可驗證獎勵的強化學習推理環境

    1,500+0近 7 天星數變化
  • 精選的機器人實用連結與軟體庫清單。

    1,483+0近 7 天星數變化
  • tensor-house@ikatsov

    企業應用場景的參考 Jupyter notebooks 與 AI/ML 應用展示合集:行銷、定價、供應鏈、智慧製造等。

    1,453+0近 7 天星數變化
  • TextWorld@microsoft

    TextWorld 是一個沙盒學習環境,用於訓練和評估文字遊戲上的強化學習 (RL) 代理程式。

    1,442+0近 7 天星數變化
  • walk-these-ways@Improbable-AI

    用於 Unitree Go1 機器人的從模擬到真實(Sim-to-real)RL 訓練與部署工具。

    1,440+0近 7 天星數變化
← 返回主題列表