reinforcement-learning
標記 reinforcement-learning 主題、收錄中的開源專案,依星數排序。
- #181
超級瑪利歐兄弟的非同步優勢演員-評論家(A3C)演算法
★ 1,111+0近 7 天星數變化 - #182★ 1,103+2近 7 天星數變化
- #183
模組化強化學習(RL)函式庫(使用 PyTorch、JAX 與 NVIDIA Warp 實作),支援 Gymnasium/Gym、NVIDIA Isaac Lab、MuJoCo Playground 等環境。
★ 1,095+0近 7 天星數變化 - #184
這是一個透過 Isaac Gym 提供雙手靈巧操作任務的函式庫。
★ 1,094+3近 7 天星數變化 - #185★ 1,086+4近 7 天星數變化
- #186
離線強化學習 (offline-rl) 演算法索引。
★ 1,078+0近 7 天星數變化 - #187
gym-retro 的分支版本,包含額外的遊戲、模擬器與支援的平台
★ 1,077+398近 7 天星數變化 - #188★ 1,075+2近 7 天星數變化
- #189★ 1,066+0近 7 天星數變化
- #190
掌握 AI/ML/DL/CV 的必備指南
★ 1,063+0近 7 天星數變化 - #191★ 1,060+1近 7 天星數變化
- #192
Agent工程師最全學習路徑 · 從零精通 AI 工程 · 20 階段 503 課 · 中文全量翻譯 + 配套站點 + 動畫講解視頻 · 如何成為 AI Agent 工程師的修成指南
★ 1,047+21近 7 天星數變化 - #193
「Learning Efficient Online 3D Bin Packing on Packing Configuration Trees」的程式碼實作。我們提出透過在階層式裝箱組態樹上進行學習,來增強線上三維裝箱問題 (BPP) 的實際適用性,這使得深度強化學習 (DRL) 模型能夠輕鬆應對實際限制,即使在連續解空間中也能表現良好。
★ 1,047+1近 7 天星數變化 - #194★ 1,043+1近 7 天星數變化
- #195★ 1,033+1近 7 天星數變化
- #196★ 1,033+1近 7 天星數變化
- #197
用於四足機器人 locomotion MPC 控制的深度強化學習
★ 1,024+2近 7 天星數變化 - #198
高吞吐量同步與非同步強化學習
★ 1,022+0近 7 天星數變化 - #199★ 1,016+0近 7 天星數變化
- #200
一個用於完全協同之人機協作效能的基準測試環境。
★ 1,003+3近 7 天星數變化 - #201★ 983+49近 7 天星數變化
- #202
多代理強化學習的精彩遊戲 AI 素材
★ 980+1近 7 天星數變化 - #203
強大的 3B 參數、基於 LLM 的強化學習音訊編輯模型,擅長編輯情感、說話風格與副語言學,並具備強大的零樣本文字轉語音功能
★ 973+1近 7 天星數變化 - #204
用於強化學習的機器人模擬環境集合
★ 963+0近 7 天星數變化 - #205
機器學習開源大學
★ 955+0近 7 天星數變化 - #206
使用生成式 AI 與深度學習進行分子與材料設計的列表。
★ 952+1近 7 天星數變化 - #207★ 951+3近 7 天星數變化
- #208★ 947+0近 7 天星數變化
- #209★ 946+6近 7 天星數變化
- #210
PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama
★ 945—近 7 天星數變化