reinforcement-learning
標記 reinforcement-learning 主題、收錄中的開源專案,依星數排序。
- #151★ 1,446+0近 7 天星數變化
- #152
用於 Unitree Go1 機器人的從模擬到真實(Sim-to-real)RL 訓練與部署工具。
★ 1,444+0近 7 天星數變化 - #153★ 1,434+0近 7 天星數變化
- #154
以 Julia 編寫的簡潔優美演算法
★ 1,426+0近 7 天星數變化 - #155
精選的 Model-based RL 資源清單(持續更新)
★ 1,394+0近 7 天星數變化 - #156★ 1,388+0近 7 天星數變化
- #157
一款用於 STEM 教育與 AI 強化服務的可程式化、高靈活性機器人貓。
★ 1,373+0近 7 天星數變化 - #158
在 ROS Gazebo 模擬器中用於移動機器人導航的深度強化學習。利用雙延遲深度確定性策略梯度 (TD3) 神經網路,機器人在模擬環境中學習導航至隨機目標點,同時避開障礙物。
★ 1,367+0近 7 天星數變化 - #159★ 1,367+0近 7 天星數變化
- #160★ 1,361+0近 7 天星數變化
- #161
Soft Actor-Critic (SAC)、Twin Delayed DDPG (TD3)、Actor-Critic (AC/A2C)、Proximal Policy Optimization (PPO)、QT-Opt、PointNet 的 PyTorch 實作..
★ 1,359+0近 7 天星數變化 - #162
一個充滿活力的生態系統,在此系統中 AI agent 透過工作流程迴圈完成任務、藉由迭代執行來改進、透過導師 agent 或人工介入進行評估,並將已完成的工作轉化為可重複使用的工作經驗與資料,以提升未來的 agent。
★ 1,334+0近 7 天星數變化 - #163
使用 Keras 實作的極簡深度 Q 學習(DQN 與 DDQN)
★ 1,329+0近 7 天星數變化 - #164
深度學習與機器學習的論文閱讀筆記
★ 1,273+0近 7 天星數變化 - #165
一個簡單且風格良好的 PPO 實作。基於我的 Medium 系列文章:https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8
★ 1,270+0近 7 天星數變化 - #166
用於強化學習的多目標 Gymnasium 環境
★ 1,244+0近 7 天星數變化 - #167
在 Android 裝置上進行 RL 研究。
★ 1,241+0近 7 天星數變化 - #168★ 1,227+0近 7 天星數變化
- #169
使用強化學習訓練人形機器人進行移動
★ 1,214+0近 7 天星數變化 - #170
帕德博恩大學(Paderborn University)強化學習課程的講義、包含解答的實作練習以及線上影片
★ 1,193+0近 7 天星數變化 - #171★ 1,189+0近 7 天星數變化
- #172★ 1,181+0近 7 天星數變化
- #173★ 1,177+0近 7 天星數變化
- #174
在模擬環境與常見設定(如 Google Robot、WidowX+Bridge)下評估與重現真實世界的機器人操作策略(例如 RT-1、RT-1-X、Octo)(CoRL 2024)
★ 1,161+0近 7 天星數變化 - #175★ 1,150+0近 7 天星數變化
- #176★ 1,146+0近 7 天星數變化
- #177★ 1,133+0近 7 天星數變化
- #178★ 1,130+5近 7 天星數變化
- #179
:computer: 學習讓機器學習,這樣你就不用辛苦編寫程式;終極清單
★ 1,129+0近 7 天星數變化 - #180★ 1,123+3近 7 天星數變化