reinforcement-learning
标记 reinforcement-learning 主题、收录中的开源项目,按星标数排序。
- #151★ 1,446+4近 7 天星标变化
- #152
用于 Unitree Go1 机器人的从模拟到真实(Sim-to-real)RL 训练与部署工具。
★ 1,444+4近 7 天星标变化 - #153★ 1,434+2近 7 天星标变化
- #154
以 Julia 编写的简洁优美算法
★ 1,426+0近 7 天星标变化 - #155
精选的 Model-based RL 资源列表(持续更新)
★ 1,394+1近 7 天星标变化 - #156★ 1,388+3近 7 天星标变化
- #157
一款用于 STEM 教育与 AI 增强服务地可编程、高灵活性机器人猫。
★ 1,373+1近 7 天星标变化 - #158
在 ROS Gazebo 模拟器中用于移动机器人导航的深度强化学习。利用双延迟深度确定性策略梯度 (TD3) 神经网络,机器人在模拟环境中学习导航至随机目标点,同时避开障碍物。
★ 1,367+5近 7 天星标变化 - #159★ 1,367+0近 7 天星标变化
- #160★ 1,361-1近 7 天星标变化
- #161
Soft Actor-Critic (SAC)、Twin Delayed DDPG (TD3)、Actor-Critic (AC/A2C)、Proximal Policy Optimization (PPO)、QT-Opt、PointNet 的 PyTorch 实现..
★ 1,359+0近 7 天星标变化 - #162
一个充满活力的生态系统,在此系统中 AI agent 通过工作流程循环完成任务、藉由迭代执行来改进、通过导师 agent 或人工介入进行评估,并将已完成的工作转化为可重复使用的工作经验与数据,以提升未来的 agent。
★ 1,334+0近 7 天星标变化 - #163
使用 Keras 实现的极简深度 Q 学习(DQN 与 DDQN)
★ 1,329+0近 7 天星标变化 - #164
深度学习与机器学习的论文阅读笔记
★ 1,273+3近 7 天星标变化 - #165
一个简单且风格良好的 PPO 实现。基于我的 Medium 系列文章:https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8
★ 1,270+1近 7 天星标变化 - #166
用于强化学习的多目标 Gymnasium 环境
★ 1,244+484近 7 天星标变化 - #167
在 Android 设备上进行 RL 研究。
★ 1,241+1近 7 天星标变化 - #168★ 1,227+14近 7 天星标变化
- #169
使用强化学习训练人形机器人进行移动
★ 1,214+4近 7 天星标变化 - #170
帕德博恩大学(Paderborn University)强化学习课程的讲义、包含解答的实操练习以及在线视频
★ 1,193+1近 7 天星标变化 - #171★ 1,189+1近 7 天星标变化
- #172★ 1,181+26近 7 天星标变化
- #173★ 1,177+0近 7 天星标变化
- #174
在模拟环境与常见设置(如 Google Robot、WidowX+Bridge)下评估与重现真实世界的机器人操作策略(例如 RT-1、RT-1-X、Octo)(CoRL 2024)
★ 1,161+8近 7 天星标变化 - #175★ 1,150+0近 7 天星标变化
- #176★ 1,146+2近 7 天星标变化
- #177★ 1,133-1近 7 天星标变化
- #178★ 1,130+5近 7 天星标变化
- #179
:computer: 学习让机器学习,这样你就不用辛苦编写程序;终极清单
★ 1,129+1近 7 天星标变化 - #180★ 1,123+4近 7 天星标变化