reinforcement-learning
标记 reinforcement-learning 主题、收录中的开源项目,按星标数排序。
- #181
超级马里奥兄弟的异步优势演员-评论家(A3C)算法
★ 1,111+0近 7 天星标变化 - #182★ 1,103+2近 7 天星标变化
- #183
模块化强化学习(RL)库(使用 PyTorch、JAX 与 NVIDIA Warp 实现),支持 Gymnasium/Gym、NVIDIA Isaac Lab、MuJoCo Playground 等环境。
★ 1,095+0近 7 天星标变化 - #184
这是一个通过 Isaac Gym 提供双手灵巧操作任务的库。
★ 1,094+3近 7 天星标变化 - #185★ 1,086+4近 7 天星标变化
- #186
离线强化学习 (offline-rl) 算法索引。
★ 1,078+0近 7 天星标变化 - #187
gym-retro 的分支版本,包含额外的游戏、模拟器与支持的平台
★ 1,077+398近 7 天星标变化 - #188★ 1,075+2近 7 天星标变化
- #189★ 1,066+0近 7 天星标变化
- #190
掌握 AI/ML/DL/CV 的必备指南
★ 1,063+0近 7 天星标变化 - #191★ 1,060+1近 7 天星标变化
- #192
“Learning Efficient Online 3D Bin Packing on Packing Configuration Trees”的代码实现。我们提出通过在分层装箱配置树上进行学习,来增强在线三维装箱问题 (BPP) 的实际适用性,这使得深度强化学习 (DRL) 模型能够轻松应对实际限制,即使在连续解空间中也能表现良好。
★ 1,047+1近 7 天星标变化 - #193
Agent工程师最全学习路径 · 从零精通 AI 工程 · 20 阶段 503 课 · 中文全量翻译 + 配套站点 + 动画讲解视频 · 如何成为 AI Agent 工程师的修成指南
★ 1,047+21近 7 天星标变化 - #194★ 1,043+1近 7 天星标变化
- #195★ 1,033+1近 7 天星标变化
- #196★ 1,033+1近 7 天星标变化
- #197
用于四足机器人 locomotion MPC 控制的深度强化学习
★ 1,024+2近 7 天星标变化 - #198
高吞吐量同步与异步强化学习
★ 1,022+0近 7 天星标变化 - #199★ 1,016+0近 7 天星标变化
- #200
一个用于完全协同之人机协作性能的基准测试环境。
★ 1,003+3近 7 天星标变化 - #201★ 983+49近 7 天星标变化
- #202
多智能体强化学习的精彩游戏 AI 素材
★ 980+1近 7 天星标变化 - #203
强大的 3B 参数、基于 LLM 的强化学习音频编辑模型,擅长编辑情感、说话风格与副语言学,并具备强大的零样本文本转语音功能
★ 973+1近 7 天星标变化 - #204
用于强化学习的机器人模拟环境集合
★ 963+0近 7 天星标变化 - #205
机器学习开源大学
★ 955+0近 7 天星标变化 - #206
使用生成式 AI 与深度学习进行分子与材料设计的列表。
★ 952+1近 7 天星标变化 - #207★ 951+3近 7 天星标变化
- #208★ 947+0近 7 天星标变化
- #209★ 946+6近 7 天星标变化
- #210
PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama
★ 945—近 7 天星标变化