跳到主要内容
buildradar
登录
主题 · reinforcement-learning

reinforcement-learning

标记 reinforcement-learning 主题、收录中的开源项目,按星标数排序。

共 305 个项目
  • mushroom-rl@MushroomRL

    用于强化学习的 Python 库

    944+0近 7 天星标变化
  • UniRL@Tencent-Hunyuan

    UniRL 是一个统一多模态模型强化学习框架

    939+15近 7 天星标变化
  • Mava@instadeepai

    🦁 适用于 JAX 中多智能体强化学习快速实验的研究友好代码库

    934+1近 7 天星标变化
  • UniLab@Motphys

    UniLab:超越 GPU 主导范式的机器人 RL 异构架构

    926+18近 7 天星标变化
  • maro@microsoft

    多智能体资源优化(MARO)平台是用于现实世界资源优化问题的“即服务强化学习”(RaaS)实例。

    923+1近 7 天星标变化
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    922+783近 7 天星标变化
  • 关于扩散模型的关键论文与博客总结,以便学习该主题。包含所有已发布扩散机器人论文的详细清单。

    920+0近 7 天星标变化
  • safe-control-gym@learnsyslab

    用于基于学习的控制和 RL 的 PyBullet CartPole 与 Quadrotor 环境(具备 CasADi 符号先验动力学)

    917+4近 7 天星标变化
  • 精选的 Decision Transformer 资源列表(持续更新)

    917+1近 7 天星标变化
  • 👉 CARLA 相关资源,包含教程、博客、代码等 https://github.com/carla-simulator/carla

    915-1近 7 天星标变化
  • hok_env@tencent-ailab

    腾讯王者荣耀 AI 开源环境

    905+0近 7 天星标变化
  • rl4co@ai4co

    一个用于组合优化(CO)强化学习(RL)全方位功能的 PyTorch 库

    900+0近 7 天星标变化
  • 精选的深度强化学习(Deep Reinforcement Learning)资源清单。

    900+0近 7 天星标变化
  • iris@eloialonso

    Transformer 是具备样本效率的世界模型。ICLR 2023,入选前 5% 卓越论文。

    899-1近 7 天星标变化
  • TienKung-Lab@Open-X-Humanoid

    天工实验室:针对双足机器人的 Direct IsaacLab 工作流程

    884+6近 7 天星标变化
  • jumanji@instadeepai

    🕹️ 一套在 JAX 中具备可扩展性的多元强化学习环境套件

    861+1近 7 天星标变化
  • REINVENT4@MolecularAI

    用于从头设计、骨架跳跃、R 基团替换、连接子设计和分子优化的 AI 分子设计工具。

    854+2近 7 天星标变化
  • humanplus@MarkFzp

    [CoRL 2024] HumanPlus: 人形机器人 shadowing 与来自人类的模仿

    849-1近 7 天星标变化
  • JaxMARL@bold-lab-ai

    基于 JAX 的多智能体强化学习

    848+1近 7 天星标变化
  • 🌟 精选的高质量 AI 工具 🤖、API 🔗、数据集 📊 与学习资源 📚 集合,涵盖机器学习 🧠、深度学习 🧩、生成式 AI 🎨、NLP 💬 与数据科学 📈。旨在帮助开发者 👩‍💻、研究人员 🔬 和创作者 ✨ 更快地探索并使用 AI 进行构建 ⚡。

    841+12近 7 天星标变化
  • openrl@OpenRL-Lab

    统一的强化学习框架

    841+0近 7 天星标变化
  • contextualbandits@david-cortes

    上下文多臂老虎机算法的 Python 实现

    839+2近 7 天星标变化
  • 安全强化学习基准仓库。

    814+1近 7 天星标变化
  • 🚀🚀🚀 收集一些关于大型语言模型(LLM)、视觉语言模型(VLM)、视觉语言动作(VLA)、AI 生成内容(AIGC)以及相关数据集与应用的优秀公开项目。

    813-1近 7 天星标变化
  • 大语言模型策略内蒸馏(OPD)的精选论文、技术报告、框架与工具集合

    803+32近 7 天星标变化
  • awesome-isaac-gym@robotlearning123

    精選的優秀 NVIDIA Isaac Gym 框架、論文、軟體與資源列表

    797+1近 7 天星标变化
  • mobilegym@Purewhiter

    MobileGym:用于 Mobile GUI Agent 研究的可验证高并发模拟平台 · 浏览器里运行的安卓模拟器 · Browser-hosted Android Simulator · 可验证评估 · 可扩展的线上 RL 训练

    787+5近 7 天星标变化
  • BFM-Zero@LeCAR-Lab

    BFM_Zero:使用无监督强化学习的人形机器人控制提示式行为基础模型

    779+5近 7 天星标变化
  • POMDPs.jl@JuliaPOMDP

    Julia 中的 MDP 与 POMDP——一个用于在离散和连续空间中定义、求解及模拟完全与部分可观测马尔可夫决策过程的接口。

    767+2近 7 天星标变化
  • panda-gym@qgallouedec

    基于 PyBullet 物理引擎与 gymnasium 的机器人环境集合。

    766+1近 7 天星标变化
← 返回主题列表