跳到主要内容
buildradar
登录
主题 · deep-reinforcement-learning

deep-reinforcement-learning

标记 deep-reinforcement-learning 主题、收录中的开源项目,按星标数排序。

共 62 个项目
  • snake@chynl

    使用 AI 玩贪吃蛇游戏。

    1,789+0近 7 天星标变化
  • Top-Deep-Learning@mbadry1

    依 Star 数排序的前 200 名深度学习 Github 仓库

    1,775+0近 7 天星标变化
  • d3rlpy@takuseno

    一个离线深度强化学习库

    1,684+0近 7 天星标变化
  • 强化学习中扩散模型(Diffusion Model)资源精选列表(持续更新)。

    1,638+0近 7 天星标变化
  • hands-on-rl@Paulescu

    免费课程,带你从零基础迈向强化学习 PRO 🦸🏻‍🦸🏽

    1,572+0近 7 天星标变化
  • awesome-deep-rl@tigerneil

    专注于深度强化学习与 AI 的未来。

    1,513+0近 7 天星标变化
  • DI-star@opendilab

    StarCraft II 的人工智能平台,具备大规模分布式训练与大师级代理。

    1,393+0近 7 天星标变化
  • DRL-robot-navigation@reiniscimurs

    在 ROS Gazebo 模拟器中用于移动机器人导航的深度强化学习。利用双延迟深度确定性策略梯度 (TD3) 神经网络,机器人在模拟环境中学习导航至随机目标点,同时避开障碍物。

    1,367+0近 7 天星标变化
  • SLM-Lab@kengz

    基于 PyTorch 的模块化深度强化学习框架。《Foundations of Deep Reinforcement Learning》一书的配套库。

    1,361+0近 7 天星标变化
  • MARLlib@Replicable-MARL

    多智能体强化学习(MARL)只需一个仓库就够了

    1,344+0近 7 天星标变化
  • 使用 Keras 实现的极简深度 Q 学习(DQN 与 DDQN)

    1,329+0近 7 天星标变化
  • omnisafe@PKU-Alignment

    JMLR:OmniSafe 是用于加速 SafeRL 研究的基础设施框架。

    1,150+0近 7 天星标变化
  • purejaxrl@luchris429

    极速的端到端 Jax RL 实现

    1,103+2近 7 天星标变化
  • DexterousHands@PKU-MARL

    这是一个通过 Isaac Gym 提供双手灵巧操作任务的库。

    1,099+3近 7 天星标变化
  • sumo-rl@LucasAlegre

    使用 SUMO 进行交通信号控制的强化学习环境。兼容于 Gymnasium、PettingZoo 以及热门的 RL 库。

    1,076+2近 7 天星标变化
  • rl-book@ZhiqingXiao

    《Reinforcement Learning: Theory and Python Implementation》一书的源代码。

    1,033+1近 7 天星标变化
  • AgileRL@AgileRL

    以 RLOps 简化强化学习。搭载最先进的 RL 算法与工具,通过进化式超参数优化实现快 10 倍的训练速度。

    951+3近 7 天星标变化
  • GibsonEnv@StanfordVL

    Gibson 环境:具身代理的真实世界感知

    947+0近 7 天星标变化
  • mushroom-rl@MushroomRL

    用于强化学习的 Python 库

    944+0近 7 天星标变化
  • 精选的深度强化学习(Deep Reinforcement Learning)资源清单。

    900+0近 7 天星标变化
  • Neural-SLAM@devendrachaplot

    ICLR-20 论文“Learning to Explore using Active Neural SLAM”的 Pytorch 代码

    851+0近 7 天星标变化
  • 此仓库包含大多数基于经典深度强化学习算法的 PyTorch 实现,包含:DQN、DDQN、Dueling Network、DDPG、SAC、A2C、PPO、TRPO。(更多算法持续开发中)

    697+1近 7 天星标变化
  • 用于构建深度强化学习智能体的 PyTorch 库

    657+0近 7 天星标变化
  • ReinforcementLearning.jl@JuliaReinforcementLearning

    适用于 Julia 的强化学习套件。

    652-1近 7 天星标变化
  • phillip@vladfi1

    SSBM "Phillip" AI

    591+0近 7 天星标变化
  • imitation-learning@Kaixhin

    模仿学习算法

    574+0近 7 天星标变化
  • hutb@OpenHUTB

    人车模拟器

    572+5近 7 天星标变化
  • -chanlun@tomcat123a

    文件“笔和线段的一种划分.py”,只需输入 K 线的 high 与 low 数据,即可自动实现笔、线段、中枢、买卖点与走势类型的划分。

    568+0近 7 天星标变化
  • 自动驾驶(Carla)中的深度强化学习(PPO)[从零开始]

    563-1近 7 天星标变化
  • DI-sheep@opendilab

    羊了个羊 + 深度强化学习

    519+0近 7 天星标变化
← 返回主题列表