跳到主要内容
buildradar
登录
主题 · reinforcement-learning

reinforcement-learning

标记 reinforcement-learning 主题、收录中的开源项目,按星标数排序。

共 305 个项目
  • Rainbow 就是你所需要的一切!从 DQN 到 Rainbow 的逐步教程

    2,032+0近 7 天星标变化
  • AgentFlow@lupantech

    AgentFlow:流中的 Agent 系统优化

    2,025+0近 7 天星标变化
  • 使用 Keras 进行高级深度学习,由 Packt 出版

    2,023+0近 7 天星标变化
  • Nemotron@NVIDIA-NeMo

    NVIDIA Nemotron 开发者资产中心 — 用于构建 Nemotron 模型的训练方法、使用手册、数据集与完整端到端参考示例的一站式资源。

    2,015+0近 7 天星标变化
  • 🚀 免费 AI 资源 - 🎓 课程、👷 工作、📝 博客、🔬 AI 研究等,应有尽有!

    1,975+0近 7 天星标变化
  • PhySO@WassimTenachi

    物理符号优化

    1,972+0近 7 天星标变化
  • all-rl-algorithms@FareedKhan-dev

    以更简单的方式实现所有强化学习(RL)算法

    1,929+0近 7 天星标变化
  • TradingGym@Yvictor

    用于训练强化学习代理或简单规则基础算法的交易与回测环境。

    1,915+0近 7 天星标变化
  • RoboVerse@RoboVerseOrg

    RoboVerse:迈向可扩展且具泛化能力的机器人学习统一平台、数据集与基准测试

    1,851+0近 7 天星标变化
  • awesome-AI-books@zslucky

    一些可用于学习与下载的实用 AI 相关书籍与 PDF,同时也应用了一些用于学习的 playground 模型。

    1,799+0近 7 天星标变化
  • snake@chynl

    使用 AI 玩贪吃蛇游戏。

    1,789+0近 7 天星标变化
  • tnt@meta-pytorch

    用于 PyTorch 训练工具与实用程序的轻量级库

    1,722+0近 7 天星标变化
  • agibot_x1_train@AgibotTech

    AgiBot X1 的强化学习训练代码。

    1,698+0近 7 天星标变化
  • bindsnet@BindsNET

    使用 PyTorch 模拟脉冲神经网络(SNN)。

    1,695+0近 7 天星标变化
  • deep-neuroevolution@uber-research

    深度神经进化

    1,666+0近 7 天星标变化
  • LightZero@opendilab

    [NeurIPS 2023 Spotlight] LightZero:一般序列决策情境中蒙特卡洛树搜索的统一基准(精选 MCTS 资源)。

    1,642+0近 7 天星标变化
  • safe-rlhf@PKU-Alignment

    Safe RLHF:通过来自人类反馈的安全强化学习进行受约束的价值对齐

    1,613+0近 7 天星标变化
  • NavRL@Zhefan-Xu

    [IEEE RA-L'25] NavRL:动态环境下的安全飞行学习(NVIDIA Isaac/Python/ROS1/ROS2)

    1,599+0近 7 天星标变化
  • godot_rl_agents@edbeeching

    一个开源软件包,让电子游戏创作者、AI 研究人员和爱好者能够为其非玩家角色(NPC)或 Agent 学习复杂行为

    1,578+0近 7 天星标变化
  • hands-on-rl@Paulescu

    免费课程,带你从零基础迈向强化学习 PRO 🦸🏻‍🦸🏽

    1,570+0近 7 天星标变化
  • AgentEvolver@modelscope

    AgentEvolver:迈向高效的自我演化 Agent 系统

    1,552+0近 7 天星标变化
  • Mortal@Equim-chan

    🚀🀄️ 由 Rust 和深度强化学习驱动的高速强大日式麻将 AI。

    1,539+0近 7 天星标变化
  • ai_all_resources@nivu

    精选的最佳人工智慧资源清单

    1,522+0近 7 天星标变化
  • envpool@sail-sg

    基于 C++ 的通用强化学习(RL)环境高性能并行环境执行引擎(向量化环境)。

    1,513+0近 7 天星标变化
  • awesome-deep-rl@tigerneil

    专注于深度强化学习与 AI 的未来。

    1,513+0近 7 天星标变化
  • reasoning-gym@open-thought

    [NeurIPS 2025 Spotlight] 具备可验证奖励的强化学习推理环境

    1,500+0近 7 天星标变化
  • 精选的机器人实用连结与软件库清单。

    1,483+0近 7 天星标变化
  • tensor-house@ikatsov

    企业应用场景的参考 Jupyter notebooks 与 AI/ML 应用展示合集:营销、定价、供应链、智能制造等。

    1,453+0近 7 天星标变化
  • TextWorld@microsoft

    TextWorld 是一个沙盒学习环境,用于训练和评估文本游戏上的强化学习 (RL) 代理程序。

    1,442+0近 7 天星标变化
  • walk-these-ways@Improbable-AI

    用于 Unitree Go1 机器人的从模拟到真实(Sim-to-real)RL 训练与部署工具。

    1,440+0近 7 天星标变化
← 返回主题列表