跳到主要内容
buildradar
Sign in
主题 · reinforcement-learning

reinforcement-learning

标记 reinforcement-learning 主题、收录中的开源项目,按星标数排序。

项目数
305
总星标数
1,292,198
平均星标数
4,237
占比
0.07%

常跟 reinforcement-learning 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 reinforcement-learning 主题的项目。

  • agent-apprenticeship@ray-r-ren

    一个充满活力的生态系统,在此系统中 AI agent 通过工作流程循环完成任务、藉由迭代执行来改进、通过导师 agent 或人工介入进行评估,并将已完成的工作转化为可重复使用的工作经验与数据,以提升未来的 agent。

    1,334
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    895
  • 人形机器人运动智能论文、开源项目、产业与求职知识库

    512
  • EvoTrace@jinzijian

    Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.

    160
  • OraRL@HVision-NKU

    🎬 OraRL — Annotations as Rollouts for efficient, scalable reinforcement learning of unified video MLLMs.

    152
  • 计算机科学课程与视频讲座列表

    83,389+0近 7 天星标变化
  • unsloth@unslothai

    本机 UI,用于运行与训练 LLM 与扩散模型,支持 Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、DeepSeek-V4、FLUX 等多种模型

    75,515+0近 7 天星标变化
  • 🧑‍🏫 60+ 深度学习论文实现与教程,附并排笔记 📝;包括 transformers(原版、xl、switch、feedback、vit 等)、optimizers(adam、adabelief、sophia 等)、GAN(cyclegan、stylegan2 等)、🎮 强化学习(ppo、dqn)、capsnet、蒸馏等 🧠

    67,389+0近 7 天星标变化
  • 学会它。打造它。交付给他人。

    52,098+0近 7 天星标变化
  • ai-agent-book@bojieli

    《深入理解 AI Agent:设计原理与工程实践》(李博杰 著)开源主仓库:全书正文、编译版 PDF 与按章配套代码

    44,381+0近 7 天星标变化
  • ray@ray-project

    Ray 是一个 AI 计算引擎,包含核心分布式运行时和加速机器学习工作负载的 AI 库套件

    43,688+0近 7 天星标变化
  • sglang@sgl-project

    SGLang 是针对大型语言模型与多模态模型的高性能服务框架

    33,538+0近 7 天星标变化
  • applied-ml@eugeneyan

    📚 企业分享的数据科学与机器学习实务论文与技术博客。

    30,107+0近 7 天星标变化
  • d2l-en@d2l-ai

    互动式深度学习书籍,包含多框架代码、数学与讨论。已在 70 个国家 500 所大学采用,包括 Stanford、MIT、Harvard 与 Cambridge。

    29,512+0近 7 天星标变化
  • FinGPT@AI4Finance-Foundation

    FinGPT:开源金融大型语言模型! 革新 🔥 我们在 HuggingFace 上发布了训练好的模型。

    21,201+0近 7 天星标变化
  • machine-learning-for-trading@stefan-jansen

    机器学习交易代码,第 3 版——从数据获取到实时执行

    20,762+0近 7 天星标变化
  • ml-agents@Unity-Technologies

    Unity Machine Learning Agents Toolkit(ML-Agents)是一个开源项目,使游戏和模拟能够作为使用深度强化学习和模仿学习训练智能代理的环境。

    19,655+0近 7 天星标变化
  • agent-lightning@microsoft

    点亮 AI 代理的绝佳训练器。

    17,959+0近 7 天星标变化
  • 这是新书《强化学习的数学基础》的主页

    17,663+0近 7 天星标变化
  • leedl-tutorial@datawhalechina

    《李宏毅深度学习教程》(李宏毅老师推荐👍,苹果书🍎),PDF 下载地址:https://github.com/datawhalechina/leedl-tutorial/releases

    16,747+0近 7 天星标变化
  • 精选的人工智能 (AI) 课程、书籍、视频讲座与论文列表。

    16,306+0近 7 天星标变化
  • Python 实现的强化学习:入门指南

    14,758+0近 7 天星标变化
  • bullet3@bulletphysics

    Bullet Physics SDK:实时碰撞检测与多物理模拟,适用于 VR、游戏、视觉特效、机器人、机器学习等

    14,711+0近 7 天星标变化
  • easy-rl@datawhalechina

    强化学习中文教程(蘑菇书🍄),在线阅读地址:https://datawhalechina.github.io/easy-rl/

    14,600+0近 7 天星标变化
  • PyTorch version of Stable Baselines, reliable implementations of reinforcement learning algorithms.

    13,758+0近 7 天星标变化
  • 通过这些精彩讲座,沉浸于深度学习、强化学习、机器学习、计算机视觉与自然语言处理的世界!

    12,939+0近 7 天星标变化
  • Gymnasium@Farama-Foundation

    单代理强化学习环境的标准 API,提供流行的参考环境与相关工具(前称 Gym)

    12,451+0近 7 天星标变化
  • wandb@wandb

    AI 开发者平台,使用 Weights & Biases 进行模型训练与微调,并从实验到部署全流程管理模型。

    11,249+0近 7 天星标变化
  • amazon-sagemaker-examples@aws

    示范如何使用 Amazon SageMaker 构建、训练与部署机器学习模型的 Jupyter Notebook 示例 📓 🧠

    10,983+0近 7 天星标变化
  • ART@OpenPipe

    Agent Reinforcement Trainer:使用 GRPO 训练多步骤代理以执行真实任务。为您的代理提供在职培训。支持 Qwen3.6、GPT-OSS、Llama 等的强化学习

    10,689+0近 7 天星标变化
  • cleanrl@vwxyzjn

    高质量单文件实现深度强化学习算法,具研究友好特性(PPO、DQN、C51、DDPG、TD3、SAC、PPG)

    10,358+0近 7 天星标变化
  • OpenRLHF@OpenRLHF

    一个易于使用、可扩展且高效能的 Agentic RL 框架,基于 Ray(PPO、DAPO、REINFORCE++、VLM、TIS、vLLM、Ray、Async RL)

    9,969+0近 7 天星标变化
  • 简单的强化学习教学,莫烦Python 中文AI教学

    9,508+0近 7 天星标变化
  • Sana@NVlabs

    SANA:使用线性扩散变换器的高效高分辨率图像合成

    8,925+0近 7 天星标变化
  • machine_learning_examples@lazyprogrammer

    机器学习示例与教学合集

    8,917+0近 7 天星标变化
← 返回主题列表