reinforcement-learning
标记 reinforcement-learning 主题、收录中的开源项目,按星标数排序。
相关主题
常跟 reinforcement-learning 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 reinforcement-learning 主题的项目。
- #1
一个充满活力的生态系统,在此系统中 AI agent 通过工作流程循环完成任务、藉由迭代执行来改进、通过导师 agent 或人工介入进行评估,并将已完成的工作转化为可重复使用的工作经验与数据,以提升未来的 agent。
★ 1,334 - #2★ 895
- #3
人形机器人运动智能论文、开源项目、产业与求职知识库
★ 512 - #4
Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.
★ 160 - #5
🎬 OraRL — Annotations as Rollouts for efficient, scalable reinforcement learning of unified video MLLMs.
★ 152
- #1
计算机科学课程与视频讲座列表
★ 83,389+0近 7 天星标变化 - #2
本机 UI,用于运行与训练 LLM 与扩散模型,支持 Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、DeepSeek-V4、FLUX 等多种模型
★ 75,515+0近 7 天星标变化 - #3
🧑🏫 60+ 深度学习论文实现与教程,附并排笔记 📝;包括 transformers(原版、xl、switch、feedback、vit 等)、optimizers(adam、adabelief、sophia 等)、GAN(cyclegan、stylegan2 等)、🎮 强化学习(ppo、dqn)、capsnet、蒸馏等 🧠
★ 67,389+0近 7 天星标变化 - #4
学会它。打造它。交付给他人。
★ 52,098+0近 7 天星标变化 - #5
《深入理解 AI Agent:设计原理与工程实践》(李博杰 著)开源主仓库:全书正文、编译版 PDF 与按章配套代码
★ 44,381+0近 7 天星标变化 - #6★ 43,688+0近 7 天星标变化
- #7★ 33,538+0近 7 天星标变化
- #8
📚 企业分享的数据科学与机器学习实务论文与技术博客。
★ 30,107+0近 7 天星标变化 - #9★ 29,512+0近 7 天星标变化
- #10★ 21,201+0近 7 天星标变化
- #11
机器学习交易代码,第 3 版——从数据获取到实时执行
★ 20,762+0近 7 天星标变化 - #12
Unity Machine Learning Agents Toolkit(ML-Agents)是一个开源项目,使游戏和模拟能够作为使用深度强化学习和模仿学习训练智能代理的环境。
★ 19,655+0近 7 天星标变化 - #13
点亮 AI 代理的绝佳训练器。
★ 17,959+0近 7 天星标变化 - #14
这是新书《强化学习的数学基础》的主页
★ 17,663+0近 7 天星标变化 - #15
《李宏毅深度学习教程》(李宏毅老师推荐👍,苹果书🍎),PDF 下载地址:https://github.com/datawhalechina/leedl-tutorial/releases
★ 16,747+0近 7 天星标变化 - #16
精选的人工智能 (AI) 课程、书籍、视频讲座与论文列表。
★ 16,306+0近 7 天星标变化 - #17
Python 实现的强化学习:入门指南
★ 14,758+0近 7 天星标变化 - #18★ 14,711+0近 7 天星标变化
- #19★ 14,600+0近 7 天星标变化
- #20
PyTorch version of Stable Baselines, reliable implementations of reinforcement learning algorithms.
★ 13,758+0近 7 天星标变化 - #21
通过这些精彩讲座,沉浸于深度学习、强化学习、机器学习、计算机视觉与自然语言处理的世界!
★ 12,939+0近 7 天星标变化 - #22★ 12,451+0近 7 天星标变化
- #23★ 11,249+0近 7 天星标变化
- #24
示范如何使用 Amazon SageMaker 构建、训练与部署机器学习模型的 Jupyter Notebook 示例 📓 🧠
★ 10,983+0近 7 天星标变化 - #25
Agent Reinforcement Trainer:使用 GRPO 训练多步骤代理以执行真实任务。为您的代理提供在职培训。支持 Qwen3.6、GPT-OSS、Llama 等的强化学习
★ 10,689+0近 7 天星标变化 - #26★ 10,358+0近 7 天星标变化
- #27
一个易于使用、可扩展且高效能的 Agentic RL 框架,基于 Ray(PPO、DAPO、REINFORCE++、VLM、TIS、vLLM、Ray、Async RL)
★ 9,969+0近 7 天星标变化 - #28
简单的强化学习教学,莫烦Python 中文AI教学
★ 9,508+0近 7 天星标变化 - #29★ 8,925+0近 7 天星标变化
- #30
机器学习示例与教学合集
★ 8,917+0近 7 天星标变化