ppo
标记 ppo 主题、收录中的开源项目,按星标数排序。
相关主题
常跟 ppo 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 ppo 主题的项目。
近 90 天内还没有新项目标记这个主题。
- #1★ 14,600+8近 7 天星标变化
- #2★ 10,955+10近 7 天星标变化
- #3★ 10,358+19近 7 天星标变化
- #4
简单的强化学习教学,莫烦Python 中文AI教学
★ 9,508-2近 7 天星标变化 - #5
Deep Reinforcement Learning Nanodegree 课程的仓库
★ 5,176+0近 7 天星标变化 - #6★ 4,359+2近 7 天星标变化
- #7
🚀 一个开源、实作导向的课程,弥合基础 RL 概念与 LLM 对齐、RLVR 及进阶代理系统之间的差距
★ 4,199+54近 7 天星标变化 - #8
FinRL‑X:面向量化交易的 AI 原生模块化基础设施
★ 3,657+50近 7 天星标变化 - #9★ 3,452+3近 7 天星标变化
- #10
干净、稳健且统一的 PyTorch 实现,涵盖热门深度强化学习(DRL)算法(Q-learning、Duel DDQN、PER、C51、Noisy DQN、PPO、DDPG、TD3、SAC、ASL)
★ 3,440+3近 7 天星标变化 - #11
在 PyTorch 中最小化实现截断目标的近端策略优化(PPO)
★ 2,381+6近 7 天星标变化 - #12★ 2,088+1近 7 天星标变化
- #13★ 1,362+0近 7 天星标变化
- #14
一个简单且风格良好的 PPO 实现。基于我的 Medium 系列文章:https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8
★ 1,269+1近 7 天星标变化 - #15
使用强化学习训练人形机器人进行移动
★ 1,210+3近 7 天星标变化 - #16★ 1,103+2近 7 天星标变化
- #17★ 1,085+4近 7 天星标变化
- #18★ 909-1近 7 天星标变化
- #19
RL 入门文件,无需编写任何代码即可立即训练、可视化与评估智能体
★ 728+0近 7 天星标变化 - #20
此仓库包含大多数基于经典深度强化学习算法的 PyTorch 实现,包含:DQN、DDQN、Dueling Network、DDPG、SAC、A2C、PPO、TRPO。(更多算法持续开发中)
★ 697+1近 7 天星标变化 - #21★ 669-1近 7 天星标变化
- #22
用于构建深度强化学习智能体的 PyTorch 库
★ 657+0近 7 天星标变化 - #23
RLAnything (ICML 2026) 与 AutoTool (ICML 2026),DemyAgent:用于 LLM 与 Agent 场景的开源强化学习
★ 634+9近 7 天星标变化 - #24
简单且高效的 LLM 微调工具(支持 LLaMA、LLaMA2、LLaMA3、Qwen、Baichuan、GLM、Falcon),大模型高效量化训练与部署。
★ 621+0近 7 天星标变化 - #25
关于视频生成强化学习的精选论文列表。
★ 591+1近 7 天星标变化 - #26
自动驾驶(Carla)中的深度强化学习(PPO)[从零开始]
★ 563-1近 7 天星标变化