跳到主要内容
buildradar
Sign in
主题 · ppo

ppo

标记 ppo 主题、收录中的开源项目,按星标数排序。

项目数
26
总星标数
86,263
平均星标数
3,318
占比
0.00%

常跟 ppo 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 ppo 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • easy-rl@datawhalechina

    强化学习中文教程(蘑菇书🍄),在线阅读地址:https://datawhalechina.github.io/easy-rl/

    14,600+8近 7 天星标变化
  • tianshou@thu-ml

    优雅的 PyTorch 深度强化学习库

    10,955+10近 7 天星标变化
  • cleanrl@vwxyzjn

    高质量单文件实现深度强化学习算法,具研究友好特性(PPO、DQN、C51、DDPG、TD3、SAC、PPG)

    10,358+19近 7 天星标变化
  • 简单的强化学习教学,莫烦Python 中文AI教学

    9,508-2近 7 天星标变化
  • deep-reinforcement-learning@udacity

    Deep Reinforcement Learning Nanodegree 课程的仓库

    5,176+0近 7 天星标变化
  • ElegantRL@AI4Finance-Foundation

    大规模并行深度强化学习。🔥

    4,359+2近 7 天星标变化
  • hands-on-modern-rl@walkinglabs

    🚀 一个开源、实作导向的课程,弥合基础 RL 概念与 LLM 对齐、RLVR 及进阶代理系统之间的差距

    4,199+54近 7 天星标变化
  • FinRL-Trading@AI4Finance-Foundation

    FinRL‑X:面向量化交易的 AI 原生模块化基础设施

    3,657+50近 7 天星标变化
  • DeepRL@ShangtongZhang

    PyTorch 深度 RL 算法模块化实现

    3,452+3近 7 天星标变化
  • DRL-Pytorch@XinJingHao

    干净、稳健且统一的 PyTorch 实现,涵盖热门深度强化学习(DRL)算法(Q-learning、Duel DDQN、PER、C51、Noisy DQN、PPO、DDPG、TD3、SAC、ASL)

    3,440+3近 7 天星标变化
  • PPO-PyTorch@nikhilbarhate99

    在 PyTorch 中最小化实现截断目标的近端策略优化(PPO)

    2,381+6近 7 天星标变化
  • on-policy@marlbenchmark

    这是 Multi-Agent PPO (MAPPO) 的官方实现。

    2,088+1近 7 天星标变化
  • SLM-Lab@kengz

    基于 PyTorch 的模块化深度强化学习框架。《Foundations of Deep Reinforcement Learning》一书的配套库。

    1,362+0近 7 天星标变化
  • PPO-for-Beginners@ericyangyu

    一个简单且风格良好的 PPO 实现。基于我的 Medium 系列文章:https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8

    1,269+1近 7 天星标变化
  • LearningHumanoidWalking@rohanpsingh

    使用强化学习训练人形机器人进行移动

    1,210+3近 7 天星标变化
  • purejaxrl@luchris429

    极速的端到端 Jax RL 实现

    1,103+2近 7 天星标变化
  • xuance@agi-brain

    XuanCe:一个全面且统一的深度强化学习库

    1,085+4近 7 天星标变化
  • HALOs@ContextualAI

    一个具有 DPO、KTO、PPO、ORPO 及其他人类意识损失函数(HALO)可扩展实现的库。

    909-1近 7 天星标变化
  • rl-starter-files@lcswillems

    RL 入门文件,无需编写任何代码即可立即训练、可视化与评估智能体

    728+0近 7 天星标变化
  • 此仓库包含大多数基于经典深度强化学习算法的 PyTorch 实现,包含:DQN、DDQN、Dueling Network、DDPG、SAC、A2C、PPO、TRPO。(更多算法持续开发中)

    697+1近 7 天星标变化
  • oat@sail-sg

    🌾 OAT:一个对研究友好的 LLM 在线对齐框架,包含强化学习、偏好学习等。

    669-1近 7 天星标变化
  • 用于构建深度强化学习智能体的 PyTorch 库

    657+0近 7 天星标变化
  • Open-AgentRL@Gen-Verse

    RLAnything (ICML 2026) 与 AutoTool (ICML 2026),DemyAgent:用于 LLM 与 Agent 场景的开源强化学习

    634+9近 7 天星标变化
  • LLamaTuner@jianzhnie

    简单且高效的 LLM 微调工具(支持 LLaMA、LLaMA2、LLaMA3、Qwen、Baichuan、GLM、Falcon),大模型高效量化训练与部署。

    621+0近 7 天星标变化
  • 关于视频生成强化学习的精选论文列表。

    591+1近 7 天星标变化
  • 自动驾驶(Carla)中的深度强化学习(PPO)[从零开始]

    563-1近 7 天星标变化
← 返回主题列表