メインコンテンツへスキップ
buildradar
Sign in
トピック · ppo

ppo

ppo がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
26
総スター数
86,096
平均スター数
3,311
シェア
0.00%

ppo と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、ppo がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • easy-rl@datawhalechina

    強化学習の中国語チュートリアル(蘑菇书🍄)、オンライン閲覧アドレス:https://datawhalechina.github.io/easy-rl/

    14,592+28直近 7 日のスター増減
  • tianshou@thu-ml

    エレガントなPyTorchディープ強化学習ライブラリ。

    10,945+11直近 7 日のスター増減
  • cleanrl@vwxyzjn

    研究フレンドリーな機能(PPO, DQN, C51, DDPG, TD3, SAC, PPG)を備えた、高品質な単一ファイルでの深層強化学習アルゴリズムの実装。

    10,339+36直近 7 日のスター増減
  • シンプルな強化学習チュートリアル、莫烦Python 中文AI教学

    9,510+7直近 7 日のスター増減
  • deep-reinforcement-learning@udacity

    Deep Reinforcement Learning NanoDegreeプログラムのリポジトリ

    5,176+0直近 7 日のスター増減
  • ElegantRL@AI4Finance-Foundation

    大規模並列深層強化学習 🔥

    4,357+1直近 7 日のスター増減
  • hands-on-modern-rl@walkinglabs

    🚀 基本的なRLの概念からLLMアライメント、RLVR、高度なエージェンティックシステムへのギャップを埋めるオープンソースの実践的カリキュラム

    4,145+94直近 7 日のスター増減
  • FinRL-Trading@AI4Finance-Foundation

    FinRL-X: クオンツ取引向けの AI ネイティブなモジュール式インフラストラクチャ。

    3,607+25直近 7 日のスター増減
  • DeepRL@ShangtongZhang

    PyTorchによる深層強化学習アルゴリズムのモジュール化された実装

    3,449+2直近 7 日のスター増減
  • DRL-Pytorch@XinJingHao

    主要な深層強化学習(DRL)アルゴリズムのクリーン、堅牢、かつ統一された PyTorch 実装(Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)

    3,437+4直近 7 日のスター増減
  • PPO-PyTorch@nikhilbarhate99

    PyTorch によるクリップ目的関数 Proximal Policy Optimization (PPO) の最小限の実装

    2,376+0直近 7 日のスター増減
  • on-policy@marlbenchmark

    Multi-Agent PPO (MAPPO) の公式実装です。

    2,087+2直近 7 日のスター増減
  • SLM-Lab@kengz

    PyTorchによるモジュール式深層強化学習フレームワーク。書籍「Foundations of Deep Reinforcement Learning」の補助ライブラリ。

    1,362-1直近 7 日のスター増減
  • PPO-for-Beginners@ericyangyu

    シンプルでスタイリッシュな PPO の実装。Medium の連載シリーズに基づいています: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8

    1,268+3直近 7 日のスター増減
  • LearningHumanoidWalking@rohanpsingh

    強化学習を用いた人型ロボットの歩行訓練。

    1,207+1直近 7 日のスター増減
  • purejaxrl@luchris429

    非常に高速なエンドツーエンドのJax RL実装

    1,100+2直近 7 日のスター増減
  • xuance@agi-brain

    XuanCe:包括的かつ統一された深層強化学習ライブラリ

    1,081+1直近 7 日のスター増減
  • HALOs@ContextualAI

    DPO、KTO、PPO、ORPO、およびその他のヒューマンアウェア損失関数(HALO)の拡張可能な実装を提供するライブラリ

    910+0直近 7 日のスター増減
  • rl-starter-files@lcswillems

    コードを1行も書かずにエージェントの訓練、可視化、評価を即座に行うためのRLスターターファイル

    728+1直近 7 日のスター増減
  • このリポジトリには、DQN、DDQN、Dueling Network、DDPG、SAC、A2C、PPO、TRPOなどの古典的な深層強化学習アルゴリズムに基づくPyTorch実装の大半が含まれています(その他のアルゴリズムも順次追加予定)

    696+0直近 7 日のスター増減
  • oat@sail-sg

    🌾 OAT:強化学習や好みの学習などを含む、LLMオンラインアライメント向けの研究しやすいフレームワーク。

    670-1直近 7 日のスター増減
  • 深層強化学習エージェントを構築するためのPyTorchライブラリ

    657+1直近 7 日のスター増減
  • Open-AgentRL@Gen-Verse

    RLAnything (ICML 2026) & AutoTool (ICML 2026)、DemyAgent: LLM およびエージェントシナリオ向けのオープンソース RL

    625+1直近 7 日のスター増減
  • LLamaTuner@jianzhnie

    LLM の簡単かつ効率的なファインチューニング。(Llama、Llama2、Llama3、Qwen、Baichuan、GLM、Falcon をサポート)大模型高效量化训练+部署。

    621+0直近 7 日のスター増減
  • 動画生成における強化学習に関する論文のキュレーションリスト

    590+2直近 7 日のスター増減
  • 自動運転 (Carla) における深層強化学習 (PPO) のスクラッチ実装

    564+1直近 7 日のスター増減
← トピック一覧に戻る