メインコンテンツへスキップ
buildradar
Sign in
トピック · proximal-policy-optimization

proximal-policy-optimization

proximal-policy-optimization がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
7
総スター数
34,133
平均スター数
4,876
シェア
0.00%

proximal-policy-optimization と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、proximal-policy-optimization がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • cleanrl@vwxyzjn

    研究フレンドリーな機能(PPO, DQN, C51, DDPG, TD3, SAC, PPG)を備えた、高品質な単一ファイルでの深層強化学習アルゴリズムの実装。

    10,358+19直近 7 日のスター増減
  • OpenRLHF@OpenRLHF

    Rayベースの使いやすいスケーラブルで高性能なエージェンティックRLフレームワーク (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)

    9,969+9直近 7 日のスター増減
  • シンプルな強化学習チュートリアル、莫烦Python 中文AI教学

    9,508-2直近 7 日のスター増減
  • PPO-PyTorch@nikhilbarhate99

    PyTorch によるクリップ目的関数 Proximal Policy Optimization (PPO) の最小限の実装

    2,381+6直近 7 日のスター増減
  • このリポジトリには、DQN、DDQN、Dueling Network、DDPG、SAC、A2C、PPO、TRPOなどの古典的な深層強化学習アルゴリズムに基づくPyTorch実装の大半が含まれています(その他のアルゴリズムも順次追加予定)

    697+1直近 7 日のスター増減
  • 深層強化学習エージェントを構築するためのPyTorchライブラリ

    657+0直近 7 日のスター増減
  • 自動運転 (Carla) における深層強化学習 (PPO) のスクラッチ実装

    563-1直近 7 日のスター増減
← トピック一覧に戻る