ppo
ppo がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
ppo と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、ppo がタグ付けされたリポジトリ。
直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。
- #1★ 14,592+28直近 7 日のスター増減
- #2★ 10,945+11直近 7 日のスター増減
- #3★ 10,339+36直近 7 日のスター増減
- #4
シンプルな強化学習チュートリアル、莫烦Python 中文AI教学
★ 9,510+7直近 7 日のスター増減 - #5
Deep Reinforcement Learning NanoDegreeプログラムのリポジトリ
★ 5,176+0直近 7 日のスター増減 - #6★ 4,357+1直近 7 日のスター増減
- #7
🚀 基本的なRLの概念からLLMアライメント、RLVR、高度なエージェンティックシステムへのギャップを埋めるオープンソースの実践的カリキュラム
★ 4,145+94直近 7 日のスター増減 - #8
FinRL-X: クオンツ取引向けの AI ネイティブなモジュール式インフラストラクチャ。
★ 3,607+25直近 7 日のスター増減 - #9★ 3,449+2直近 7 日のスター増減
- #10
主要な深層強化学習(DRL)アルゴリズムのクリーン、堅牢、かつ統一された PyTorch 実装(Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)
★ 3,437+4直近 7 日のスター増減 - #11
PyTorch によるクリップ目的関数 Proximal Policy Optimization (PPO) の最小限の実装
★ 2,376+0直近 7 日のスター増減 - #12★ 2,087+2直近 7 日のスター増減
- #13★ 1,362-1直近 7 日のスター増減
- #14
シンプルでスタイリッシュな PPO の実装。Medium の連載シリーズに基づいています: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8
★ 1,268+3直近 7 日のスター増減 - #15
強化学習を用いた人型ロボットの歩行訓練。
★ 1,207+1直近 7 日のスター増減 - #16★ 1,100+2直近 7 日のスター増減
- #17★ 1,081+1直近 7 日のスター増減
- #18★ 910+0直近 7 日のスター増減
- #19
コードを1行も書かずにエージェントの訓練、可視化、評価を即座に行うためのRLスターターファイル
★ 728+1直近 7 日のスター増減 - #20
このリポジトリには、DQN、DDQN、Dueling Network、DDPG、SAC、A2C、PPO、TRPOなどの古典的な深層強化学習アルゴリズムに基づくPyTorch実装の大半が含まれています(その他のアルゴリズムも順次追加予定)
★ 696+0直近 7 日のスター増減 - #21★ 670-1直近 7 日のスター増減
- #22
深層強化学習エージェントを構築するためのPyTorchライブラリ
★ 657+1直近 7 日のスター増減 - #23
RLAnything (ICML 2026) & AutoTool (ICML 2026)、DemyAgent: LLM およびエージェントシナリオ向けのオープンソース RL
★ 625+1直近 7 日のスター増減 - #24
LLM の簡単かつ効率的なファインチューニング。(Llama、Llama2、Llama3、Qwen、Baichuan、GLM、Falcon をサポート)大模型高效量化训练+部署。
★ 621+0直近 7 日のスター増減 - #25
動画生成における強化学習に関する論文のキュレーションリスト
★ 590+2直近 7 日のスター増減 - #26
自動運転 (Carla) における深層強化学習 (PPO) のスクラッチ実装
★ 564+1直近 7 日のスター増減