メインコンテンツへスキップ
buildradar
Sign in
トピック · reinforcement-learning-algorithms

reinforcement-learning-algorithms

reinforcement-learning-algorithms がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
21
総スター数
39,604
平均スター数
1,886
シェア
0.00%

reinforcement-learning-algorithms と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、reinforcement-learning-algorithms がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • PyTorch版のStable Baselines。強化学習アルゴリズムの信頼性の高い実装を提供。

    13,758+21直近 7 日のスター増減
  • deep-reinforcement-learning@udacity

    Deep Reinforcement Learning NanoDegreeプログラムのリポジトリ

    5,176+0直近 7 日のスター増減
  • DI-engine@opendilab

    OpenDILab決定AIエンジン。最も包括的な強化学習フレームワーク。

    3,642+1直近 7 日のスター増減
  • PPO-PyTorch@nikhilbarhate99

    PyTorch によるクリップ目的関数 Proximal Policy Optimization (PPO) の最小限の実装

    2,381+6直近 7 日のスター増減
  • モデルベース強化学習(Model-based RL)に関する優れたリソースの厳選リスト(随時更新)

    1,393+0直近 7 日のスター増減
  • PPO-for-Beginners@ericyangyu

    シンプルでスタイリッシュな PPO の実装。Medium の連載シリーズに基づいています: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8

    1,269+1直近 7 日のスター増減
  • ARPO@RUC-NLPIR

    [ICLR 2026] エージェント型強化ポリシー最適化 (ARPO)

    1,116+5直近 7 日のスター増減
  • purejaxrl@luchris429

    非常に高速なエンドツーエンドのJax RL実装

    1,102+2直近 7 日のスター増減
  • UI-Venus@inclusionAI

    UI-Venus は、スクリーンショットのみを入力として使用し、正確な GUI 要素のグラウンディングと効果的なナビゲーションを実行するように設計されたネイティブ UI エージェントです。

    1,037+23直近 7 日のスター増減
  • Decision Transformer リソースのキュレーションリスト(随時更新)

    916+0直近 7 日のスター増減
  • course-content-dl@NeuromatchAcademy

    NMA ディープラーニングコース

    812+1直近 7 日のスター増減
  • POMDPs.jl@JuliaPOMDP

    JuliaでのMDPおよびPOMDP - 離散空間および連続空間における完全・部分観測マルコフ決定プロセスの定義、解決、シミュレーションを行うためのインターフェース

    766+1直近 7 日のスター増減
  • stable-baselines3-contrib@Stable-Baselines-Team

    Stable-Baselines3向けContribパッケージ - 実験的な強化学習(RL)コード

    736+5直近 7 日のスター増減
  • UAV向けの深層強化学習による自律障害物回避アルゴリズムに関するプロジェクトです。

    730+0直近 7 日のスター増減
  • disco_rl@google-deepmind

    Nature 掲載論文「Discovering State-of-the-art Reinforcement Algorithms」の付属コード

    728+2直近 7 日のスター増減
  • 探索的強化学習(RL)に関する厳選リソースリスト(随時更新)

    723+0直近 7 日のスター増減
  • UAV-DDPG@fangvv

    論文「Computation Offloading Optimization for UAV-assisted Mobile Edge Computing: A Deep Deterministic Policy Gradient Approach」のコード

    722+1直近 7 日のスター増減
  • Rofunc@Skylark0924

    🤖 ロボットのデモからの学習とロボット操作のためのフルプロセスPythonパッケージ

    720+1直近 7 日のスター増減
  • 実装付きのモンテカルロ木探索(MCTS)論文のキュレーションリスト

    715+1直近 7 日のスター増減
  • 深層強化学習エージェントを構築するためのPyTorchライブラリ

    657+0直近 7 日のスター増減
  • dLLM-RL@Gen-Verse

    [ICLR 2026] TraceRLの公式コード:Diffusion LLMのポストトレーニングを革新し、SOTAのTraDoシリーズを駆動する

    520+1直近 7 日のスター増減
← トピック一覧に戻る