メインコンテンツへスキップ
buildradar
Sign in
トピック · reinforcement-learning

reinforcement-learning

reinforcement-learning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

305 件のリポジトリ
  • スーパーマリオブラザーズ向けの非同期Advantage Actor-Critic (A3C) アルゴリズム

    1,111-1直近 7 日のスター増減
  • purejaxrl@luchris429

    非常に高速なエンドツーエンドのJax RL実装

    1,103+3直近 7 日のスター増減
  • skrl@Toni-SM

    Gymnasium/Gym、NVIDIA Isaac Lab、MuJoCo Playgroundなどの環境をサポートする、モジュール式強化学習(RL)ライブラリ(PyTorch、JAX、NVIDIA Warpで実装)。

    1,095+2直近 7 日のスター増減
  • DexterousHands@PKU-MARL

    Isaac Gym を通じて両手器用操作タスクを提供するライブラリ。

    1,094+7直近 7 日のスター増減
  • xuance@agi-brain

    XuanCe:包括的かつ統一された深層強化学習ライブラリ

    1,085+4直近 7 日のスター増減
  • オフライン強化学習(offline-rl)アルゴリズムのインデックス

    1,078+3直近 7 日のスター増減
  • Stable-Retro@Farama-Foundation

    追加のゲーム、エミュレータ、サポートプラットフォームを備えたgym-retroのフォーク

    1,078+395直近 7 日のスター増減
  • sumo-rl@LucasAlegre

    SUMOを使用した信号制御のための強化学習環境。Gymnasium、PettingZoo、および主要な強化学習ライブラリと互換性があります。

    1,075+4直近 7 日のスター増減
  • Books@Rishabh-creator601

    様々なプログラミング分野に関する書籍、PDF、EPUB。読んで、成長し、楽しもう 😊😊😊😊

    1,066+6直近 7 日のスター増減
  • AI/ML/DL/CV の最新情報をキャッチアップするための必須ガイド

    1,063+0直近 7 日のスター増減
  • judgeval@JudgmentLabs

    エージェントのための継続的改善スタック。環境データと評価機能により、エージェントの改善とモニタリングを駆動します。

    1,060+2直近 7 日のスター増減
  • Online-3D-BPP-PCT@alexfrom0815

    「Learning Efficient Online 3D Bin Packing on Packing Configuration Trees」の実装コード。階層型パッキング構成ツリーの学習を通じてオンライン3D箱詰め問題(BPP)の実用性を高め、深層強化学習(DRL)モデルが実用的な制約に対処しやすく、連続的な解空間でも高性能を発揮できるようにします。

    1,047+1直近 7 日のスター増減
  • GPTSwarm@metauto-ai

    🐝 強化学習(RL)およびプロンプト最適化を用いた初の自己改善型エージェント

    1,043+3直近 7 日のスター増減
  • AIエージェントエンジニアのための完全学習パス · ゼロからマスターするAIエンジニアリング · 20ステージ503レッスン · 中国語完全翻訳+サポートサイト+アニメーション解説動画 · AIエージェントエンジニアになるための修得ガイド

    1,042+39直近 7 日のスター増減
  • rl-tools@rl-tools

    最速の深層強化学習ライブラリ

    1,033+3直近 7 日のスター増減
  • rl-book@ZhiqingXiao

    書籍「Reinforcement Learning: Theory and Python Implementation」のソースコード

    1,033+3直近 7 日のスター増減
  • rl-mpc-locomotion@silvery107

    四足歩行ロボットの移動の MPC 制御のための深層強化学習

    1,024+4直近 7 日のスター増減
  • sample-factory@alex-petrenko

    高スループットな同期および非同期強化学習

    1,021+0直近 7 日のスター増減
  • DeepRec@imsheridan

    推薦システムおよび CTR 予測に関する業界の古典的かつ最先端の論文・資料のコレクション

    1,016+0直近 7 日のスター増減
  • overcooked_ai@HumanCompatibleAI

    完全協調型人間・AI パフォーマンスのためのベンチマーク環境。

    1,003+5直近 7 日のスター増減
  • マルチエージェント強化学習に関する素晴らしいゲーム AI 資料

    979+2直近 7 日のスター増減
  • Step-Audio-EditX@stepfun-ai

    感情、話し方、パラ言語の編集に優れ、堅牢なゼロショットTTS機能を備えた、強力な3BパラメータのLLMベース強化学習オーディオ編集モデル

    972+2直近 7 日のスター増減
  • verl-omni@verl-project

    拡散モデルおよびオムニモデル向けのマルチモーダル RL トレーニングフレームワーク

    968+73直近 7 日のスター増減
  • Gymnasium-Robotics@Farama-Foundation

    強化学習用のロボットシミュレーション環境集。

    963+1直近 7 日のスター増減
  • 機械学習オープンソース大学

    955+0直近 7 日のスター増減
  • 生成AIとディープラーニングを用いた分子・材料設計のリスト

    952+1直近 7 日のスター増減
  • AgileRL@AgileRL

    RLOps による強化学習の効率化。最先端の強化学習アルゴリズムとツールを提供し、進化型ハイパーパラメータ最適化により 10 倍高速なトレーニングを実現。

    951+5直近 7 日のスター増減
  • GibsonEnv@StanfordVL

    Gibson Environments: 組み込みエージェントのための現実世界の知覚

    947+1直近 7 日のスター増減
  • Shimmy@Farama-Foundation

    PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama

    947直近 7 日のスター増減
  • tdmpc2@nicklashansen

    論文「TD-MPC2: Scalable, Robust World Models for Continuous Control」のコード。

    944+7直近 7 日のスター増減
← トピック一覧に戻る