メインコンテンツへスキップ
buildradar
Sign in
トピック · reinforcement-learning

reinforcement-learning

reinforcement-learning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

305 件のリポジトリ
  • Rainbow is all you need! DQNからRainbowまでのステップバイステップチュートリアル

    2,032+0直近 7 日のスター増減
  • AgentFlow@lupantech

    AgentFlow: インフロー型のエージェントシステム最適化

    2,025+0直近 7 日のスター増減
  • Packt から出版された Advanced Deep Learning with Keras

    2,023+0直近 7 日のスター増減
  • Nemotron@NVIDIA-NeMo

    NVIDIA Nemotron 向け開発者アセットハブ — Nemotron モデルを使用した構築のための、トレーニングレシピ、使用法クックブック、データセット、完全なエンドツーエンドの参照例が集まったワンストップリソース

    2,015+0直近 7 日のスター増減
  • 🚀 無料の AI リソース - 誰でも利用できる 🎓 コース、👷 求人、📝 ブログ、🔬 AI 研究など多数!

    1,975+0直近 7 日のスター増減
  • PhySO@WassimTenachi

    物理記号最適化

    1,972+0直近 7 日のスター増減
  • all-rl-algorithms@FareedKhan-dev

    強化学習アルゴリズムをよりシンプルに実装

    1,929+0直近 7 日のスター増減
  • TradingGym@Yvictor

    強化学習エージェントのトレーニングやシンプルなルールベースのアルゴリズムのための、トレーディングおよびバックテスト環境

    1,915+0直近 7 日のスター増減
  • RoboVerse@RoboVerseOrg

    RoboVerse:スケーラブルで汎用的なロボット学習に向けた、統合プラットフォーム、データセット、ベンチマーク

    1,851+0直近 7 日のスター増減
  • awesome-AI-books@zslucky

    学習とダウンロード用の優れた AI 関連書籍や PDF のまとめ。学習用のプレイグラウンドモデルも提供

    1,799+0直近 7 日のスター増減
  • snake@chynl

    AI でスネークゲームをプレイする。

    1,789+0直近 7 日のスター増減
  • tnt@meta-pytorch

    PyTorch のトレーニングツールとユーティリティのための軽量ライブラリ

    1,722+0直近 7 日のスター増減
  • agibot_x1_train@AgibotTech

    AgiBot X1の強化学習トレーニングコード

    1,698+0直近 7 日のスター増減
  • bindsnet@BindsNET

    PyTorchを使用したスパイキングニューラルネットワーク(SNN)のシミュレーション。

    1,695+0直近 7 日のスター増減
  • deep-neuroevolution@uber-research

    ディープニューロエボリューション

    1,666+0直近 7 日のスター増減
  • LightZero@opendilab

    [NeurIPS 2023 Spotlight] LightZero: 一般的な逐次決定シナリオにおけるモンテカルロ木探索の統合ベンチマーク(優れた MCTS)

    1,642+0直近 7 日のスター増減
  • safe-rlhf@PKU-Alignment

    Safe RLHF: 人間からのフィードバックによる安全な強化学習を通じた制約付き価値アライメント

    1,613+0直近 7 日のスター増減
  • NavRL@Zhefan-Xu

    [IEEE RA-L'25] NavRL: 動的環境における安全な飛行の学習 (NVIDIA Isaac/Python/ROS1/ROS2)

    1,599+0直近 7 日のスター増減
  • godot_rl_agents@edbeeching

    ビデオゲーム制作会社、AI 研究者、趣味の開発者が NPC やエージェントの複雑な行動を学習させることができるオープンソースパッケージ

    1,578+0直近 7 日のスター増減
  • hands-on-rl@Paulescu

    ゼロから強化学習プロへと導く無料コース 🦸🏻‍🦸🏽

    1,570+0直近 7 日のスター増減
  • AgentEvolver@modelscope

    AgentEvolver: 効率的な自己進化型エージェントシステムに向けて

    1,552+0直近 7 日のスター増減
  • Mortal@Equim-chan

    🚀🀄️ Rust と深層強化学習を活用した、高速で強力な麻雀 AI

    1,539+0直近 7 日のスター増減
  • ai_all_resources@nivu

    厳選された人工知能のベストリソースリスト

    1,522+0直近 7 日のスター増減
  • awesome-deep-rl@tigerneil

    深層強化学習とAIの未来に向けて

    1,513+0直近 7 日のスター増減
  • envpool@sail-sg

    汎用 RL 環境向けの C++ ベースの高性能並列環境実行エンジン(ベクター化環境)。

    1,513+0直近 7 日のスター増減
  • reasoning-gym@open-thought

    [NeurIPS 2025 Spotlight] 検証可能な報酬を用いた強化学習のための推論環境

    1,500+0直近 7 日のスター増減
  • ロボット開発に役立つ素晴らしいリンクやソフトウェアライブラリの厳選リスト

    1,483+0直近 7 日のスター増減
  • tensor-house@ikatsov

    マーケティング、価格設定、サプライチェーン、スマート製造などのエンタープライズ向けユースケースに対応する、Jupyter notebookの参考資料とデモAI/MLアプリケーションのコレクション

    1,453+0直近 7 日のスター増減
  • TextWorld@microsoft

    TextWorld は、テキストベースのゲームにおける強化学習(RL)エージェントの訓練と評価のためのサンドボックス学習環境です

    1,442+0直近 7 日のスター増減
  • walk-these-ways@Improbable-AI

    Unitree Go1 ロボット向けの Sim-to-real 強化学習のトレーニングおよびデプロイツール

    1,440+0直近 7 日のスター増減
← トピック一覧に戻る