メインコンテンツへスキップ
buildradar
Sign in
トピック · reinforcement-learning

reinforcement-learning

reinforcement-learning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
300
総スター数
1,279,586
平均スター数
4,265
シェア
0.07%

reinforcement-learning と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、reinforcement-learning がタグ付けされたリポジトリ。

  • agent-apprenticeship@ray-r-ren

    AI エージェントがワークフローのループを通じてタスクを完了し、反復実行によって自己改善を行い、メンターエージェントや人間のフィードバックによって評価され、完了した作業を再利用可能な作業経験やデータに変換して将来のエージェントの改善に活かすための活きたエコシステム。

    1,334
  • UniRL@Tencent-Hunyuan

    UniRL は、統合マルチモーダルモデルの強化学習用フレームワークです

    921
  • EvoTrace@jinzijian

    Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.

    160
  • OraRL@HVision-NKU

    🎬 OraRL — Annotations as Rollouts for efficient, scalable reinforcement learning of unified video MLLMs.

    151
  • ビデオ講義付きのコンピュータサイエンスコース一覧。

    83,226+81直近 7 日のスター増減
  • unsloth@unslothai

    Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、DeepSeek-V4、FLUXなどを含むLLMおよび拡散モデルを実行・学習するためのローカルUI。

    75,178+887直近 7 日のスター増減
  • 🧑‍🏫 60以上のディープラーニング論文の実装/チュートリアルと、並行ノート 📝。トランスフォーマー(original, xl, switch, feedback, vit, ...)、オプティマイザ(adam, adabelief, sophia, ...)、GANs(cyclegan, stylegan2, ...)、🎮強化学習(ppo, dqn)、capsnet、蒸留(distillation, ...)など🧠

    67,368+38直近 7 日のスター増減
  • 学び、構築し、他者のためにリリースする。

    50,949+3,384直近 7 日のスター増減
  • ray@ray-project

    RayはAIコンピューティングエンジンです。Rayは、コアとなる分散ランタイムと、MLワークロードを高速化するためのAIライブラリ群で構成されています。

    43,647+70直近 7 日のスター増減
  • ai-agent-book@bojieli

    《深入理解 AI Agent:设计原理与工程实践》(李博杰 著)オープンソースメインリポジトリ:全書本文、コンパイル版PDF、および章ごとの対応コード。

    43,359+2,617直近 7 日のスター増減
  • sglang@sgl-project

    SGLangは、大規模言語モデルおよびマルチモーダルモデル向けの高性能サービングフレームワークです。

    32,747+503直近 7 日のスター増減
  • applied-ml@eugeneyan

    📚 データサイエンスおよび機械学習を本番環境で利用する際の企業の論文や技術ブログ。

    30,097+26直近 7 日のスター増減
  • d2l-en@d2l-ai

    マルチフレームワークのコード、数学、ディスカッションを伴うインタラクティブな深層学習ブック。Stanford、MIT、Harvard、Cambridgeを含む70カ国から500の大学で採用されています。

    29,482+71直近 7 日のスター増減
  • FinGPT@AI4Finance-Foundation

    FinGPT: オープンソースの金融大規模言語モデル!革新をもたらします🔥 学習済みモデルをHuggingFaceで公開。

    21,184+55直近 7 日のスター増減
  • machine-learning-for-trading@stefan-jansen

    トレーディングのための機械学習コード、第3版 — データソースの確保からライブ実行まで。

    20,719+149直近 7 日のスター増減
  • ml-agents@Unity-Technologies

    Unity Machine Learning Agents Toolkit (ML-Agents) は、深層強化学習と模倣学習を用いてインテリジェントエージェントを訓練するための環境としてゲームやシミュレーションを利用可能にするオープンソースプロジェクトです。

    19,653+8直近 7 日のスター増減
  • agent-lightning@microsoft

    AIエージェントを輝かせるための究極のトレーナー。

    17,903+304直近 7 日のスター増減
  • これは「Mathematical Foundations of Reinforcement Learning.」という新しい書籍のホームページです。

    17,610+88直近 7 日のスター増減
  • leedl-tutorial@datawhalechina

    《李宏毅深度学习教程》(李宏毅先生推奨👍、Apple Books🍎)、PDFダウンロードアドレス:https://github.com/datawhalechina/leedl-tutorial/releases

    16,739+14直近 7 日のスター増減
  • 人工知能 (AI) のコース、書籍、ビデオ講義、論文の厳選リスト。

    16,262+288直近 7 日のスター増減
  • 強化学習のPython実装:入門

    14,758+7直近 7 日のスター増減
  • bullet3@bulletphysics

    Bullet Physics SDK:VR、ゲーム、視覚効果、ロボティクス、機械学習など向けのリアルタイム衝突検出およびマルチフィジックスシミュレーション。

    14,704+19直近 7 日のスター増減
  • easy-rl@datawhalechina

    強化学習の中国語チュートリアル(蘑菇书🍄)、オンライン閲覧アドレス:https://datawhalechina.github.io/easy-rl/

    14,592+28直近 7 日のスター増減
  • PyTorch版のStable Baselines。強化学習アルゴリズムの信頼性の高い実装を提供。

    13,737+20直近 7 日のスター増減
  • これらの刺激的な講義を通じて、Deep Learning、Reinforcement Learning、Machine Learning、Computer Vision、NLPにどっぷり浸りましょう!!

    12,936+5直近 7 日のスター増減
  • Gymnasium@Farama-Foundation

    単一エージェント強化学習環境のための標準API。人気の参照環境や関連ユーティリティを含む(旧Gym)

    12,430+65直近 7 日のスター増減
  • wandb@wandb

    AI開発者プラットフォーム。Weights & Biasesを使用してモデルのトレーニングとファインチューニングを行い、実験から本番環境までのモデル管理を行う。

    11,245+9直近 7 日のスター増減
  • amazon-sagemaker-examples@aws

    例 📓 Amazon SageMaker を使用して機械学習モデルを構築、トレーニング、デプロイする方法を示す Jupyter ノートブック。

    10,981+2直近 7 日のスター増減
  • ART@OpenPipe

    Agent Reinforcement Trainer: GRPOを用いた実世界タスク向けマルチステップエージェントの訓練。エージェントに現場トレーニングを提供。Qwen3.6、GPT-OSS、Llamaなどに対応した強化学習!

    10,679+57直近 7 日のスター増減
  • cleanrl@vwxyzjn

    研究フレンドリーな機能(PPO, DQN, C51, DDPG, TD3, SAC, PPG)を備えた、高品質な単一ファイルでの深層強化学習アルゴリズムの実装。

    10,339+36直近 7 日のスター増減
  • OpenRLHF@OpenRLHF

    Rayベースの使いやすいスケーラブルで高性能なエージェンティックRLフレームワーク (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)

    9,960+19直近 7 日のスター増減
  • シンプルな強化学習チュートリアル、莫烦Python 中文AI教学

    9,510+7直近 7 日のスター増減
  • machine_learning_examples@lazyprogrammer

    機械学習の例とチュートリアルのコレクション。

    8,916+5直近 7 日のスター増減
  • Sana@NVlabs

    SANA:Linear Diffusion Transformerによる効率的な高解像度画像合成

    8,888+91直近 7 日のスター増減
← トピック一覧に戻る