reinforcement-learning
reinforcement-learning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
reinforcement-learning と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、reinforcement-learning がタグ付けされたリポジトリ。
- #1
AI エージェントがワークフローのループを通じてタスクを完了し、反復実行によって自己改善を行い、メンターエージェントや人間のフィードバックによって評価され、完了した作業を再利用可能な作業経験やデータに変換して将来のエージェントの改善に活かすための活きたエコシステム。
★ 1,334 - #2★ 921
- #3
Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.
★ 160 - #4
🎬 OraRL — Annotations as Rollouts for efficient, scalable reinforcement learning of unified video MLLMs.
★ 151
- #1
ビデオ講義付きのコンピュータサイエンスコース一覧。
★ 83,226+81直近 7 日のスター増減 - #2
Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、DeepSeek-V4、FLUXなどを含むLLMおよび拡散モデルを実行・学習するためのローカルUI。
★ 75,178+887直近 7 日のスター増減 - #3
🧑🏫 60以上のディープラーニング論文の実装/チュートリアルと、並行ノート 📝。トランスフォーマー(original, xl, switch, feedback, vit, ...)、オプティマイザ(adam, adabelief, sophia, ...)、GANs(cyclegan, stylegan2, ...)、🎮強化学習(ppo, dqn)、capsnet、蒸留(distillation, ...)など🧠
★ 67,368+38直近 7 日のスター増減 - #4
学び、構築し、他者のためにリリースする。
★ 50,949+3,384直近 7 日のスター増減 - #5★ 43,647+70直近 7 日のスター増減
- #6
《深入理解 AI Agent:设计原理与工程实践》(李博杰 著)オープンソースメインリポジトリ:全書本文、コンパイル版PDF、および章ごとの対応コード。
★ 43,359+2,617直近 7 日のスター増減 - #7★ 32,747+503直近 7 日のスター増減
- #8
📚 データサイエンスおよび機械学習を本番環境で利用する際の企業の論文や技術ブログ。
★ 30,097+26直近 7 日のスター増減 - #9
マルチフレームワークのコード、数学、ディスカッションを伴うインタラクティブな深層学習ブック。Stanford、MIT、Harvard、Cambridgeを含む70カ国から500の大学で採用されています。
★ 29,482+71直近 7 日のスター増減 - #10★ 21,184+55直近 7 日のスター増減
- #11
トレーディングのための機械学習コード、第3版 — データソースの確保からライブ実行まで。
★ 20,719+149直近 7 日のスター増減 - #12
Unity Machine Learning Agents Toolkit (ML-Agents) は、深層強化学習と模倣学習を用いてインテリジェントエージェントを訓練するための環境としてゲームやシミュレーションを利用可能にするオープンソースプロジェクトです。
★ 19,653+8直近 7 日のスター増減 - #13
AIエージェントを輝かせるための究極のトレーナー。
★ 17,903+304直近 7 日のスター増減 - #14
これは「Mathematical Foundations of Reinforcement Learning.」という新しい書籍のホームページです。
★ 17,610+88直近 7 日のスター増減 - #15
《李宏毅深度学习教程》(李宏毅先生推奨👍、Apple Books🍎)、PDFダウンロードアドレス:https://github.com/datawhalechina/leedl-tutorial/releases
★ 16,739+14直近 7 日のスター増減 - #16
人工知能 (AI) のコース、書籍、ビデオ講義、論文の厳選リスト。
★ 16,262+288直近 7 日のスター増減 - #17
強化学習のPython実装:入門
★ 14,758+7直近 7 日のスター増減 - #18
Bullet Physics SDK:VR、ゲーム、視覚効果、ロボティクス、機械学習など向けのリアルタイム衝突検出およびマルチフィジックスシミュレーション。
★ 14,704+19直近 7 日のスター増減 - #19★ 14,592+28直近 7 日のスター増減
- #20
PyTorch版のStable Baselines。強化学習アルゴリズムの信頼性の高い実装を提供。
★ 13,737+20直近 7 日のスター増減 - #21
これらの刺激的な講義を通じて、Deep Learning、Reinforcement Learning、Machine Learning、Computer Vision、NLPにどっぷり浸りましょう!!
★ 12,936+5直近 7 日のスター増減 - #22★ 12,430+65直近 7 日のスター増減
- #23★ 11,245+9直近 7 日のスター増減
- #24
例 📓 Amazon SageMaker を使用して機械学習モデルを構築、トレーニング、デプロイする方法を示す Jupyter ノートブック。
★ 10,981+2直近 7 日のスター増減 - #25
Agent Reinforcement Trainer: GRPOを用いた実世界タスク向けマルチステップエージェントの訓練。エージェントに現場トレーニングを提供。Qwen3.6、GPT-OSS、Llamaなどに対応した強化学習!
★ 10,679+57直近 7 日のスター増減 - #26★ 10,339+36直近 7 日のスター増減
- #27
Rayベースの使いやすいスケーラブルで高性能なエージェンティックRLフレームワーク (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)
★ 9,960+19直近 7 日のスター増減 - #28
シンプルな強化学習チュートリアル、莫烦Python 中文AI教学
★ 9,510+7直近 7 日のスター増減 - #29
機械学習の例とチュートリアルのコレクション。
★ 8,916+5直近 7 日のスター増減 - #30★ 8,888+91直近 7 日のスター増減