rl
rl がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
rl と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、rl がタグ付けされたリポジトリ。
直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。
- #1
Llama中国コミュニティ。最新のLlama学習資料をリアルタイムで集約し、完全オープンソースで商用利用可能な最高の中国語Llama大規模モデルエコシステムを構築。
★ 14,740+1直近 7 日のスター増減 - #2★ 10,945+11直近 7 日のスター増減
- #3★ 10,901+4直近 7 日のスター増減
- #4
Agent Reinforcement Trainer: GRPOを用いた実世界タスク向けマルチステップエージェントの訓練。エージェントに現場トレーニングを提供。Qwen3.6、GPT-OSS、Llamaなどに対応した強化学習!
★ 10,679+57直近 7 日のスター増減 - #5★ 5,703+19直近 7 日のスター増減
- #6★ 5,136+10直近 7 日のスター増減
- #7
🚀 基本的なRLの概念からLLMアライメント、RLVR、高度なエージェンティックシステムへのギャップを埋めるオープンソースの実践的カリキュラム
★ 4,145+94直近 7 日のスター増減 - #8
agent-sandbox は、分離されたステートフルなシングルトンワークロードの簡単な管理を可能にし、AI エージェントランタイムや強化学習(RL)などのユースケースに最適です。
★ 3,678+92直近 7 日のスター増減 - #9
五目並べのためのAlphaZeroアルゴリズムの実装
★ 3,625+2直近 7 日のスター増減 - #10★ 3,540+12直近 7 日のスター増減
- #11
Stable Baselines3 強化学習エージェントのためのトレーニングフレームワーク。ハイパーパラメータ最適化と事前トレーニング済みエージェントが含まれています。
★ 2,872+3直近 7 日のスター増減 - #12
100行のコードによる論文の実装
★ 2,867+8直近 7 日のスター増減 - #13
MuZero
★ 2,863+4直近 7 日のスター増減 - #14
大規模推論モデルのための強化学習サーベイ
★ 2,481+2直近 7 日のスター増減 - #15
強化学習アルゴリズムをよりシンプルに実装
★ 1,922+7直近 7 日のスター増減 - #16★ 1,872+3直近 7 日のスター増減
- #17
[ICLR 2026] SimpleVLA-RL: 強化学習による VLA トレーニングのスケーリング
★ 1,839+9直近 7 日のスター増減 - #18
System-2 推論に関する最新の進展
★ 1,353+1直近 7 日のスター増減 - #19
R1-Zero-Likeトレーニングの理解:批判的視点
★ 1,274+1直近 7 日のスター増減 - #20
🎓 LLM(大規模言語モデル)構築の体系的カリキュラム|🛠️ 事前学習データエンジニアリング、Tokenizer、Transformer、MoE、GPUプログラミング(CUDA/Triton)、分散学習、スケーリング則、推論最適化、アライメント(SFT/RLHF/GRPO)を網羅|🚀 6つの段階的な課題とコード駆動により、LLMのフルスタックな認知体系を構築
★ 1,260+22直近 7 日のスター増減 - #21★ 1,121+5直近 7 日のスター増減
- #22★ 1,111+3直近 7 日のスター増減
- #23★ 1,080+8直近 7 日のスター増減
- #24★ 1,058+1直近 7 日のスター増減
- #25
Tensorlakeは、サンドボックスおよびバックグラウンドエージェントアプリケーションのデプロイメントのためのサーバーレスランタイムです
★ 995+1直近 7 日のスター増減 - #26
AIネイティブなリスクインテリジェンスシステム「OpenDeRisk」——アプリケーションシステムの24時間365日の包括的かつ詳細な保護を提供するリスクインテリジェントマネージャー
★ 968+3直近 7 日のスター増減 - #27
強化学習用の Python ライブラリ
★ 944+1直近 7 日のスター増減 - #28
「AI-Compass」は、AI 技術の海原を航海するための指針をコミュニティに提供します。初心者から上級開発者まで、AI のあらゆる分野への道を見つけることができます。開発者が AI のコアコンセプト、主要技術、最新トレンドを体系的に理解し、実践を通じて理論から実装までの全プロセスを習得することを目的としています。
★ 926+12直近 7 日のスター増減 - #29
sim-to-realおよび強化学習(RL)向けの3Dプリント製オープンソースヒューマノイドロボットプラットフォーム
★ 820+1直近 7 日のスター増減 - #30
MobileGym: モバイル GUI エージェント研究のための検証可能かつ高度に並列化されたシミュレーションプラットフォーム · ブラウザで動作する Android シミュレータ · Browser-hosted Android Simulator · 検証可能な評価 · スケーラブルなオンライン RL トレーニング
★ 777+10直近 7 日のスター増減