reinforcement-learning
reinforcement-learning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #211★ 943+6直近 7 日のスター増減
- #212★ 935+17直近 7 日のスター増減
- #213★ 934+2直近 7 日のスター増減
- #214
Multi-Agent Resource Optimization (MARO) プラットフォームは、現実世界の資源最適化問題に対する Reinforcement Learning as a Service (RaaS) のインスタンスです。
★ 923+2直近 7 日のスター増減 - #215
拡散モデルに関する主要な論文やブログのまとめ。公開されているすべての拡散ロボティクス論文の詳細リスト。
★ 920+1直近 7 日のスター増減 - #216★ 918+23直近 7 日のスター増減
- #217
学習ベースの制御と強化学習のためのPyBullet CartPoleおよびQuadrotor環境(CasADiシンボリック事前ダイナミクス付き)
★ 917+4直近 7 日のスター増減 - #218
Decision Transformer リソースのキュレーションリスト(随時更新)
★ 916+0直近 7 日のスター増減 - #219
👉 チュートリアル、ブログ、コードなどのCARLAリソース https://github.com/carla-simulator/carla
★ 915-1直近 7 日のスター増減 - #220★ 905+1直近 7 日のスター増減
- #221
素晴らしいディープ強化学習リソースの厳選リスト。
★ 900+1直近 7 日のスター増減 - #222★ 900+1直近 7 日のスター増減
- #223★ 900+0直近 7 日のスター増減
- #224
Tien Kung-Lab: 脚式ロボット向けのダイレクトなIsaacLabワークフロー
★ 883+11直近 7 日のスター増減 - #225★ 861+2直近 7 日のスター増減
- #226★ 853+3直近 7 日のスター増減
- #227★ 850+0直近 7 日のスター増減
- #228★ 848+3直近 7 日のスター増減
- #229★ 841+0直近 7 日のスター増減
- #230
機械学習、ディープラーニング、生成 AI、NLP、データサイエンスをカバーする、無料かつ高品質な AI ツール、API、データセット、学習リソースの厳選コレクション。開発者、研究者、クリエイターの迅速な AI 探索と開発を支援します。
★ 840+27直近 7 日のスター増減 - #231
コンテキスト・バンディット・アルゴリズムのPython実装
★ 838+0直近 7 日のスター増減 - #232
🚀🚀🚀 大規模言語モデル(LLM)、視覚言語モデル(VLM)、視覚言語行動モデル(VLA)、AI生成コンテンツ(AIGC)、および関連するデータセットやアプリケーションに関する素晴らしい公開プロジェクトのコレクション。
★ 815+1直近 7 日のスター増減 - #233
安全な強化学習のベースラインのためのリポジトリ。
★ 813+0直近 7 日のスター増減 - #234
NVIDIA Isaac Gym の優れたフレームワーク、論文、ソフトウェア、リソースをまとめたキュレーションリスト
★ 797+2直近 7 日のスター増減 - #235
大規模言語モデルのオンポリシー蒸留(OPD)に関する論文、テクニカルレポート、フレームワーク、ツールの厳選コレクション。
★ 791+31直近 7 日のスター増減 - #236
MobileGym: モバイル GUI エージェント研究のための検証可能かつ高度に並列化されたシミュレーションプラットフォーム · ブラウザで動作する Android シミュレータ · Browser-hosted Android Simulator · 検証可能な評価 · スケーラブルなオンライン RL トレーニング
★ 786+10直近 7 日のスター増減 - #237★ 776+15直近 7 日のスター増減
- #238
JuliaでのMDPおよびPOMDP - 離散空間および連続空間における完全・部分観測マルコフ決定プロセスの定義、解決、シミュレーションを行うためのインターフェース
★ 766+1直近 7 日のスター増減 - #239★ 765+1直近 7 日のスター増減
- #240
強化学習のための多目的 Gymnasium 環境
★ 760-1直近 7 日のスター増減