メインコンテンツへスキップ
buildradar
Sign in
トピック · reinforcement-learning

reinforcement-learning

reinforcement-learning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

304 件のリポジトリ
  • tdmpc2@nicklashansen

    論文「TD-MPC2: Scalable, Robust World Models for Continuous Control」のコード。

    943+6直近 7 日のスター増減
  • UniRL@Tencent-Hunyuan

    UniRL は、統合マルチモーダルモデルの強化学習用フレームワークです

    935+17直近 7 日のスター増減
  • Mava@instadeepai

    🦁 JAXにおけるマルチエージェント強化学習の迅速な実験を可能にする、研究者向けのコードベース

    934+2直近 7 日のスター増減
  • maro@microsoft

    Multi-Agent Resource Optimization (MARO) プラットフォームは、現実世界の資源最適化問題に対する Reinforcement Learning as a Service (RaaS) のインスタンスです。

    923+2直近 7 日のスター増減
  • 拡散モデルに関する主要な論文やブログのまとめ。公開されているすべての拡散ロボティクス論文の詳細リスト。

    920+1直近 7 日のスター増減
  • UniLab@Motphys

    UniLab: GPU優位のパラダイムを超えたロボットRLのための異種混合アーキテクチャ

    918+23直近 7 日のスター増減
  • safe-control-gym@learnsyslab

    学習ベースの制御と強化学習のためのPyBullet CartPoleおよびQuadrotor環境(CasADiシンボリック事前ダイナミクス付き)

    917+4直近 7 日のスター増減
  • Decision Transformer リソースのキュレーションリスト(随時更新)

    916+0直近 7 日のスター増減
  • 👉 チュートリアル、ブログ、コードなどのCARLAリソース https://github.com/carla-simulator/carla

    915-1直近 7 日のスター増減
  • hok_env@tencent-ailab

    テンセントの王者荣耀 (Honor of Kings) AI オープン環境

    905+1直近 7 日のスター増減
  • 素晴らしいディープ強化学習リソースの厳選リスト。

    900+1直近 7 日のスター増減
  • rl4co@ai4co

    組み合わせ最適化(CO)のための強化学習(RL)全般を扱うPyTorchライブラリ

    900+1直近 7 日のスター増減
  • iris@eloialonso

    Transformersはサンプル効率の高いワールドモデルです。ICLR 2023上位5%の注目論文。

    900+0直近 7 日のスター増減
  • TienKung-Lab@Open-X-Humanoid

    Tien Kung-Lab: 脚式ロボット向けのダイレクトなIsaacLabワークフロー

    883+11直近 7 日のスター増減
  • jumanji@instadeepai

    🕹️ JAX製の拡張性に優れた多様な強化学習環境スイート

    861+2直近 7 日のスター増減
  • REINVENT4@MolecularAI

    デノボデザイン、スキャフォールドホッピング、R グループ置換、リンカーデザイン、分子最適化のための AI 分子設計ツール

    853+3直近 7 日のスター増減
  • humanplus@MarkFzp

    [CoRL 2024] HumanPlus: ヒューマノイドのシャドーイングと人間からの模倣

    850+0直近 7 日のスター増減
  • JaxMARL@bold-lab-ai

    JAXを使用したマルチエージェント強化学習

    848+3直近 7 日のスター増減
  • openrl@OpenRL-Lab

    統合強化学習フレームワーク

    841+0直近 7 日のスター増減
  • 機械学習、ディープラーニング、生成 AI、NLP、データサイエンスをカバーする、無料かつ高品質な AI ツール、API、データセット、学習リソースの厳選コレクション。開発者、研究者、クリエイターの迅速な AI 探索と開発を支援します。

    840+27直近 7 日のスター増減
  • contextualbandits@david-cortes

    コンテキスト・バンディット・アルゴリズムのPython実装

    838+0直近 7 日のスター増減
  • 🚀🚀🚀 大規模言語モデル(LLM)、視覚言語モデル(VLM)、視覚言語行動モデル(VLA)、AI生成コンテンツ(AIGC)、および関連するデータセットやアプリケーションに関する素晴らしい公開プロジェクトのコレクション。

    815+1直近 7 日のスター増減
  • 安全な強化学習のベースラインのためのリポジトリ。

    813+0直近 7 日のスター増減
  • awesome-isaac-gym@robotlearning123

    NVIDIA Isaac Gym の優れたフレームワーク、論文、ソフトウェア、リソースをまとめたキュレーションリスト

    797+2直近 7 日のスター増減
  • 大規模言語モデルのオンポリシー蒸留(OPD)に関する論文、テクニカルレポート、フレームワーク、ツールの厳選コレクション。

    791+31直近 7 日のスター増減
  • mobilegym@Purewhiter

    MobileGym: モバイル GUI エージェント研究のための検証可能かつ高度に並列化されたシミュレーションプラットフォーム · ブラウザで動作する Android シミュレータ · Browser-hosted Android Simulator · 検証可能な評価 · スケーラブルなオンライン RL トレーニング

    786+10直近 7 日のスター増減
  • BFM-Zero@LeCAR-Lab

    BFM_Zero: 教師なし強化学習を用いた人型ロボット制御のためのプロンプト可能な行動基礎モデル

    776+15直近 7 日のスター増減
  • POMDPs.jl@JuliaPOMDP

    JuliaでのMDPおよびPOMDP - 離散空間および連続空間における完全・部分観測マルコフ決定プロセスの定義、解決、シミュレーションを行うためのインターフェース

    766+1直近 7 日のスター増減
  • panda-gym@qgallouedec

    PyBullet物理エンジンとgymnasiumベースのロボット環境セット

    765+1直近 7 日のスター増減
  • MO-Gymnasium@Farama-Foundation

    強化学習のための多目的 Gymnasium 環境

    760-1直近 7 日のスター増減
← トピック一覧に戻る