メインコンテンツへスキップ
buildradar
Sign in
トピック · reinforcement-learning

reinforcement-learning

reinforcement-learning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

305 件のリポジトリ
  • ChatGPTの資料まとめ学習、継続的な更新...

    4,190+1直近 7 日のスター増減
  • acme@google-deepmind

    強化学習コンポーネントおよびエージェントのライブラリ

    4,054+2直近 7 日のスター増減
  • fsrs4anki@open-spaced-repetition

    Free Spaced Repetition Schedulerアルゴリズムに基づいたモダンなAnkiカスタムスケジューリング

    4,052+1直近 7 日のスター増減
  • Andrew-NG-Notes@ashishpatel26

    これはAndrew NGによるCourseraの手書きノートです。

    3,808+6直近 7 日のスター増減
  • polyaxon@polyaxon

    AIインフラ / AIオーケストレーション / AIコントロールプレーン

    3,727+0直近 7 日のスター増減
  • dreamerv3@danijar

    ワールドモデルを通じた多様なドメインのマスター

    3,726+12直近 7 日のスター増減
  • 最小限でクリーンな強化学習のサンプル

    3,660+0直近 7 日のスター増減
  • awesome-DeepLearning@PaddlePaddle

    ディープラーニングの入門・上級・特色コース、学術・産業実践事例、知識百科、面接問題集

    3,651+2直近 7 日のスター増減
  • DI-engine@opendilab

    OpenDILab決定AIエンジン。最も包括的な強化学習フレームワーク。

    3,642+1直近 7 日のスター増減
  • AlphaZero_Gomoku@junxiaosong

    五目並べのためのAlphaZeroアルゴリズムの実装

    3,627+2直近 7 日のスター増減
  • Reco-papers@wzhe06

    推薦システムに関する古典的な論文とリソース

    3,568+1直近 7 日のスター増減
  • ml-course@girafe-ai

    オープン機械学習コース

    3,545+4直近 7 日のスター増減
  • rl@pytorch

    強化学習のための、モジュール式でプリミティブ中心の Python ファーストな PyTorch ライブラリ

    3,545+5直近 7 日のスター増減
  • rlcard@datamllab

    カード(ポーカー)ゲームにおける強化学習/AIボット - ブラックジャック、Leduc、テキサスホールデム、闘地主、麻雀、UNO

    3,541+0直近 7 日のスター増減
  • PettingZoo@Farama-Foundation

    マルチエージェント強化学習環境のための標準API。一般的なリファレンス環境および関連ユーティリティを含む。

    3,503+4直近 7 日のスター増減
  • MetaClaw@aiming-lab

    🦞 エージェントに話しかけるだけで、学習して進化します 🧬

    3,496-1直近 7 日のスター増減
  • tensorwatch@microsoft

    Pythonの機械学習およびデータサイエンス向けデバッグ、モニタリング、可視化ツール

    3,472+1直近 7 日のスター増減
  • PARL@PaddlePaddle

    強化学習のための高性能分散学習フレームワーク

    3,454+1直近 7 日のスター増減
  • DRL-Pytorch@XinJingHao

    主要な深層強化学習(DRL)アルゴリズムのクリーン、堅牢、かつ統一された PyTorch 実装(Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)

    3,440+3直近 7 日のスター増減
  • catalyst@catalyst-team

    高速化されたディープラーニングの研究開発

    3,382+0直近 7 日のスター増減
  • tensorforce@tensorforce

    Tensorforce: 応用強化学習のためのTensorFlowライブラリ

    3,305+0直近 7 日のスター増減
  • HighwayEnv@Farama-Foundation

    自動運転および戦術的意思決定タスク向けの環境コレクション

    3,302+3直近 7 日のスター増減
  • ManiSkill@mani-skill

    操作スキルフレームワーク:オープンソースの GPU 並列化ロボットシミュレータおよびベンチマーク

    3,283+13直近 7 日のスター増減
  • brax@google

    アクセラレータハードウェア上の超並列リジッドボディ物理シミュレーション

    3,227+1直近 7 日のスター増減
  • データサイエンスに関する厳選されたリソースリンク集

    3,222+1直近 7 日のスター増減
  • Skywork-R1V@SkyworkAI

    Skywork-R1V は Skywork AI が開発した高度なマルチモーダル AI モデルシリーズで、視覚と言語の推論を専門としています。

    3,168+0直近 7 日のスター増減
  • OSWorld@xlang-ai

    [NeurIPS 2024] OSWorld: 実コンピュータ環境におけるオープンエンドなタスクのためのマルチモーダルエージェントのベンチマーク

    3,118+6直近 7 日のスター増減
  • habitat-lab@facebookresearch

    多様なタスクや環境でembodied AIエージェントを訓練するためのモジュール式高水準ライブラリ。

    3,117+6直近 7 日のスター増減
  • ビデオ講義付きの無料の機械学習・AIコース集

    3,112+0直近 7 日のスター増減
  • TradeMaster@TradeMaster-NTU

    TradeMaster は、強化学習を活用した量的取引のためのオープンソースプラットフォームです :fire: :zap: :rainbow:

    3,056+2直近 7 日のスター増減
← トピック一覧に戻る