跳到主要內容
buildradar
登入
主題 · reinforcement-learning

reinforcement-learning

標記 reinforcement-learning 主題、收錄中的開源專案,依星數排序。

共 305 個專案
  • ChatGPT 資料彙總學習,持續更新……

    4,190+0近 7 天星數變化
  • acme@google-deepmind

    一個強化學習元件與代理的庫

    4,054+0近 7 天星數變化
  • fsrs4anki@open-spaced-repetition

    基於 Free Spaced Repetition Scheduler 演算法的現代 Anki 自訂排程。

    4,052+0近 7 天星數變化
  • Andrew-NG-Notes@ashishpatel26

    这是 Andrew NG Coursera 手写笔记

    3,808+0近 7 天星數變化
  • polyaxon@polyaxon

    AI Infra / AI Orchestration / AI Control Plane

    3,727+0近 7 天星數變化
  • dreamerv3@danijar

    透過世界模型掌握多領域專業知識

    3,726+0近 7 天星數變化
  • 簡潔且乾淨的強化學習範例

    3,660+0近 7 天星數變化
  • awesome-DeepLearning@PaddlePaddle

    深度學習入門課、資深課、特色課、學術案例、產業實踐案例、深度學習知識百科及面試題庫The course, case and knowledge of Deep Learning and AI

    3,651+0近 7 天星數變化
  • DI-engine@opendilab

    OpenDILab Decision AI Engine。最全面的強化學習框架 B.P.

    3,642+0近 7 天星數變化
  • AlphaZero_Gomoku@junxiaosong

    AlphaZero 演算法在圍棋五子棋(亦稱 Gobang 或 Five in a Row)的實作

    3,627+0近 7 天星數變化
  • Reco-papers@wzhe06

    推薦系統的經典論文與資源

    3,568+0近 7 天星數變化
  • ml-course@girafe-ai

    開源機器學習課程

    3,545+0近 7 天星數變化
  • rl@pytorch

    一個模組化、原始型優先、Python 首先的 PyTorch Reinforcement Learning 函式庫。

    3,545+0近 7 天星數變化
  • rlcard@datamllab

    卡牌遊戲中的強化學習 / AI 機器人:Blackjack、Leduc、Texas、DouDizhu、Mahjong、UNO

    3,541+0近 7 天星數變化
  • PettingZoo@Farama-Foundation

    A standard API for multi-agent reinforcement learning environments, with popular reference environments and related utilities

    3,503+0近 7 天星數變化
  • MetaClaw@aiming-lab

    🦞 只需與你的代理對話——它會學習並進化 🧬

    3,496+0近 7 天星數變化
  • tensorwatch@microsoft

    Python 机器学习与数据科学的调试、监控与可视化

    3,472+0近 7 天星數變化
  • PARL@PaddlePaddle

    高效能分散式訓練框架,用於強化學習

    3,454+0近 7 天星數變化
  • DRL-Pytorch@XinJingHao

    乾淨、穩健且統一的 PyTorch 實作,涵蓋熱門深度強化學習(DRL)演算法(Q-learning、Duel DDQN、PER、C51、Noisy DQN、PPO、DDPG、TD3、SAC、ASL)

    3,440+0近 7 天星數變化
  • catalyst@catalyst-team

    加速深度學習研發

    3,382+0近 7 天星數變化
  • tensorforce@tensorforce

    Tensorforce:用於應用強化學習的 TensorFlow 函式庫

    3,305+0近 7 天星數變化
  • HighwayEnv@Farama-Foundation

    一系列自動駕駛與戰術決策任務的環境集合。

    3,302+0近 7 天星數變化
  • ManiSkill@mani-skill

    Manipulation Skill Framework,一個開源的 GPU 平行化機器人模擬器與基準測試

    3,283+0近 7 天星數變化
  • brax@google

    在加速器硬體上進行大規模並行剛體物理模擬。

    3,227+0近 7 天星數變化
  • 精心策划的數據科學資源鏈接集合

    3,222+0近 7 天星數變化
  • Skywork-R1V@SkyworkAI

    Skywork-R1V 是 Skywork AI 開發的先進多模態 AI 模型系列,專注於視覺-語言推理

    3,168+0近 7 天星數變化
  • OSWorld@xlang-ai

    [NeurIPS 2024] OSWorld:在真實電腦環境中評測開放式任務的多模態 Agent。

    3,118+0近 7 天星數變化
  • habitat-lab@facebookresearch

    一個模組化的高階函式庫,用於在多種任務與環境中訓練具身 AI 代理。

    3,117+0近 7 天星數變化
  • 包含視訊課程的優質免費機器學習與 AI 課程。

    3,112+0近 7 天星數變化
  • TradeMaster@TradeMaster-NTU

    TradeMaster 是一個由強化學習賦能的開源量化交易平台 :fire: :zap: :rainbow:

    3,056+0近 7 天星數變化
← 返回主題列表