跳到主要內容
buildradar
Sign in
主題 · reinforcement-learning

reinforcement-learning

標記 reinforcement-learning 主題、收錄中的開源專案,依星數排序。

專案數
305
總星數
1,292,198
平均星數
4,237
佔比
0.07%

常跟 reinforcement-learning 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 reinforcement-learning 主題的專案。

  • agent-apprenticeship@ray-r-ren

    一個充滿活力的生態系統,在此系統中 AI agent 透過工作流程迴圈完成任務、藉由迭代執行來改進、透過導師 agent 或人工介入進行評估,並將已完成的工作轉化為可重複使用的工作經驗與資料,以提升未來的 agent。

    1,334
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    875
  • 人形机器人运动智能论文、开源项目、产业与求职知识库

    509
  • EvoTrace@jinzijian

    Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.

    160
  • OraRL@HVision-NKU

    🎬 OraRL — Annotations as Rollouts for efficient, scalable reinforcement learning of unified video MLLMs.

    152
  • 電腦科學課程與影片講座列表

    83,389+163近 7 天星數變化
  • unsloth@unslothai

    本機 UI,用於執行與訓練 LLM 與擴散模型,支援 Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、DeepSeek-V4、FLUX 等多種模型

    75,515+337近 7 天星數變化
  • 🧑‍🏫 60+ 深度學習論文實作與教學,附並排筆記 📝;包括 transformers(原版、xl、switch、feedback、vit 等)、optimizers(adam、adabelief、sophia 等)、GAN(cyclegan、stylegan2 等)、🎮 強化學習(ppo、dqn)、capsnet、蒸餾等 🧠

    67,389+21近 7 天星數變化
  • 學會它。打造它。交付給他人。

    52,098+1,149近 7 天星數變化
  • ai-agent-book@bojieli

    《深入理解 AI Agent:設計原理與工程實踐》(李博杰 著)開源主倉庫:全書正文、編譯版 PDF 與按章配套程式碼

    44,381+1,022近 7 天星數變化
  • ray@ray-project

    Ray 是一個 AI 計算引擎,包含核心分散式執行環境與加速機器學習工作負載的 AI 函式庫套件

    43,688+41近 7 天星數變化
  • sglang@sgl-project

    SGLang 是針對大型語言模型與多模態模型的高效能服務框架

    33,538+791近 7 天星數變化
  • applied-ml@eugeneyan

    📚 企業分享的資料科學與機器學習實務論文與技術部落格。

    30,107+10近 7 天星數變化
  • d2l-en@d2l-ai

    互動式深度學習書籍,包含多框架程式碼、數學與討論。已在 70 個國家 500 所大學採用,包括 Stanford、MIT、Harvard 與 Cambridge。

    29,512+30近 7 天星數變化
  • FinGPT@AI4Finance-Foundation

    FinGPT:開源金融大型語言模型! 革新 🔥 我們在 HuggingFace 上發布了訓練好的模型。

    21,201+17近 7 天星數變化
  • machine-learning-for-trading@stefan-jansen

    機器學習交易程式碼,第 3 版——從資料取得到即時執行

    20,762+43近 7 天星數變化
  • ml-agents@Unity-Technologies

    Unity 機器學習代理工具包(ML‑Agents)是一個開源專案,讓遊戲與模擬環境可用於透過深度強化學習與模仿學習訓練智慧代理。

    19,655+2近 7 天星數變化
  • agent-lightning@microsoft

    點亮 AI 代理的絕佳訓練器。

    17,959+56近 7 天星數變化
  • 這是新書《強化學習的數學基礎》的首頁

    17,663+53近 7 天星數變化
  • leedl-tutorial@datawhalechina

    《李宏毅深度學習教程》(李宏毅老師推薦👍,蘋果書🍎),PDF 下載地址:https://github.com/datawhalechina/leedl-tutorial/releases

    16,747+8近 7 天星數變化
  • 精選的人工智慧 (AI) 課程、書籍、影片講座與論文清單。

    16,306+44近 7 天星數變化
  • Python 實作的強化學習:入門指南

    14,758+0近 7 天星數變化
  • bullet3@bulletphysics

    Bullet Physics SDK:即時碰撞偵測與多物理模擬,適用於 VR、遊戲、視覺特效、機器人、機器學習等

    14,711+7近 7 天星數變化
  • easy-rl@datawhalechina

    強化學習中文教程(蘑菇書🍄),線上閱讀地址:https://datawhalechina.github.io/easy-rl/

    14,600+8近 7 天星數變化
  • PyTorch 版 Stable Baselines,可靠的強化學習演算法實作

    13,758+21近 7 天星數變化
  • 透過這些精彩講座,沉浸於深度學習、強化學習、機器學習、電腦視覺與自然語言處理的世界!

    12,939+3近 7 天星數變化
  • Gymnasium@Farama-Foundation

    單代理強化學習環境的標準 API,提供流行的參考環境與相關工具(前稱 Gym)

    12,451+21近 7 天星數變化
  • wandb@wandb

    AI 開發者平台,使用 Weights & Biases 進行模型訓練與微調,並從實驗到部署全流程管理模型。

    11,249+4近 7 天星數變化
  • amazon-sagemaker-examples@aws

    示範如何使用 Amazon SageMaker 建構、訓練與部署機器學習模型的 Jupyter Notebook 範例 📓 🧠

    10,983+2近 7 天星數變化
  • ART@OpenPipe

    Agent Reinforcement Trainer:使用 GRPO 訓練多步驟代理以執行真實任務。為您的代理提供在職訓練。支援 Qwen3.6、GPT-OSS、Llama 等的強化學習

    10,689+10近 7 天星數變化
  • cleanrl@vwxyzjn

    高品質單檔實作深度強化學習演算法,具研究友好功能(PPO、DQN、C51、DDPG、TD3、SAC、PPG)

    10,358+19近 7 天星數變化
  • OpenRLHF@OpenRLHF

    一個易於使用、可擴展且高效能的 Agentic RL 框架,基於 Ray(PPO、DAPO、REINFORCE++、VLM、TIS、vLLM、Ray、Async RL)

    9,969+9近 7 天星數變化
  • 簡單的強化學習教學,莫煩Python 中文AI教學

    9,508-2近 7 天星數變化
  • Sana@NVlabs

    SANA:使用線性擴散變換器的高效高解析度影像合成

    8,925+37近 7 天星數變化
  • machine_learning_examples@lazyprogrammer

    機器學習範例與教學合集

    8,917+1近 7 天星數變化
← 返回主題列表