跳到主要内容
buildradar
登录
主题 · reinforcement-learning

reinforcement-learning

标记 reinforcement-learning 主题、收录中的开源项目,按星标数排序。

共 305 个项目
  • ChatGPT 资料汇总学习,持续更新……

    4,190+0近 7 天星标变化
  • acme@google-deepmind

    一个强化学习元件与代理的库

    4,054+0近 7 天星标变化
  • fsrs4anki@open-spaced-repetition

    基于 Free Spaced Repetition Scheduler 算法的现代 Anki 自订排程。

    4,052+0近 7 天星标变化
  • Andrew-NG-Notes@ashishpatel26

    这是 Andrew NG Coursera 手写笔记

    3,808+0近 7 天星标变化
  • polyaxon@polyaxon

    AI Infra / AI Orchestration / AI Control Plane

    3,727+0近 7 天星标变化
  • dreamerv3@danijar

    透过世界模型掌握多领域专业知识

    3,726+0近 7 天星标变化
  • 简洁且干净的强化学习示例

    3,660+0近 7 天星标变化
  • awesome-DeepLearning@PaddlePaddle

    深度学习入门课、资深课、特色课、学术案例、产业实践案例、深度学习知识百科及面试题库The course, case and knowledge of Deep Learning and AI

    3,651+0近 7 天星标变化
  • DI-engine@opendilab

    OpenDILab Decision AI Engine。最全面的强化学习框架 B.P.

    3,642+0近 7 天星标变化
  • AlphaZero_Gomoku@junxiaosong

    AlphaZero 算法在五子棋(亦称 Gobang 或 Five in a Row)的实现

    3,627+0近 7 天星标变化
  • Reco-papers@wzhe06

    推荐系统的经典论文与资源

    3,568+0近 7 天星标变化
  • ml-course@girafe-ai

    开源机器学习课程

    3,545+0近 7 天星标变化
  • rl@pytorch

    一个模块化、原始型优先、Python 首先的 PyTorch Reinforcement Learning 函数库。

    3,545+0近 7 天星标变化
  • rlcard@datamllab

    卡牌游戏中的强化学习 / AI 机器人:Blackjack、Leduc、Texas、DouDizhu、Mahjong、UNO

    3,541+0近 7 天星标变化
  • PettingZoo@Farama-Foundation

    A standard API for multi-agent reinforcement learning environments, with popular reference environments and related utilities

    3,503+0近 7 天星标变化
  • MetaClaw@aiming-lab

    🦞 只需与您的代理对话——它会学习并进化 🧬

    3,496+0近 7 天星标变化
  • tensorwatch@microsoft

    Python 机器学习与数据科学的调试、监控与可视化

    3,472+0近 7 天星标变化
  • PARL@PaddlePaddle

    高效能分散式训练框架,用于强化学习

    3,454+0近 7 天星标变化
  • DRL-Pytorch@XinJingHao

    干净、稳健且统一的 PyTorch 实现,涵盖热门深度强化学习(DRL)算法(Q-learning、Duel DDQN、PER、C51、Noisy DQN、PPO、DDPG、TD3、SAC、ASL)

    3,440+0近 7 天星标变化
  • catalyst@catalyst-team

    加速深度学习研发

    3,382+0近 7 天星标变化
  • tensorforce@tensorforce

    Tensorforce:用于应用强化学习的 TensorFlow 库

    3,305+0近 7 天星标变化
  • HighwayEnv@Farama-Foundation

    一系列自动驾驶与战术决策任务的环境集合。

    3,302+0近 7 天星标变化
  • ManiSkill@mani-skill

    Manipulation Skill Framework,一个开源的 GPU 并行化机器人模拟器与基准测试

    3,283+0近 7 天星标变化
  • brax@google

    在加速器硬件上进行大规模并行刚体物理模拟。

    3,227+0近 7 天星标变化
  • 精心策划的数据科学资源链接集合

    3,222+0近 7 天星标变化
  • Skywork-R1V@SkyworkAI

    Skywork-R1V 是 Skywork AI 开发的先进多模态 AI 模型系列,专注于视觉-语言推理

    3,168+0近 7 天星标变化
  • OSWorld@xlang-ai

    [NeurIPS 2024] OSWorld:在真实电脑环境中评测开放式任务的多模态 Agent。

    3,118+0近 7 天星标变化
  • habitat-lab@facebookresearch

    一个模块化的高级函数库,用于在多种任务与环境中训练具身 AI 代理。

    3,117+0近 7 天星标变化
  • 包含视频课程的优质免费机器学习与 AI 课程。

    3,112+0近 7 天星标变化
  • TradeMaster@TradeMaster-NTU

    TradeMaster 是一个由强化学习赋能的开源量化交易平台 :fire: :zap: :rainbow:

    3,056+0近 7 天星标变化
← 返回主题列表