跳到主要内容
buildradar
登录
所有者 · opendilab

opendilab

opendilab 收录中的开源项目,按星标数排序。

共 16 个项目
  • awesome-RLHF@opendilab

    一份经过精选的强化学习与人类反馈资源列表(持续更新)

    4,424+0近 7 天星标变化
  • DI-engine@opendilab

    OpenDILab Decision AI Engine。最全面的强化学习框架 B.P.

    3,642+0近 7 天星标变化
  • PPOxFamily@opendilab

    PPO x Family DRL 教程课程(决策智能入门级公开课:8节课帮你盘清算法理论,理顺代码逻辑,玩转决策AI应用实践 )

    2,616+0近 7 天星标变化
  • LightZero@opendilab

    [NeurIPS 2023 Spotlight] LightZero:一般序列决策情境中蒙特卡洛树搜索的统一基准(精选 MCTS 资源)。

    1,642+0近 7 天星标变化
  • 强化学习中扩散模型(Diffusion Model)资源精选列表(持续更新)。

    1,635+0近 7 天星标变化
  • 精选的 Model-based RL 资源列表(持续更新)

    1,393+0近 7 天星标变化
  • DI-star@opendilab

    StarCraft II 的人工智能平台,具备大规模分布式训练与大师级代理。

    1,393+0近 7 天星标变化
  • LMDrive@opendilab

    [CVPR 2024] LMDrive:结合大型语言模型的闭环端到端驾驶

    929+0近 7 天星标变化
  • 精选的 Decision Transformer 资源列表(持续更新)

    917+1近 7 天星标变化
  • 精选的探索式强化学习 (RL) 资源清单(持续更新)

    723+0近 7 天星标变化
  • InterFuser@opendilab

    [CoRL 2022] InterFuser:使用可解释性传感器融合 Transformer 的安全增强型自动驾驶

    652-1近 7 天星标变化
  • DI-drive@opendilab

    用于自动驾驶模拟的决策智能平台。

    638+0近 7 天星标变化
  • 多模态强化学习资源精选清单(持续更新)

    620+1近 7 天星标变化
  • LLMRiddles@opendilab

    LLM Riddles 游戏的开源重制版与展示。

    587+0近 7 天星标变化
  • CleanS2S@opendilab

    单一文件实现的高质量流式语音对语音互动代理原型

    541+0近 7 天星标变化
  • DI-sheep@opendilab

    羊了个羊 + 深度强化学习

    519+0近 7 天星标变化
← 返回所有者排行