Saltar al contenido principal
buildradar
Sign in
Propietario · opendilab

opendilab

Repositorios de código abierto monitorizados de opendilab, ordenados por estrellas.

16 repositorios
  • awesome-RLHF@opendilab

    Una lista seleccionada de recursos sobre aprendizaje por refuerzo con retroalimentación humana (actualizada continuamente)

    4424+2Variación de estrellas de los últimos 7 días
  • DI-engine@opendilab

    OpenDILab Decision AI Engine. El framework de aprendizaje por refuerzo más completo B.P.

    3642+1Variación de estrellas de los últimos 7 días
  • PPOxFamily@opendilab

    Curso tutorial de DRL PPO x Family (Curso abierto de introducción a la inteligencia de decisiones: 8 lecciones para aclarar la teoría de algoritmos, ordenar la lógica del código y dominar la práctica de aplicaciones de IA de decisiones)

    2616+2Variación de estrellas de los últimos 7 días
  • LightZero@opendilab

    [NeurIPS 2023 Spotlight] LightZero: un benchmark unificado para la búsqueda en árbol de Monte Carlo en escenarios de decisión secuencial general (awesome MCTS)

    1642+4Variación de estrellas de los últimos 7 días
  • Una lista curada de recursos sobre modelos de difusión en aprendizaje por refuerzo (actualizada continuamente).

    1635+2Variación de estrellas de los últimos 7 días
  • Una lista curada de recursos excelentes sobre aprendizaje por refuerzo basado en modelos (actualizada continuamente)

    1393+0Variación de estrellas de los últimos 7 días
  • DI-star@opendilab

    Plataforma de inteligencia artificial para StarCraft II con entrenamiento distribuido a gran escala y agentes de nivel gran maestro.

    1393+0Variación de estrellas de los últimos 7 días
  • LMDrive@opendilab

    [CVPR 2024] LMDrive: Conducción autónoma de extremo a extremo en bucle cerrado con modelos de lenguaje de gran tamaño.

    929+0Variación de estrellas de los últimos 7 días
  • Una lista curada de recursos sobre Decision Transformer (actualizada continuamente)

    916+0Variación de estrellas de los últimos 7 días
  • Lista curada de recursos sobre aprendizaje por refuerzo (RL) de exploración (actualizada continuamente)

    723+0Variación de estrellas de los últimos 7 días
  • InterFuser@opendilab

    [CoRL 2022] InterFuser: Conducción autónoma mejorada con seguridad mediante Transformer de fusión de sensores interpretable

    652-1Variación de estrellas de los últimos 7 días
  • DI-drive@opendilab

    Plataforma de inteligencia de decisiones para la simulación de conducción autónoma.

    639+1Variación de estrellas de los últimos 7 días
  • Una lista curada de recursos de aprendizaje por refuerzo multimodal (actualizada continuamente).

    620+1Variación de estrellas de los últimos 7 días
  • LLMRiddles@opendilab

    Reproducción o demostración de código abierto del juego LLM Riddles.

    587+0Variación de estrellas de los últimos 7 días
  • CleanS2S@opendilab

    Agente interactivo de voz a voz de alta calidad y con transmisión en continuo en un solo archivo.

    541+0Variación de estrellas de los últimos 7 días
  • DI-sheep@opendilab

    Yang-le-ge-yang + Aprendizaje por refuerzo profundo (Deep Reinforcement Learning + juego de 3 fichas).

    519+0Variación de estrellas de los últimos 7 días
← Volver al ranking de propietarios