opendilab
Repositorios de código abierto monitorizados de opendilab, ordenados por estrellas.
- #1
Una lista seleccionada de recursos sobre aprendizaje por refuerzo con retroalimentación humana (actualizada continuamente)
★ 4424+2Variación de estrellas de los últimos 7 días - #2
OpenDILab Decision AI Engine. El framework de aprendizaje por refuerzo más completo B.P.
★ 3642+1Variación de estrellas de los últimos 7 días - #3
Curso tutorial de DRL PPO x Family (Curso abierto de introducción a la inteligencia de decisiones: 8 lecciones para aclarar la teoría de algoritmos, ordenar la lógica del código y dominar la práctica de aplicaciones de IA de decisiones)
★ 2616+2Variación de estrellas de los últimos 7 días - #4
[NeurIPS 2023 Spotlight] LightZero: un benchmark unificado para la búsqueda en árbol de Monte Carlo en escenarios de decisión secuencial general (awesome MCTS)
★ 1642+4Variación de estrellas de los últimos 7 días - #5
Una lista curada de recursos sobre modelos de difusión en aprendizaje por refuerzo (actualizada continuamente).
★ 1635+2Variación de estrellas de los últimos 7 días - #6
Una lista curada de recursos excelentes sobre aprendizaje por refuerzo basado en modelos (actualizada continuamente)
★ 1393+0Variación de estrellas de los últimos 7 días - #7
Plataforma de inteligencia artificial para StarCraft II con entrenamiento distribuido a gran escala y agentes de nivel gran maestro.
★ 1393+0Variación de estrellas de los últimos 7 días - #8
[CVPR 2024] LMDrive: Conducción autónoma de extremo a extremo en bucle cerrado con modelos de lenguaje de gran tamaño.
★ 929+0Variación de estrellas de los últimos 7 días - #9
Una lista curada de recursos sobre Decision Transformer (actualizada continuamente)
★ 916+0Variación de estrellas de los últimos 7 días - #10
Lista curada de recursos sobre aprendizaje por refuerzo (RL) de exploración (actualizada continuamente)
★ 723+0Variación de estrellas de los últimos 7 días - #11
[CoRL 2022] InterFuser: Conducción autónoma mejorada con seguridad mediante Transformer de fusión de sensores interpretable
★ 652-1Variación de estrellas de los últimos 7 días - #12
Plataforma de inteligencia de decisiones para la simulación de conducción autónoma.
★ 639+1Variación de estrellas de los últimos 7 días - #13
Una lista curada de recursos de aprendizaje por refuerzo multimodal (actualizada continuamente).
★ 620+1Variación de estrellas de los últimos 7 días - #14
Reproducción o demostración de código abierto del juego LLM Riddles.
★ 587+0Variación de estrellas de los últimos 7 días - #15
Agente interactivo de voz a voz de alta calidad y con transmisión en continuo en un solo archivo.
★ 541+0Variación de estrellas de los últimos 7 días - #16
Yang-le-ge-yang + Aprendizaje por refuerzo profundo (Deep Reinforcement Learning + juego de 3 fichas).
★ 519+0Variación de estrellas de los últimos 7 días