Saltar al contenido principal
buildradar
Sign in
Tema · reinforcement-learning

reinforcement-learning

Repositorios de código abierto monitorizados etiquetados con reinforcement-learning, ordenados por estrellas.

304 repositorios
  • Recopilación y estudio de materiales sobre ChatGPT, actualización continua......

    4190+1Variación de estrellas de los últimos 7 días
  • acme@google-deepmind

    Una biblioteca de componentes y agentes de aprendizaje por refuerzo

    4054+2Variación de estrellas de los últimos 7 días
  • fsrs4anki@open-spaced-repetition

    Una planificación personalizada moderna para Anki basada en el algoritmo Free Spaced Repetition Scheduler

    4052+1Variación de estrellas de los últimos 7 días
  • Andrew-NG-Notes@ashishpatel26

    Estas son las notas manuscritas de Andrew Ng en Coursera.

    3808+6Variación de estrellas de los últimos 7 días
  • polyaxon@polyaxon

    Infraestructura de AI / Orquestación de AI / Plano de control de AI

    3727+0Variación de estrellas de los últimos 7 días
  • dreamerv3@danijar

    Dominando diversos dominios a través de modelos del mundo

    3726+12Variación de estrellas de los últimos 7 días
  • Ejemplos de aprendizaje por refuerzo mínimos y limpios

    3660+0Variación de estrellas de los últimos 7 días
  • awesome-DeepLearning@PaddlePaddle

    Curso de introducción al aprendizaje profundo, cursos avanzados, cursos especializados, casos académicos, casos de práctica industrial, enciclopedia de conocimientos de aprendizaje profundo y banco de preguntas para entrevistas.

    3651+2Variación de estrellas de los últimos 7 días
  • DI-engine@opendilab

    OpenDILab Decision AI Engine. El framework de aprendizaje por refuerzo más completo B.P.

    3642+1Variación de estrellas de los últimos 7 días
  • AlphaZero_Gomoku@junxiaosong

    Una implementación del algoritmo AlphaZero para Gomoku (también llamado Gobang o Cinco en línea)

    3627+2Variación de estrellas de los últimos 7 días
  • Reco-papers@wzhe06

    Artículos clásicos y recursos sobre recomendación

    3568+1Variación de estrellas de los últimos 7 días
  • rl@pytorch

    Una biblioteca de PyTorch modular, enfocada en primitivas y nativa de Python para el aprendizaje por refuerzo (Reinforcement Learning).

    3545+5Variación de estrellas de los últimos 7 días
  • ml-course@girafe-ai

    Curso abierto de Machine Learning

    3545+4Variación de estrellas de los últimos 7 días
  • rlcard@datamllab

    Aprendizaje reforzado / Bots de IA en juegos de cartas (póker): Blackjack, Leduc, Texas, DouDizhu, Mahjong, UNO.

    3541+0Variación de estrellas de los últimos 7 días
  • PettingZoo@Farama-Foundation

    Una API estándar para entornos de aprendizaje por refuerzo multiagente, con entornos de referencia populares y utilidades relacionadas

    3503+4Variación de estrellas de los últimos 7 días
  • MetaClaw@aiming-lab

    Habla con tu agente: aprende y EVOLUCIONA.

    3496-1Variación de estrellas de los últimos 7 días
  • tensorwatch@microsoft

    Depuración, monitoreo y visualización para Python Machine Learning y Data Science

    3472+1Variación de estrellas de los últimos 7 días
  • PARL@PaddlePaddle

    Un framework de entrenamiento distribuido de alto rendimiento para Reinforcement Learning.

    3454+1Variación de estrellas de los últimos 7 días
  • DRL-Pytorch@XinJingHao

    Implementación en PyTorch limpia, robusta y unificada de algoritmos populares de Aprendizaje por Refuerzo Profundo (DRL) (Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)

    3440+3Variación de estrellas de los últimos 7 días
  • catalyst@catalyst-team

    Investigación y desarrollo de deep learning acelerado

    3382+0Variación de estrellas de los últimos 7 días
  • tensorforce@tensorforce

    Tensorforce: una librería de TensorFlow para aprendizaje por refuerzo aplicado

    3305+0Variación de estrellas de los últimos 7 días
  • HighwayEnv@Farama-Foundation

    Una colección de entornos para conducción autónoma y tareas de toma de decisiones tácticas

    3302+3Variación de estrellas de los últimos 7 días
  • ManiSkill@mani-skill

    Framework de habilidades de manipulación, un simulador de robótica y banco de pruebas paralelizado por GPU de código abierto

    3283+13Variación de estrellas de los últimos 7 días
  • brax@google

    Simulación de física de cuerpos rígidos masivamente paralela en hardware acelerador.

    3227+1Variación de estrellas de los últimos 7 días
  • Enlaces de recursos cuidadosamente seleccionados para ciencia de datos en un solo lugar

    3222+1Variación de estrellas de los últimos 7 días
  • Skywork-R1V@SkyworkAI

    Skywork-R1V es una serie avanzada de modelos de IA multimodal desarrollada por Skywork AI, especializada en razonamiento de visión-lenguaje.

    3168+0Variación de estrellas de los últimos 7 días
  • OSWorld@xlang-ai

    [NeurIPS 2024] OSWorld: Evaluación comparativa de agentes multimodales para tareas abiertas en entornos informáticos reales

    3118+6Variación de estrellas de los últimos 7 días
  • habitat-lab@facebookresearch

    Una biblioteca modular de alto nivel para entrenar agentes de IA incorporada en una variedad de tareas y entornos.

    3117+6Variación de estrellas de los últimos 7 días
  • Cursos gratuitos e increíbles de machine learning e IA con clases en video.

    3112+0Variación de estrellas de los últimos 7 días
  • TradeMaster@TradeMaster-NTU

    TradeMaster es una plataforma de código abierto para el comercio cuantitativo potenciada por aprendizaje por refuerzo :fire: :zap: :rainbow:

    3056+2Variación de estrellas de los últimos 7 días
← Volver a temas