reinforcement-learning
Repositorios de código abierto monitorizados etiquetados con reinforcement-learning, ordenados por estrellas.
- #121
¡Rainbow es todo lo que necesitas! Un tutorial paso a paso desde DQN hasta Rainbow
★ 2032+0Variación de estrellas de los últimos 7 días - #122★ 2025+4Variación de estrellas de los últimos 7 días
- #123
Deep Learning Avanzado con Keras, publicado por Packt
★ 2023+0Variación de estrellas de los últimos 7 días - #124
Centro de recursos para desarrolladores de NVIDIA Nemotron: un punto único para recetas de entrenamiento, manuales de uso, conjuntos de datos y ejemplos de referencia integrales para construir con modelos Nemotron
★ 2015+18Variación de estrellas de los últimos 7 días - #125
🚀 Recursos de IA GRATIS: 🎓 Cursos, 👷 Empleos, 📝 Blogs, 🔬 Investigación en IA y muchos más, ¡para todos!
★ 1975+9Variación de estrellas de los últimos 7 días - #126★ 1972+1Variación de estrellas de los últimos 7 días
- #127
Implementación de todos los algoritmos de RL de una manera más sencilla.
★ 1929+7Variación de estrellas de los últimos 7 días - #128
Entorno de trading y backtesting para entrenar agentes de aprendizaje por refuerzo o algoritmos basados en reglas simples.
★ 1915+2Variación de estrellas de los últimos 7 días - #129
RoboVerse: hacia una plataforma, conjunto de datos y benchmark unificados para el aprendizaje robótico escalable y generalizable.
★ 1851+11Variación de estrellas de los últimos 7 días - #130
Algunos libros y PDFs impresionantes relacionados con IA para aprender y descargar, también aplica algunos modelos de playground para el aprendizaje.
★ 1799+2Variación de estrellas de los últimos 7 días - #131★ 1789+1Variación de estrellas de los últimos 7 días
- #132
Una biblioteca ligera de herramientas y utilidades para el entrenamiento en PyTorch
★ 1722+0Variación de estrellas de los últimos 7 días - #133
El código de entrenamiento de aprendizaje por refuerzo para AgiBot X1.
★ 1698-1Variación de estrellas de los últimos 7 días - #134★ 1695+0Variación de estrellas de los últimos 7 días
- #135
Neuroevolución profunda
★ 1666-1Variación de estrellas de los últimos 7 días - #136
[NeurIPS 2023 Spotlight] LightZero: un benchmark unificado para la búsqueda en árbol de Monte Carlo en escenarios de decisión secuencial general (awesome MCTS)
★ 1642+4Variación de estrellas de los últimos 7 días - #137
Safe RLHF: Alineación de valores restringida mediante aprendizaje por refuerzo seguro a partir de retroalimentación humana
★ 1613+1Variación de estrellas de los últimos 7 días - #138
[IEEE RA-L'25] NavRL: Aprendizaje de vuelo seguro en entornos dinámicos (NVIDIA Isaac/Python/ROS1/ROS2)
★ 1599+7Variación de estrellas de los últimos 7 días - #139
Un paquete de código abierto que permite a creadores de videojuegos, investigadores de IA y aficionados aprender comportamientos complejos para sus personajes no jugadores (NPC) o agentes.
★ 1578+1Variación de estrellas de los últimos 7 días - #140
Curso gratuito que te lleva de cero a profesional en Aprendizaje por Refuerzo
★ 1570+0Variación de estrellas de los últimos 7 días - #141
AgentEvolver: Hacia un sistema de agentes autoevolutivos eficiente
★ 1552+3Variación de estrellas de los últimos 7 días - #142
Una IA rápida y potente para riichi mahjong, impulsada por Rust y aprendizaje por refuerzo profundo
★ 1539+8Variación de estrellas de los últimos 7 días - #143
Una lista curada de los mejores recursos de inteligencia artificial
★ 1522+2Variación de estrellas de los últimos 7 días - #144
Motor de ejecución de entornos paralelos de alto rendimiento basado en C++ (entorno vectorizado) para entornos de RL generales.
★ 1513+2Variación de estrellas de los últimos 7 días - #145
Para el aprendizaje por refuerzo profundo y el futuro de la IA.
★ 1513+0Variación de estrellas de los últimos 7 días - #146
[NeurIPS 2025 Spotlight] Entornos de razonamiento para aprendizaje por refuerzo con recompensas verificables
★ 1500+3Variación de estrellas de los últimos 7 días - #147
Una lista curada de enlaces y bibliotecas de software útiles para robots.
★ 1483+3Variación de estrellas de los últimos 7 días - #148
Una colección de Jupyter notebooks de referencia y aplicaciones de demostración de IA/ML para casos de uso empresarial: marketing, precios, cadena de suministro, fabricación inteligente y más.
★ 1453+1Variación de estrellas de los últimos 7 días - #149
TextWorld es un entorno de aprendizaje tipo sandbox para el entrenamiento y evaluación de agentes de aprendizaje por refuerzo (RL) en juegos basados en texto.
★ 1442+1Variación de estrellas de los últimos 7 días - #150
Herramientas de entrenamiento y despliegue de aprendizaje por refuerzo (RL) de simulación a realidad para el robot Unitree Go1.
★ 1440+0Variación de estrellas de los últimos 7 días