reinforcement-learning
Repositorios de código abierto monitorizados etiquetados con reinforcement-learning, ordenados por estrellas.
- #181
Algoritmo Asynchronous Advantage Actor-Critic (A3C) para Super Mario Bros
★ 1111-1Variación de estrellas de los últimos 7 días - #182★ 1102+2Variación de estrellas de los últimos 7 días
- #183
Biblioteca modular de aprendizaje por refuerzo (RL) (implementada en PyTorch, JAX y NVIDIA Warp) con soporte para Gymnasium/Gym, NVIDIA Isaac Lab, MuJoCo Playground y otros entornos.
★ 1095+2Variación de estrellas de los últimos 7 días - #184
Biblioteca que proporciona tareas de manipulación con manos diestras duales a través de Isaac Gym.
★ 1094+6Variación de estrellas de los últimos 7 días - #185★ 1085+2Variación de estrellas de los últimos 7 días
- #186
Un fork de gym-retro con juegos, emuladores y plataformas adicionales compatibles.
★ 1079+396Variación de estrellas de los últimos 7 días - #187
Un índice de algoritmos para aprendizaje por refuerzo offline (offline-rl).
★ 1078+3Variación de estrellas de los últimos 7 días - #188
Entornos de aprendizaje por refuerzo para el control de semáforos con SUMO. Compatible con Gymnasium, PettingZoo y bibliotecas populares de RL.
★ 1074+3Variación de estrellas de los últimos 7 días - #189★ 1065+5Variación de estrellas de los últimos 7 días
- #190
Guía esencial para mantenerse al día con AI/ML/DL/CV
★ 1063+0Variación de estrellas de los últimos 7 días - #191
La pila de mejora continua para agentes. Nuestros datos de entorno y evaluaciones potencian la mejora y el monitoreo de agentes.
★ 1060+2Variación de estrellas de los últimos 7 días - #192
Implementación del código de "Learning Efficient Online 3D Bin Packing on Packing Configuration Trees". Proponemos mejorar la aplicabilidad práctica del problema de empaquetado 3D (BPP) en línea mediante el aprendizaje en un árbol de configuración de empaquetado jerárquico, lo que facilita que el modelo de aprendizaje por refuerzo profundo (DRL) maneje restricciones prácticas y tenga un buen rendimiento incluso con espacios de solución continuos.
★ 1047+1Variación de estrellas de los últimos 7 días - #193
Ruta de aprendizaje más completa para ingenieros de agentes · Domina la ingeniería de IA desde cero · 20 etapas, 503 lecciones · Traducción completa al chino + sitio web de apoyo + videos explicativos animados · Guía definitiva para convertirte en un ingeniero de agentes de IA
★ 1043+38Variación de estrellas de los últimos 7 días - #194★ 1041+1Variación de estrellas de los últimos 7 días
- #195★ 1033+3Variación de estrellas de los últimos 7 días
- #196
Código fuente del libro "Reinforcement Learning: Theory and Python Implementation"
★ 1033+3Variación de estrellas de los últimos 7 días - #197
Aprendizaje por refuerzo profundo para el control MPC de la locomoción de robots cuadrúpedos
★ 1023+2Variación de estrellas de los últimos 7 días - #198
Aprendizaje por refuerzo síncrono y asíncrono de alto rendimiento
★ 1021+1Variación de estrellas de los últimos 7 días - #199
Colección de artículos y recursos clásicos y de vanguardia en la industria de sistemas de recomendación y predicción de CTR
★ 1016+0Variación de estrellas de los últimos 7 días - #200
Un entorno de referencia para el rendimiento humano-IA totalmente cooperativo
★ 1003+5Variación de estrellas de los últimos 7 días - #201
Materiales destacados de IA para juegos sobre aprendizaje por refuerzo multiagente.
★ 979+2Variación de estrellas de los últimos 7 días - #202
Un potente modelo de edición de audio basado en aprendizaje por refuerzo y LLM de 3B de parámetros, excelente para editar emociones, estilos de habla y paralingüística, con capacidades robustas de texto a voz zero-shot.
★ 971+2Variación de estrellas de los últimos 7 días - #203
Una colección de entornos de simulación robótica para aprendizaje por refuerzo.
★ 963+1Variación de estrellas de los últimos 7 días - #204
Framework de entrenamiento de aprendizaje por refuerzo multimodal para modelos de difusión y omnimodales
★ 959+60Variación de estrellas de los últimos 7 días - #205
Universidad de código abierto de aprendizaje automático.
★ 955+0Variación de estrellas de los últimos 7 días - #206
Lista de diseño molecular y de materiales utilizando IA generativa y aprendizaje profundo
★ 952+1Variación de estrellas de los últimos 7 días - #207
Optimización del aprendizaje por refuerzo con RLOps. Algoritmos y herramientas de RL de vanguardia, con un entrenamiento 10 veces más rápido mediante optimización evolutiva de hiperparámetros.
★ 951+4Variación de estrellas de los últimos 7 días - #208★ 947+1Variación de estrellas de los últimos 7 días
- #209
PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama
★ 947—Variación de estrellas de los últimos 7 días - #210
Biblioteca de Python para aprendizaje por refuerzo.
★ 944+0Variación de estrellas de los últimos 7 días