reinforcement-learning
Repositorios de código abierto monitorizados etiquetados con reinforcement-learning, ordenados por estrellas.
- #61
Recopilación y estudio de materiales sobre ChatGPT, actualización continua......
★ 4190+1Variación de estrellas de los últimos 7 días - #62★ 4054+2Variación de estrellas de los últimos 7 días
- #63
Una planificación personalizada moderna para Anki basada en el algoritmo Free Spaced Repetition Scheduler
★ 4052+1Variación de estrellas de los últimos 7 días - #64
Estas son las notas manuscritas de Andrew Ng en Coursera.
★ 3808+6Variación de estrellas de los últimos 7 días - #65★ 3727+0Variación de estrellas de los últimos 7 días
- #66★ 3726+12Variación de estrellas de los últimos 7 días
- #67
Ejemplos de aprendizaje por refuerzo mínimos y limpios
★ 3660+0Variación de estrellas de los últimos 7 días - #68
Curso de introducción al aprendizaje profundo, cursos avanzados, cursos especializados, casos académicos, casos de práctica industrial, enciclopedia de conocimientos de aprendizaje profundo y banco de preguntas para entrevistas.
★ 3651+2Variación de estrellas de los últimos 7 días - #69
OpenDILab Decision AI Engine. El framework de aprendizaje por refuerzo más completo B.P.
★ 3642+1Variación de estrellas de los últimos 7 días - #70
Una implementación del algoritmo AlphaZero para Gomoku (también llamado Gobang o Cinco en línea)
★ 3627+2Variación de estrellas de los últimos 7 días - #71
Artículos clásicos y recursos sobre recomendación
★ 3568+1Variación de estrellas de los últimos 7 días - #72
Una biblioteca de PyTorch modular, enfocada en primitivas y nativa de Python para el aprendizaje por refuerzo (Reinforcement Learning).
★ 3545+5Variación de estrellas de los últimos 7 días - #73★ 3545+4Variación de estrellas de los últimos 7 días
- #74
Aprendizaje reforzado / Bots de IA en juegos de cartas (póker): Blackjack, Leduc, Texas, DouDizhu, Mahjong, UNO.
★ 3541+0Variación de estrellas de los últimos 7 días - #75
Una API estándar para entornos de aprendizaje por refuerzo multiagente, con entornos de referencia populares y utilidades relacionadas
★ 3503+4Variación de estrellas de los últimos 7 días - #76★ 3496-1Variación de estrellas de los últimos 7 días
- #77
Depuración, monitoreo y visualización para Python Machine Learning y Data Science
★ 3472+1Variación de estrellas de los últimos 7 días - #78
Un framework de entrenamiento distribuido de alto rendimiento para Reinforcement Learning.
★ 3454+1Variación de estrellas de los últimos 7 días - #79
Implementación en PyTorch limpia, robusta y unificada de algoritmos populares de Aprendizaje por Refuerzo Profundo (DRL) (Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)
★ 3440+3Variación de estrellas de los últimos 7 días - #80★ 3382+0Variación de estrellas de los últimos 7 días
- #81
Tensorforce: una librería de TensorFlow para aprendizaje por refuerzo aplicado
★ 3305+0Variación de estrellas de los últimos 7 días - #82
Una colección de entornos para conducción autónoma y tareas de toma de decisiones tácticas
★ 3302+3Variación de estrellas de los últimos 7 días - #83
Framework de habilidades de manipulación, un simulador de robótica y banco de pruebas paralelizado por GPU de código abierto
★ 3283+13Variación de estrellas de los últimos 7 días - #84★ 3227+1Variación de estrellas de los últimos 7 días
- #85
Enlaces de recursos cuidadosamente seleccionados para ciencia de datos en un solo lugar
★ 3222+1Variación de estrellas de los últimos 7 días - #86
Skywork-R1V es una serie avanzada de modelos de IA multimodal desarrollada por Skywork AI, especializada en razonamiento de visión-lenguaje.
★ 3168+0Variación de estrellas de los últimos 7 días - #87
[NeurIPS 2024] OSWorld: Evaluación comparativa de agentes multimodales para tareas abiertas en entornos informáticos reales
★ 3118+6Variación de estrellas de los últimos 7 días - #88
Una biblioteca modular de alto nivel para entrenar agentes de IA incorporada en una variedad de tareas y entornos.
★ 3117+6Variación de estrellas de los últimos 7 días - #89
Cursos gratuitos e increíbles de machine learning e IA con clases en video.
★ 3112+0Variación de estrellas de los últimos 7 días - #90
TradeMaster es una plataforma de código abierto para el comercio cuantitativo potenciada por aprendizaje por refuerzo :fire: :zap: :rainbow:
★ 3056+2Variación de estrellas de los últimos 7 días