reinforcement-learning-algorithms
Repositorios de código abierto monitorizados etiquetados con reinforcement-learning-algorithms, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a reinforcement-learning-algorithms en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con reinforcement-learning-algorithms.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
Versión en PyTorch de Stable Baselines, implementaciones confiables de algoritmos de aprendizaje por refuerzo.
★ 13.758+21Variación de estrellas de los últimos 7 días - #2
Repositorio para el programa Nanodegree de Aprendizaje por Refuerzo Profundo (Deep Reinforcement Learning)
★ 5176+0Variación de estrellas de los últimos 7 días - #3
OpenDILab Decision AI Engine. El framework de aprendizaje por refuerzo más completo B.P.
★ 3642+1Variación de estrellas de los últimos 7 días - #4
Implementación mínima de Proximal Policy Optimization (PPO) con objetivo recortado en PyTorch
★ 2381+6Variación de estrellas de los últimos 7 días - #5
Una lista curada de recursos excelentes sobre aprendizaje por refuerzo basado en modelos (actualizada continuamente)
★ 1393+0Variación de estrellas de los últimos 7 días - #6
Una implementación de PPO simple y bien estructurada. Basada en mi serie de Medium: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8.
★ 1269+1Variación de estrellas de los últimos 7 días - #7★ 1114+3Variación de estrellas de los últimos 7 días
- #8★ 1102+2Variación de estrellas de los últimos 7 días
- #9
UI-Venus es un agente de interfaz de usuario nativo diseñado para realizar un anclaje preciso de elementos GUI y una navegación efectiva utilizando solo capturas de pantalla como entrada.
★ 1037+23Variación de estrellas de los últimos 7 días - #10
Una lista curada de recursos sobre Decision Transformer (actualizada continuamente)
★ 916+0Variación de estrellas de los últimos 7 días - #11
Curso de aprendizaje profundo de NMA.
★ 812+1Variación de estrellas de los últimos 7 días - #12
MDPs y POMDPs en Julia - Una interfaz para definir, resolver y simular procesos de decisión de Markov total o parcialmente observables en espacios discretos y continuos.
★ 766+1Variación de estrellas de los últimos 7 días - #13
Paquete contrib para Stable-Baselines3: código experimental de aprendizaje por refuerzo (RL)
★ 736+5Variación de estrellas de los últimos 7 días - #14
Proyecto sobre algoritmos de evasión de obstáculos autónomos para UAV mediante aprendizaje por refuerzo profundo.
★ 730+0Variación de estrellas de los últimos 7 días - #15
Código complementario para la publicación en Nature "Discovering State-of-the-art Reinforcement Algorithms"
★ 728+2Variación de estrellas de los últimos 7 días - #16
Lista curada de recursos sobre aprendizaje por refuerzo (RL) de exploración (actualizada continuamente)
★ 723+0Variación de estrellas de los últimos 7 días - #17
Código para el artículo "Optimización de descarga de computación para computación de borde móvil asistida por UAV: un enfoque de gradiente de política determinista profundo"
★ 722+1Variación de estrellas de los últimos 7 días - #18
Paquete de Python para el proceso completo de aprendizaje robótico a partir de demostraciones y manipulación robótica.
★ 720+1Variación de estrellas de los últimos 7 días - #19
Lista curada de artículos sobre búsqueda en árbol de Monte Carlo con implementaciones.
★ 715+1Variación de estrellas de los últimos 7 días - #20
Una biblioteca de PyTorch para crear agentes de aprendizaje por refuerzo profundo.
★ 657+0Variación de estrellas de los últimos 7 días - #21
[ICLR 2026] Código oficial para TraceRL: Revolucionando el post-entrenamiento para LLM de difusión, impulsando la serie SOTA TraDo.
★ 520+1Variación de estrellas de los últimos 7 días