Saltar al contenido principal
buildradar
Sign in
Tema · reinforcement-learning-algorithms

reinforcement-learning-algorithms

Repositorios de código abierto monitorizados etiquetados con reinforcement-learning-algorithms, ordenados por estrellas.

Repositorios
21
Estrellas totales
39.604
Estrellas de media
1886
Proporción
0,00%

Temas que aparecen con frecuencia junto a reinforcement-learning-algorithms en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con reinforcement-learning-algorithms.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • Versión en PyTorch de Stable Baselines, implementaciones confiables de algoritmos de aprendizaje por refuerzo.

    13.758+21Variación de estrellas de los últimos 7 días
  • deep-reinforcement-learning@udacity

    Repositorio para el programa Nanodegree de Aprendizaje por Refuerzo Profundo (Deep Reinforcement Learning)

    5176+0Variación de estrellas de los últimos 7 días
  • DI-engine@opendilab

    OpenDILab Decision AI Engine. El framework de aprendizaje por refuerzo más completo B.P.

    3642+1Variación de estrellas de los últimos 7 días
  • PPO-PyTorch@nikhilbarhate99

    Implementación mínima de Proximal Policy Optimization (PPO) con objetivo recortado en PyTorch

    2381+6Variación de estrellas de los últimos 7 días
  • Una lista curada de recursos excelentes sobre aprendizaje por refuerzo basado en modelos (actualizada continuamente)

    1393+0Variación de estrellas de los últimos 7 días
  • PPO-for-Beginners@ericyangyu

    Una implementación de PPO simple y bien estructurada. Basada en mi serie de Medium: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8.

    1269+1Variación de estrellas de los últimos 7 días
  • ARPO@RUC-NLPIR

    [ICLR 2026] Optimización de políticas reforzadas por agentes (ARPO)

    1114+3Variación de estrellas de los últimos 7 días
  • purejaxrl@luchris429

    Implementaciones de RL en Jax extremadamente rápidas de extremo a extremo

    1102+2Variación de estrellas de los últimos 7 días
  • UI-Venus@inclusionAI

    UI-Venus es un agente de interfaz de usuario nativo diseñado para realizar un anclaje preciso de elementos GUI y una navegación efectiva utilizando solo capturas de pantalla como entrada.

    1037+23Variación de estrellas de los últimos 7 días
  • Una lista curada de recursos sobre Decision Transformer (actualizada continuamente)

    916+0Variación de estrellas de los últimos 7 días
  • course-content-dl@NeuromatchAcademy

    Curso de aprendizaje profundo de NMA.

    812+1Variación de estrellas de los últimos 7 días
  • POMDPs.jl@JuliaPOMDP

    MDPs y POMDPs en Julia - Una interfaz para definir, resolver y simular procesos de decisión de Markov total o parcialmente observables en espacios discretos y continuos.

    766+1Variación de estrellas de los últimos 7 días
  • stable-baselines3-contrib@Stable-Baselines-Team

    Paquete contrib para Stable-Baselines3: código experimental de aprendizaje por refuerzo (RL)

    736+5Variación de estrellas de los últimos 7 días
  • Proyecto sobre algoritmos de evasión de obstáculos autónomos para UAV mediante aprendizaje por refuerzo profundo.

    730+0Variación de estrellas de los últimos 7 días
  • disco_rl@google-deepmind

    Código complementario para la publicación en Nature "Discovering State-of-the-art Reinforcement Algorithms"

    728+2Variación de estrellas de los últimos 7 días
  • Lista curada de recursos sobre aprendizaje por refuerzo (RL) de exploración (actualizada continuamente)

    723+0Variación de estrellas de los últimos 7 días
  • UAV-DDPG@fangvv

    Código para el artículo "Optimización de descarga de computación para computación de borde móvil asistida por UAV: un enfoque de gradiente de política determinista profundo"

    722+1Variación de estrellas de los últimos 7 días
  • Rofunc@Skylark0924

    Paquete de Python para el proceso completo de aprendizaje robótico a partir de demostraciones y manipulación robótica.

    720+1Variación de estrellas de los últimos 7 días
  • Lista curada de artículos sobre búsqueda en árbol de Monte Carlo con implementaciones.

    715+1Variación de estrellas de los últimos 7 días
  • Una biblioteca de PyTorch para crear agentes de aprendizaje por refuerzo profundo.

    657+0Variación de estrellas de los últimos 7 días
  • dLLM-RL@Gen-Verse

    [ICLR 2026] Código oficial para TraceRL: Revolucionando el post-entrenamiento para LLM de difusión, impulsando la serie SOTA TraDo.

    520+1Variación de estrellas de los últimos 7 días
← Volver a temas