Pular para o conteúdo principal
buildradar
Sign in
Tópico · reinforcement-learning-algorithms

reinforcement-learning-algorithms

Repositórios de código aberto acompanhados marcados com reinforcement-learning-algorithms, ordenados por estrelas.

Repositórios
21
Total de estrelas
39.604
Média de estrelas
1.886
Participação
0,00%

Tópicos que aparecem com frequência ao lado de reinforcement-learning-algorithms no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com reinforcement-learning-algorithms.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • Implementações confiáveis de algoritmos de reinforcement learning, versão PyTorch do Stable Baselines.

    13.758+21Variação de estrelas nos últimos 7 dias
  • deep-reinforcement-learning@udacity

    Repositório para o programa Nanodegree de Aprendizado por Reforço Profundo.

    5.176+0Variação de estrelas nos últimos 7 dias
  • DI-engine@opendilab

    OpenDILab Decision AI Engine. O framework de Reinforcement Learning mais abrangente.

    3.642+1Variação de estrelas nos últimos 7 dias
  • PPO-PyTorch@nikhilbarhate99

    Implementação mínima de Proximal Policy Optimization (PPO) com objetivo recortado em PyTorch

    2.381+6Variação de estrelas nos últimos 7 dias
  • Uma lista curada de recursos incríveis sobre RL baseada em modelos (atualizada continuamente)

    1.393+0Variação de estrelas nos últimos 7 dias
  • PPO-for-Beginners@ericyangyu

    Uma implementação simples e bem estruturada de PPO, baseada na série do Medium: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8.

    1.269+1Variação de estrelas nos últimos 7 dias
  • ARPO@RUC-NLPIR

    [ICLR 2026] Agentic Reinforced Policy Optimization (ARPO)

    1.116+3Variação de estrelas nos últimos 7 dias
  • purejaxrl@luchris429

    Implementações de RL de ponta a ponta extremamente rápidas em Jax

    1.102+2Variação de estrelas nos últimos 7 dias
  • UI-Venus@inclusionAI

    UI-Venus é um agente de UI nativo projetado para realizar o grounding preciso de elementos de GUI e navegação eficaz usando apenas capturas de tela como entrada.

    1.037+23Variação de estrelas nos últimos 7 dias
  • Uma lista com curadoria de recursos do Decision Transformer (atualizada continuamente)

    916+0Variação de estrelas nos últimos 7 dias
  • course-content-dl@NeuromatchAcademy

    Curso de deep learning da NMA

    812+1Variação de estrelas nos últimos 7 dias
  • POMDPs.jl@JuliaPOMDP

    MDPs e POMDPs em Julia - Uma interface para definir, resolver e simular processos de decisão de Markov total ou parcialmente observáveis em espaços discretos e contínuos.

    766+1Variação de estrelas nos últimos 7 dias
  • stable-baselines3-contrib@Stable-Baselines-Team

    Pacote contrib para Stable-Baselines3 - Código experimental de aprendizado por reforço (RL).

    736+5Variação de estrelas nos últimos 7 dias
  • Este é um projeto sobre algoritmo autônomo de desvio de obstáculos por aprendizado por reforço profundo para UAV.

    730+0Variação de estrelas nos últimos 7 dias
  • disco_rl@google-deepmind

    Código complementar para a publicação na Nature "Discovering State-of-the-art Reinforcement Algorithms"

    728+2Variação de estrelas nos últimos 7 dias
  • Uma lista curada de recursos incríveis de RL de exploração (atualizada continuamente)

    723+0Variação de estrelas nos últimos 7 dias
  • UAV-DDPG@fangvv

    Código para o artigo "Computation Offloading Optimization for UAV-assisted Mobile Edge Computing: A Deep Deterministic Policy Gradient Approach"

    722+1Variação de estrelas nos últimos 7 dias
  • Rofunc@Skylark0924

    🤖 O pacote Python de processo completo para aprendizado de robôs a partir de demonstração e manipulação de robôs

    720+1Variação de estrelas nos últimos 7 dias
  • Uma lista selecionada de artigos sobre busca em árvore de Monte Carlo com implementações.

    715+1Variação de estrelas nos últimos 7 dias
  • Uma biblioteca PyTorch para construir agentes de aprendizado por reforço profundo.

    657+0Variação de estrelas nos últimos 7 dias
  • dLLM-RL@Gen-Verse

    [ICLR 2026] Código oficial para TraceRL: Revolucionando o pós-treinamento para LLMs de Difusão, impulsionando a série SOTA TraDo.

    520+1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos