Pular para o conteúdo principal
buildradar
Sign in
Tópico · reinforcement-learning

reinforcement-learning

Repositórios de código aberto acompanhados marcados com reinforcement-learning, ordenados por estrelas.

305 repositórios
  • MO-Gymnasium@Farama-Foundation

    Ambientes Gymnasium multi-objetivo para aprendizado por reforço

    760-1Variação de estrelas nos últimos 7 dias
  • tmrl@trackmania-rl

    Aprendizado por reforço para aplicações em tempo real

    737+2Variação de estrelas nos últimos 7 dias
  • stable-baselines3-contrib@Stable-Baselines-Team

    Pacote contrib para Stable-Baselines3 - Código experimental de aprendizado por reforço (RL).

    736+5Variação de estrelas nos últimos 7 dias
  • Este é um projeto sobre algoritmo autônomo de desvio de obstáculos por aprendizado por reforço profundo para UAV.

    730+0Variação de estrelas nos últimos 7 dias
  • Long-RL@NVlabs

    Long-RL: Escalando RL para Sequências Longas (NeurIPS 2025)

    730+1Variação de estrelas nos últimos 7 dias
  • disco_rl@google-deepmind

    Código complementar para a publicação na Nature "Discovering State-of-the-art Reinforcement Algorithms"

    728+2Variação de estrelas nos últimos 7 dias
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    727Variação de estrelas nos últimos 7 dias
  • rl-agents@eleurent

    Implementações de algoritmos de Aprendizado por Reforço e Planejamento

    726-1Variação de estrelas nos últimos 7 dias
  • Uma lista curada de recursos incríveis de RL de exploração (atualizada continuamente)

    723+0Variação de estrelas nos últimos 7 dias
  • UAV-DDPG@fangvv

    Código para o artigo "Computation Offloading Optimization for UAV-assisted Mobile Edge Computing: A Deep Deterministic Policy Gradient Approach"

    722+1Variação de estrelas nos últimos 7 dias
  • PyPokerEngine@ishikota

    Mecanismo de pôquer para desenvolvimento de IA de pôquer em Python

    722+1Variação de estrelas nos últimos 7 dias
  • neuron_poker@dickreuter

    Ambiente de pôquer Texas Hold'em OpenAI Gym com aprendizado por reforço baseado em keras-rl. Inclui renderização virtual e Monte Carlo para cálculo de equidade.

    722+1Variação de estrelas nos últimos 7 dias
  • DeepRetrieval@pat-jj

    [COLM’25] DeepRetrieval — 🔥 Treinamento de agente de busca por RLVR com resultado de recuperação

    719+2Variação de estrelas nos últimos 7 dias
  • Uma lista selecionada de artigos sobre busca em árvore de Monte Carlo com implementações.

    715+1Variação de estrelas nos últimos 7 dias
  • Matterport3DSimulator@peteanderson80

    Plataforma de pesquisa de IA para aprendizado por reforço a partir de imagens panorâmicas reais.

    713+1Variação de estrelas nos últimos 7 dias
  • mpc-reinforcement-learning@FilippoAiraldi

    Aprendizado por reforço com controle preditivo de modelo (MPC).

    710+1Variação de estrelas nos últimos 7 dias
  • pymarl2@hijkzzz

    Algoritmos MARL ajustados no SMAC (100% de taxa de vitória na maioria dos cenários)

    708-1Variação de estrelas nos últimos 7 dias
  • Uma coleção abrangente de frontend e levantamento de artigos e modelos de repositórios GitHub sobre modelos de visão e linguagem. Atualizações contínuas.

    706+3Variação de estrelas nos últimos 7 dias
  • ns3-gym@tkn-tub

    ns3-gym - O ambiente de testes para Aprendizado por Reforço em pesquisas de redes

    693+2Variação de estrelas nos últimos 7 dias
  • Flow-Factory@X-GenGroup

    Uma estrutura unificada para aprendizado por reforço simplificado em modelos Flow-Matching

    692+7Variação de estrelas nos últimos 7 dias
  • irl-imitation@yrlu

    Implementação de algoritmos de Reinforcement Learning Inverso (IRL) em Python/Tensorflow. Deep MaxEnt, MaxEnt, LPIRL

    681+2Variação de estrelas nos últimos 7 dias
  • RosettaStone@utilForever

    Simulador de Hearthstone usando C++ com aprendizado por reforço

    680+1Variação de estrelas nos últimos 7 dias
  • AI-Toolbox@Svalorzen

    Um framework C++ para MDPs e POMDPs com bindings para Python

    671+1Variação de estrelas nos últimos 7 dias
  • Uma biblioteca PyTorch para construir agentes de aprendizado por reforço profundo.

    657+0Variação de estrelas nos últimos 7 dias
  • BenchMARL@facebookresearch

    BenchMARL é uma biblioteca para benchmark de Multi-Agent Reinforcement Learning (MARL). O BenchMARL permite comparar rapidamente diferentes algoritmos, tarefas e modelos de MARL, mantendo-se sistematicamente fundamentado em seus dois principais pilares: reprodutibilidade e padronização.

    656+2Variação de estrelas nos últimos 7 dias
  • Ciclo de vida completo de um projeto de ciência de dados

    653+0Variação de estrelas nos últimos 7 dias
  • ReinforcementLearning.jl@JuliaReinforcementLearning

    Um pacote de aprendizado por reforço para Julia

    652-1Variação de estrelas nos últimos 7 dias
  • Últimos avanços em raciocínio de cadeia de pensamento longa (Long Chain-of-Thought)

    647-1Variação de estrelas nos últimos 7 dias
  • pgx@sotetsuk

    ♟️ Ambientes de jogos de RL vetorizados em JAX

    644+3Variação de estrelas nos últimos 7 dias
  • Seg-Zero@JIA-Lab-research

    Página do projeto para "Seg-Zero: Reasoning-Chain Guided Segmentation via Cognitive Reinforcement"

    639+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos