reinforcement-learning
Repositórios de código aberto acompanhados marcados com reinforcement-learning, ordenados por estrelas.
- #241
Ambientes Gymnasium multi-objetivo para aprendizado por reforço
★ 760-1Variação de estrelas nos últimos 7 dias - #242★ 737+2Variação de estrelas nos últimos 7 dias
- #243
Pacote contrib para Stable-Baselines3 - Código experimental de aprendizado por reforço (RL).
★ 736+5Variação de estrelas nos últimos 7 dias - #244
Este é um projeto sobre algoritmo autônomo de desvio de obstáculos por aprendizado por reforço profundo para UAV.
★ 730+0Variação de estrelas nos últimos 7 dias - #245★ 730+1Variação de estrelas nos últimos 7 dias
- #246
Código complementar para a publicação na Nature "Discovering State-of-the-art Reinforcement Algorithms"
★ 728+2Variação de estrelas nos últimos 7 dias - #247★ 727—Variação de estrelas nos últimos 7 dias
- #248★ 726-1Variação de estrelas nos últimos 7 dias
- #249
Uma lista curada de recursos incríveis de RL de exploração (atualizada continuamente)
★ 723+0Variação de estrelas nos últimos 7 dias - #250
Código para o artigo "Computation Offloading Optimization for UAV-assisted Mobile Edge Computing: A Deep Deterministic Policy Gradient Approach"
★ 722+1Variação de estrelas nos últimos 7 dias - #251
Mecanismo de pôquer para desenvolvimento de IA de pôquer em Python
★ 722+1Variação de estrelas nos últimos 7 dias - #252
Ambiente de pôquer Texas Hold'em OpenAI Gym com aprendizado por reforço baseado em keras-rl. Inclui renderização virtual e Monte Carlo para cálculo de equidade.
★ 722+1Variação de estrelas nos últimos 7 dias - #253
[COLM’25] DeepRetrieval — 🔥 Treinamento de agente de busca por RLVR com resultado de recuperação
★ 719+2Variação de estrelas nos últimos 7 dias - #254
Uma lista selecionada de artigos sobre busca em árvore de Monte Carlo com implementações.
★ 715+1Variação de estrelas nos últimos 7 dias - #255
Plataforma de pesquisa de IA para aprendizado por reforço a partir de imagens panorâmicas reais.
★ 713+1Variação de estrelas nos últimos 7 dias - #256
Aprendizado por reforço com controle preditivo de modelo (MPC).
★ 710+1Variação de estrelas nos últimos 7 dias - #257★ 708-1Variação de estrelas nos últimos 7 dias
- #258
Uma coleção abrangente de frontend e levantamento de artigos e modelos de repositórios GitHub sobre modelos de visão e linguagem. Atualizações contínuas.
★ 706+3Variação de estrelas nos últimos 7 dias - #259★ 693+2Variação de estrelas nos últimos 7 dias
- #260
Uma estrutura unificada para aprendizado por reforço simplificado em modelos Flow-Matching
★ 692+7Variação de estrelas nos últimos 7 dias - #261
Implementação de algoritmos de Reinforcement Learning Inverso (IRL) em Python/Tensorflow. Deep MaxEnt, MaxEnt, LPIRL
★ 681+2Variação de estrelas nos últimos 7 dias - #262
Simulador de Hearthstone usando C++ com aprendizado por reforço
★ 680+1Variação de estrelas nos últimos 7 dias - #263
Um framework C++ para MDPs e POMDPs com bindings para Python
★ 671+1Variação de estrelas nos últimos 7 dias - #264
Uma biblioteca PyTorch para construir agentes de aprendizado por reforço profundo.
★ 657+0Variação de estrelas nos últimos 7 dias - #265
BenchMARL é uma biblioteca para benchmark de Multi-Agent Reinforcement Learning (MARL). O BenchMARL permite comparar rapidamente diferentes algoritmos, tarefas e modelos de MARL, mantendo-se sistematicamente fundamentado em seus dois principais pilares: reprodutibilidade e padronização.
★ 656+2Variação de estrelas nos últimos 7 dias - #266
Ciclo de vida completo de um projeto de ciência de dados
★ 653+0Variação de estrelas nos últimos 7 dias - #267
Um pacote de aprendizado por reforço para Julia
★ 652-1Variação de estrelas nos últimos 7 dias - #268
Últimos avanços em raciocínio de cadeia de pensamento longa (Long Chain-of-Thought)
★ 647-1Variação de estrelas nos últimos 7 dias - #269★ 644+3Variação de estrelas nos últimos 7 dias
- #270
Página do projeto para "Seg-Zero: Reasoning-Chain Guided Segmentation via Cognitive Reinforcement"
★ 639+0Variação de estrelas nos últimos 7 dias