reinforcement-learning
Repositórios de código aberto acompanhados marcados com reinforcement-learning, ordenados por estrelas.
- #121
Rainbow é tudo o que você precisa! Um tutorial passo a passo de DQN até Rainbow
★ 2.032+0Variação de estrelas nos últimos 7 dias - #122★ 2.025+4Variação de estrelas nos últimos 7 dias
- #123
Deep Learning avançado com Keras, publicado pela Packt
★ 2.023+0Variação de estrelas nos últimos 7 dias - #124
Central de recursos para desenvolvedores NVIDIA Nemotron — um recurso completo com receitas de treinamento, guias de uso, conjuntos de dados e exemplos de referência de ponta a ponta para criar com modelos Nemotron
★ 2.015+18Variação de estrelas nos últimos 7 dias - #125
🚀 Recursos de IA GRATUITOS - 🎓 Cursos, 👷 Vagas, 📝 Blogs, 🔬 Pesquisa em IA e muito mais - para todos!
★ 1.975+9Variação de estrelas nos últimos 7 dias - #126★ 1.972+1Variação de estrelas nos últimos 7 dias
- #127
Implementação de todos os algoritmos de RL de uma forma mais simples
★ 1.929+7Variação de estrelas nos últimos 7 dias - #128
Ambiente de negociação e backtesting para treinar agentes de aprendizado por reforço ou algoritmos baseados em regras simples
★ 1.915+2Variação de estrelas nos últimos 7 dias - #129
RoboVerse: Rumo a uma plataforma, conjunto de dados e benchmark unificados para aprendizado de robôs escalável e generalizável.
★ 1.851+11Variação de estrelas nos últimos 7 dias - #130
Alguns livros e PDFs incríveis relacionados a IA para aprendizado e download, além de modelos de playground para estudo
★ 1.799+2Variação de estrelas nos últimos 7 dias - #131★ 1.789+1Variação de estrelas nos últimos 7 dias
- #132★ 1.722+0Variação de estrelas nos últimos 7 dias
- #133
O código de treinamento de aprendizado por reforço para o AgiBot X1.
★ 1.698-1Variação de estrelas nos últimos 7 dias - #134★ 1.695+0Variação de estrelas nos últimos 7 dias
- #135
Neuroevolução profunda
★ 1.666-1Variação de estrelas nos últimos 7 dias - #136
[NeurIPS 2023 Spotlight] LightZero: Um benchmark unificado para Monte Carlo Tree Search em cenários de decisão sequencial geral (awesome MCTS).
★ 1.642+4Variação de estrelas nos últimos 7 dias - #137
Safe RLHF: Alinhamento de valor restrito via Aprendizado por Reforço Seguro a partir de Feedback Humano
★ 1.613+1Variação de estrelas nos últimos 7 dias - #138
[IEEE RA-L'25] NavRL: Aprendendo voo seguro em ambientes dinâmicos (NVIDIA Isaac/Python/ROS1/ROS2)
★ 1.599+7Variação de estrelas nos últimos 7 dias - #139
Um pacote de código aberto que permite a criadores de videogames, pesquisadores de IA e entusiastas aprender comportamentos complexos para seus personagens não jogáveis ou agentes.
★ 1.578+1Variação de estrelas nos últimos 7 dias - #140
Curso gratuito que leva você do zero ao nível PRO em Aprendizado por Reforço.
★ 1.570+0Variação de estrelas nos últimos 7 dias - #141
AgentEvolver: Rumo a um sistema de agentes autoevolutivos eficiente
★ 1.552+3Variação de estrelas nos últimos 7 dias - #142
🚀🀄️ Uma IA rápida e forte para riichi mahjong, alimentada por Rust e aprendizado por reforço profundo.
★ 1.539+8Variação de estrelas nos últimos 7 dias - #143
Uma lista curada dos melhores recursos de Inteligência Artificial
★ 1.522+2Variação de estrelas nos últimos 7 dias - #144
Motor de execução de ambiente paralelo de alto desempenho baseado em C++ (ambiente vetorizado) para ambientes de RL geral.
★ 1.513+2Variação de estrelas nos últimos 7 dias - #145
Para deep RL e o futuro da IA.
★ 1.513+0Variação de estrelas nos últimos 7 dias - #146
[NeurIPS 2025 Spotlight] Ambientes de raciocínio para aprendizado por reforço com recompensas verificáveis
★ 1.500+3Variação de estrelas nos últimos 7 dias - #147
Uma lista curada de links e bibliotecas de software úteis para robôs.
★ 1.483+3Variação de estrelas nos últimos 7 dias - #148
Uma coleção de Jupyter notebooks de referência e demonstrações de aplicações de IA/ML para casos de uso corporativo: marketing, precificação, cadeia de suprimentos, manufatura inteligente e muito mais.
★ 1.453+1Variação de estrelas nos últimos 7 dias - #149
TextWorld é um ambiente de aprendizado sandbox para o treinamento e avaliação de agentes de aprendizado por reforço (RL) em jogos baseados em texto.
★ 1.442+1Variação de estrelas nos últimos 7 dias - #150
Ferramentas de treinamento e implantação de RL sim-to-real para o robô Unitree Go1.
★ 1.440+0Variação de estrelas nos últimos 7 dias