reinforcement-learning
Repositórios de código aberto acompanhados marcados com reinforcement-learning, ordenados por estrelas.
- #181
Algoritmo Asynchronous Advantage Actor-Critic (A3C) para Super Mario Bros.
★ 1.111-1Variação de estrelas nos últimos 7 dias - #182★ 1.103+2Variação de estrelas nos últimos 7 dias
- #183
Biblioteca modular de Aprendizado por Reforço (RL) (implementada em PyTorch, JAX e NVIDIA Warp) com suporte para Gymnasium/Gym, NVIDIA Isaac Lab, MuJoCo Playground e outros ambientes
★ 1.095+2Variação de estrelas nos últimos 7 dias - #184
Biblioteca que fornece tarefas de manipulação manual dual destra através do Isaac Gym.
★ 1.094+7Variação de estrelas nos últimos 7 dias - #185★ 1.085+4Variação de estrelas nos últimos 7 dias
- #186
Um índice de algoritmos para aprendizado por reforço offline (offline-rl)
★ 1.078+3Variação de estrelas nos últimos 7 dias - #187
Um fork do gym-retro com jogos, emuladores e plataformas suportadas adicionais
★ 1.078+396Variação de estrelas nos últimos 7 dias - #188
Ambientes de Aprendizagem por Reforço para Controle de Sinais de Trânsito com SUMO. Compatível com Gymnasium, PettingZoo e bibliotecas populares de RL.
★ 1.075+3Variação de estrelas nos últimos 7 dias - #189
Livros / PDFs / EPUBS para diferentes áreas de programação. LEIA, CRESÇA E APROVEITE
★ 1.066+5Variação de estrelas nos últimos 7 dias - #190
Guia essencial para acompanhar IA/ML/DL/CV
★ 1.063+0Variação de estrelas nos últimos 7 dias - #191
A pilha de melhoria contínua para agentes. Nossos dados de ambiente e avaliações impulsionam a melhoria e o monitoramento de agentes.
★ 1.060+2Variação de estrelas nos últimos 7 dias - #192
Implementação de código para "Learning Efficient Online 3D Bin Packing on Packing Configuration Trees". Propomos melhorar a aplicabilidade prática do problema de empacotamento 3D online (BPP) através do aprendizado em uma árvore de configuração de empacotamento hierárquica, o que torna o modelo de aprendizado por reforço profundo (DRL) capaz de lidar com restrições práticas e ter um bom desempenho mesmo com espaço de solução contínuo.
★ 1.047+1Variação de estrelas nos últimos 7 dias - #193★ 1.043+1Variação de estrelas nos últimos 7 dias
- #194
Caminho de aprendizado completo para engenheiros de agentes: domine a engenharia de IA do zero, com 20 etapas, 503 aulas, tradução completa, site de suporte e vídeos explicativos animados; um guia para se tornar um engenheiro de agentes de IA.
★ 1.042+40Variação de estrelas nos últimos 7 dias - #195★ 1.033+3Variação de estrelas nos últimos 7 dias
- #196
Códigos-fonte para o livro "Reinforcement Learning: Theory and Python Implementation"
★ 1.033+3Variação de estrelas nos últimos 7 dias - #197
Deep RL para controle MPC de locomoção de robô quadrúpede
★ 1.024+3Variação de estrelas nos últimos 7 dias - #198
Aprendizado por reforço síncrono e assíncrono de alto rendimento.
★ 1.021+0Variação de estrelas nos últimos 7 dias - #199
Coleção de artigos clássicos e de ponta da indústria de recomendação e publicidade / Artigos obrigatórios sobre sistemas de recomendação e previsão de CTR
★ 1.016+0Variação de estrelas nos últimos 7 dias - #200
Um ambiente de benchmark para desempenho humano-IA totalmente cooperativo.
★ 1.003+5Variação de estrelas nos últimos 7 dias - #201
Materiais incríveis de IA para jogos de Aprendizagem por Reforço Multi-Agente
★ 979+2Variação de estrelas nos últimos 7 dias - #202
Um poderoso modelo de áudio de aprendizado por reforço baseado em LLM de 3B parâmetros que se destaca na edição de Emoção, estilo de fala e paralinguística, e apresenta robusta conversão de texto em fala zero-shot
★ 972+1Variação de estrelas nos últimos 7 dias - #203★ 968+64Variação de estrelas nos últimos 7 dias
- #204
Uma coleção de ambientes de simulação de robótica para aprendizado por reforço.
★ 963+1Variação de estrelas nos últimos 7 dias - #205
Universidade de Código Aberto de Machine Learning
★ 955+0Variação de estrelas nos últimos 7 dias - #206
Lista de design molecular e de materiais usando Generative AI e Deep Learning
★ 952+1Variação de estrelas nos últimos 7 dias - #207
Otimizando o aprendizado por reforço com RLOps. Algoritmos e ferramentas de ponta de RL, com treinamento 10x mais rápido por meio de otimização evolutiva de hiperparâmetros.
★ 951+5Variação de estrelas nos últimos 7 dias - #208
PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama
★ 947—Variação de estrelas nos últimos 7 dias - #209★ 947+1Variação de estrelas nos últimos 7 dias
- #210★ 944+6Variação de estrelas nos últimos 7 dias