reinforcement-learning
Repositórios de código aberto acompanhados marcados com reinforcement-learning, ordenados por estrelas.
- #61
Compilação de materiais de estudo sobre ChatGPT, com atualizações contínuas
★ 4.190+1Variação de estrelas nos últimos 7 dias - #62★ 4.054+2Variação de estrelas nos últimos 7 dias
- #63
Um agendamento personalizado moderno para Anki baseado no algoritmo Free Spaced Repetition Scheduler
★ 4.052+1Variação de estrelas nos últimos 7 dias - #64
Estas são as anotações manuscritas do curso de Andrew NG no Coursera.
★ 3.808+6Variação de estrelas nos últimos 7 dias - #65★ 3.727+0Variação de estrelas nos últimos 7 dias
- #66★ 3.726+12Variação de estrelas nos últimos 7 dias
- #67
Exemplos de Reinforcement Learning mínimos e limpos
★ 3.660+0Variação de estrelas nos últimos 7 dias - #68
Curso introdutório, avançado e especializado de Deep Learning, casos acadêmicos, casos de prática industrial, enciclopédia de conhecimento de Deep Learning e banco de questões de entrevistas. O curso, o caso e o conhecimento de Deep Learning e IA
★ 3.651+2Variação de estrelas nos últimos 7 dias - #69
OpenDILab Decision AI Engine. O framework de Reinforcement Learning mais abrangente.
★ 3.642+1Variação de estrelas nos últimos 7 dias - #70
Uma implementação do algoritmo AlphaZero para Gomoku (também conhecido como Gobang ou Cinco em Linha)
★ 3.627+2Variação de estrelas nos últimos 7 dias - #71
Artigos clássicos e recursos sobre sistemas de recomendação.
★ 3.568+1Variação de estrelas nos últimos 7 dias - #72★ 3.545+4Variação de estrelas nos últimos 7 dias
- #73
Uma biblioteca PyTorch modular, focada em primitivas e em Python para Aprendizado por Reforço.
★ 3.545+5Variação de estrelas nos últimos 7 dias - #74
Aprendizado por reforço / Bots de IA em jogos de cartas (pôquer) - Blackjack, Leduc, Texas, DouDizhu, Mahjong, UNO.
★ 3.541+0Variação de estrelas nos últimos 7 dias - #75
Uma API padrão para ambientes de aprendizado por reforço multiagente, com ambientes de referência populares e utilitários relacionados
★ 3.503+4Variação de estrelas nos últimos 7 dias - #76★ 3.496-1Variação de estrelas nos últimos 7 dias
- #77
Depuração, monitoramento e visualização para Machine Learning e Ciência de Dados em Python.
★ 3.472+1Variação de estrelas nos últimos 7 dias - #78
Um framework de treinamento distribuído de alto desempenho para Aprendizado por Reforço
★ 3.454+1Variação de estrelas nos últimos 7 dias - #79
Implementação PyTorch limpa, robusta e unificada de algoritmos populares de Deep Reinforcement Learning (DRL) (Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL).
★ 3.440+3Variação de estrelas nos últimos 7 dias - #80★ 3.382+0Variação de estrelas nos últimos 7 dias
- #81
Tensorforce: uma biblioteca TensorFlow para aprendizado por reforço aplicado.
★ 3.305+0Variação de estrelas nos últimos 7 dias - #82
Uma coleção de ambientes para direção autônoma e tarefas de tomada de decisão tática
★ 3.302+3Variação de estrelas nos últimos 7 dias - #83
Manipulation Skill Framework, um simulador e benchmark de robótica de código aberto paralelizado em GPU.
★ 3.283+13Variação de estrelas nos últimos 7 dias - #84★ 3.227+1Variação de estrelas nos últimos 7 dias
- #85
Links de recursos cuidadosamente selecionados para ciência de dados em um só lugar
★ 3.222+1Variação de estrelas nos últimos 7 dias - #86
Skywork-R1V é uma série avançada de modelos de IA multimodal desenvolvida pela Skywork AI, especializada em raciocínio de visão e linguagem.
★ 3.168+0Variação de estrelas nos últimos 7 dias - #87
[NeurIPS 2024] OSWorld: Benchmarking de agentes multimodais para tarefas abertas em ambientes computacionais reais.
★ 3.118+6Variação de estrelas nos últimos 7 dias - #88
Uma biblioteca modular de alto nível para treinar agentes de IA incorporada (embodied AI) em uma variedade de tarefas e ambientes.
★ 3.117+6Variação de estrelas nos últimos 7 dias - #89
Cursos gratuitos de aprendizado de máquina e IA com videoaulas.
★ 3.112+0Variação de estrelas nos últimos 7 dias - #90
TradeMaster é uma plataforma de código aberto para negociação quantitativa potencializada por aprendizado por reforço :fire: :zap: :rainbow:.
★ 3.056+2Variação de estrelas nos últimos 7 dias