Pular para o conteúdo principal
buildradar
Sign in
Tópico · reinforcement-learning

reinforcement-learning

Repositórios de código aberto acompanhados marcados com reinforcement-learning, ordenados por estrelas.

305 repositórios
  • Compilação de materiais de estudo sobre ChatGPT, com atualizações contínuas

    4.190+1Variação de estrelas nos últimos 7 dias
  • acme@google-deepmind

    Uma biblioteca de componentes e agentes de aprendizado por reforço.

    4.054+2Variação de estrelas nos últimos 7 dias
  • fsrs4anki@open-spaced-repetition

    Um agendamento personalizado moderno para Anki baseado no algoritmo Free Spaced Repetition Scheduler

    4.052+1Variação de estrelas nos últimos 7 dias
  • Andrew-NG-Notes@ashishpatel26

    Estas são as anotações manuscritas do curso de Andrew NG no Coursera.

    3.808+6Variação de estrelas nos últimos 7 dias
  • polyaxon@polyaxon

    Infraestrutura de IA / Orquestração de IA / Plano de Controle de IA.

    3.727+0Variação de estrelas nos últimos 7 dias
  • dreamerv3@danijar

    Dominando diversos domínios através de modelos de mundo.

    3.726+12Variação de estrelas nos últimos 7 dias
  • Exemplos de Reinforcement Learning mínimos e limpos

    3.660+0Variação de estrelas nos últimos 7 dias
  • awesome-DeepLearning@PaddlePaddle

    Curso introdutório, avançado e especializado de Deep Learning, casos acadêmicos, casos de prática industrial, enciclopédia de conhecimento de Deep Learning e banco de questões de entrevistas. O curso, o caso e o conhecimento de Deep Learning e IA

    3.651+2Variação de estrelas nos últimos 7 dias
  • DI-engine@opendilab

    OpenDILab Decision AI Engine. O framework de Reinforcement Learning mais abrangente.

    3.642+1Variação de estrelas nos últimos 7 dias
  • AlphaZero_Gomoku@junxiaosong

    Uma implementação do algoritmo AlphaZero para Gomoku (também conhecido como Gobang ou Cinco em Linha)

    3.627+2Variação de estrelas nos últimos 7 dias
  • Reco-papers@wzhe06

    Artigos clássicos e recursos sobre sistemas de recomendação.

    3.568+1Variação de estrelas nos últimos 7 dias
  • ml-course@girafe-ai

    Curso aberto de Machine Learning

    3.545+4Variação de estrelas nos últimos 7 dias
  • rl@pytorch

    Uma biblioteca PyTorch modular, focada em primitivas e em Python para Aprendizado por Reforço.

    3.545+5Variação de estrelas nos últimos 7 dias
  • rlcard@datamllab

    Aprendizado por reforço / Bots de IA em jogos de cartas (pôquer) - Blackjack, Leduc, Texas, DouDizhu, Mahjong, UNO.

    3.541+0Variação de estrelas nos últimos 7 dias
  • PettingZoo@Farama-Foundation

    Uma API padrão para ambientes de aprendizado por reforço multiagente, com ambientes de referência populares e utilitários relacionados

    3.503+4Variação de estrelas nos últimos 7 dias
  • MetaClaw@aiming-lab

    🦞 Apenas fale com seu agente — ele aprende e EVOLUI 🧬.

    3.496-1Variação de estrelas nos últimos 7 dias
  • tensorwatch@microsoft

    Depuração, monitoramento e visualização para Machine Learning e Ciência de Dados em Python.

    3.472+1Variação de estrelas nos últimos 7 dias
  • PARL@PaddlePaddle

    Um framework de treinamento distribuído de alto desempenho para Aprendizado por Reforço

    3.454+1Variação de estrelas nos últimos 7 dias
  • DRL-Pytorch@XinJingHao

    Implementação PyTorch limpa, robusta e unificada de algoritmos populares de Deep Reinforcement Learning (DRL) (Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL).

    3.440+3Variação de estrelas nos últimos 7 dias
  • catalyst@catalyst-team

    P&D de deep learning acelerado

    3.382+0Variação de estrelas nos últimos 7 dias
  • tensorforce@tensorforce

    Tensorforce: uma biblioteca TensorFlow para aprendizado por reforço aplicado.

    3.305+0Variação de estrelas nos últimos 7 dias
  • HighwayEnv@Farama-Foundation

    Uma coleção de ambientes para direção autônoma e tarefas de tomada de decisão tática

    3.302+3Variação de estrelas nos últimos 7 dias
  • ManiSkill@mani-skill

    Manipulation Skill Framework, um simulador e benchmark de robótica de código aberto paralelizado em GPU.

    3.283+13Variação de estrelas nos últimos 7 dias
  • brax@google

    Simulação de física de corpo rígido massivamente paralela em hardware acelerador

    3.227+1Variação de estrelas nos últimos 7 dias
  • Links de recursos cuidadosamente selecionados para ciência de dados em um só lugar

    3.222+1Variação de estrelas nos últimos 7 dias
  • Skywork-R1V@SkyworkAI

    Skywork-R1V é uma série avançada de modelos de IA multimodal desenvolvida pela Skywork AI, especializada em raciocínio de visão e linguagem.

    3.168+0Variação de estrelas nos últimos 7 dias
  • OSWorld@xlang-ai

    [NeurIPS 2024] OSWorld: Benchmarking de agentes multimodais para tarefas abertas em ambientes computacionais reais.

    3.118+6Variação de estrelas nos últimos 7 dias
  • habitat-lab@facebookresearch

    Uma biblioteca modular de alto nível para treinar agentes de IA incorporada (embodied AI) em uma variedade de tarefas e ambientes.

    3.117+6Variação de estrelas nos últimos 7 dias
  • Cursos gratuitos de aprendizado de máquina e IA com videoaulas.

    3.112+0Variação de estrelas nos últimos 7 dias
  • TradeMaster@TradeMaster-NTU

    TradeMaster é uma plataforma de código aberto para negociação quantitativa potencializada por aprendizado por reforço :fire: :zap: :rainbow:.

    3.056+2Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos