opendilab
Repositórios de código aberto acompanhados de opendilab, ordenados por estrelas.
- #1
Uma lista curada de recursos sobre aprendizado por reforço com feedback humano (atualizada continuamente).
★ 4.424+2Variação de estrelas nos últimos 7 dias - #2
OpenDILab Decision AI Engine. O framework de Reinforcement Learning mais abrangente.
★ 3.642+1Variação de estrelas nos últimos 7 dias - #3
Curso tutorial de DRL PPO x Family (Curso introdutório de inteligência de decisão: 8 aulas para entender a teoria dos algoritmos, a lógica do código e aplicar IA de decisão)
★ 2.616+2Variação de estrelas nos últimos 7 dias - #4
[NeurIPS 2023 Spotlight] LightZero: Um benchmark unificado para Monte Carlo Tree Search em cenários de decisão sequencial geral (awesome MCTS).
★ 1.642+4Variação de estrelas nos últimos 7 dias - #5
Uma lista curada de recursos sobre modelos de difusão em RL (atualizada continuamente).
★ 1.635+2Variação de estrelas nos últimos 7 dias - #6
Uma lista curada de recursos incríveis sobre RL baseada em modelos (atualizada continuamente)
★ 1.393+0Variação de estrelas nos últimos 7 dias - #7
Uma plataforma de inteligência artificial para StarCraft II com treinamento distribuído em larga escala e agentes de nível grand-master.
★ 1.393+0Variação de estrelas nos últimos 7 dias - #8
[CVPR 2024] LMDrive: Condução de ponta a ponta em malha fechada com Large Language Models
★ 929+0Variação de estrelas nos últimos 7 dias - #9
Uma lista com curadoria de recursos do Decision Transformer (atualizada continuamente)
★ 916+0Variação de estrelas nos últimos 7 dias - #10
Uma lista curada de recursos incríveis de RL de exploração (atualizada continuamente)
★ 723+0Variação de estrelas nos últimos 7 dias - #11
[CoRL 2022] InterFuser: Condução autônoma aprimorada para segurança usando Transformer de fusão de sensores interpretável
★ 652-1Variação de estrelas nos últimos 7 dias - #12★ 639+1Variação de estrelas nos últimos 7 dias
- #13
Uma lista curada de recursos de Aprendizagem por Reforço Multimodal (atualizada continuamente)
★ 620+1Variação de estrelas nos últimos 7 dias - #14
Reprodução/Demonstração de código aberto do jogo LLM Riddles
★ 587+0Variação de estrelas nos últimos 7 dias - #15
Agente interativo de fala para fala (Speech-to-Speech) de alta qualidade e em streaming implementado em um único arquivo.
★ 541+0Variação de estrelas nos últimos 7 dias - #16
Sheep a Sheep + Aprendizado por Reforço Profundo (Deep Reinforcement Learning + Jogo 3 Tiles)
★ 519+0Variação de estrelas nos últimos 7 dias