Pular para o conteúdo principal
buildradar
Sign in
Proprietário · opendilab

opendilab

Repositórios de código aberto acompanhados de opendilab, ordenados por estrelas.

16 repositórios
  • awesome-RLHF@opendilab

    Uma lista curada de recursos sobre aprendizado por reforço com feedback humano (atualizada continuamente).

    4.424+2Variação de estrelas nos últimos 7 dias
  • DI-engine@opendilab

    OpenDILab Decision AI Engine. O framework de Reinforcement Learning mais abrangente.

    3.642+1Variação de estrelas nos últimos 7 dias
  • PPOxFamily@opendilab

    Curso tutorial de DRL PPO x Family (Curso introdutório de inteligência de decisão: 8 aulas para entender a teoria dos algoritmos, a lógica do código e aplicar IA de decisão)

    2.616+2Variação de estrelas nos últimos 7 dias
  • LightZero@opendilab

    [NeurIPS 2023 Spotlight] LightZero: Um benchmark unificado para Monte Carlo Tree Search em cenários de decisão sequencial geral (awesome MCTS).

    1.642+4Variação de estrelas nos últimos 7 dias
  • Uma lista curada de recursos sobre modelos de difusão em RL (atualizada continuamente).

    1.635+2Variação de estrelas nos últimos 7 dias
  • Uma lista curada de recursos incríveis sobre RL baseada em modelos (atualizada continuamente)

    1.393+0Variação de estrelas nos últimos 7 dias
  • DI-star@opendilab

    Uma plataforma de inteligência artificial para StarCraft II com treinamento distribuído em larga escala e agentes de nível grand-master.

    1.393+0Variação de estrelas nos últimos 7 dias
  • LMDrive@opendilab

    [CVPR 2024] LMDrive: Condução de ponta a ponta em malha fechada com Large Language Models

    929+0Variação de estrelas nos últimos 7 dias
  • Uma lista com curadoria de recursos do Decision Transformer (atualizada continuamente)

    916+0Variação de estrelas nos últimos 7 dias
  • Uma lista curada de recursos incríveis de RL de exploração (atualizada continuamente)

    723+0Variação de estrelas nos últimos 7 dias
  • InterFuser@opendilab

    [CoRL 2022] InterFuser: Condução autônoma aprimorada para segurança usando Transformer de fusão de sensores interpretável

    652-1Variação de estrelas nos últimos 7 dias
  • DI-drive@opendilab

    Plataforma de Inteligência de Decisão para simulação de direção autônoma.

    639+1Variação de estrelas nos últimos 7 dias
  • Uma lista curada de recursos de Aprendizagem por Reforço Multimodal (atualizada continuamente)

    620+1Variação de estrelas nos últimos 7 dias
  • LLMRiddles@opendilab

    Reprodução/Demonstração de código aberto do jogo LLM Riddles

    587+0Variação de estrelas nos últimos 7 dias
  • CleanS2S@opendilab

    Agente interativo de fala para fala (Speech-to-Speech) de alta qualidade e em streaming implementado em um único arquivo.

    541+0Variação de estrelas nos últimos 7 dias
  • DI-sheep@opendilab

    Sheep a Sheep + Aprendizado por Reforço Profundo (Deep Reinforcement Learning + Jogo 3 Tiles)

    519+0Variação de estrelas nos últimos 7 dias
← Voltar para o ranking de proprietários