Pular para o conteúdo principal
buildradar
Sign in
Tópico · vision-language-pretraining

vision-language-pretraining

Repositórios de código aberto acompanhados marcados com vision-language-pretraining, ordenados por estrelas.

Repositórios
5
Total de estrelas
37.849
Média de estrelas
7.570
Participação
0,00%

Tópicos que aparecem com frequência ao lado de vision-language-pretraining no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com vision-language-pretraining.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • Janus@deepseek-ai

    Série Janus: Modelos unificados de compreensão e geração multimodal.

    17.763+1Variação de estrelas nos últimos 7 dias
  • LAVIS@salesforce

    LAVIS - Uma biblioteca completa para inteligência de linguagem e visão

    11.261-1Variação de estrelas nos últimos 7 dias
  • DeepSeek-VL@deepseek-ai

    DeepSeek-VL: Rumo à compreensão de visão e linguagem no mundo real

    4.177+2Variação de estrelas nos últimos 7 dias
  • Video-LLaMA@DAMO-NLP-SG

    [EMNLP 2023 Demo] Video-LLaMA: Um modelo de linguagem audiovisual ajustado por instruções para compreensão de vídeo

    3.141+2Variação de estrelas nos últimos 7 dias
  • Video-ChatGPT@mbzuai-oryx

    [ACL 2024 🔥] Video-ChatGPT é um modelo de conversação de vídeo capaz de gerar conversas significativas sobre vídeos. Ele combina as capacidades de LLMs com um codificador visual pré-treinado adaptado para representação de vídeo espaço-temporal. Também apresentamos um 'Benchmarking de Avaliação Quantitativa' rigoroso para modelos de conversação baseados em vídeo.

    1.507+1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos