Pular para o conteúdo principal
buildradar
Sign in
Tópico · large-multimodal-models

large-multimodal-models

Repositórios de código aberto acompanhados marcados com large-multimodal-models, ordenados por estrelas.

Repositórios
9
Total de estrelas
10.371
Média de estrelas
1.152
Participação
0,00%

Tópicos que aparecem com frequência ao lado de large-multimodal-models no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com large-multimodal-models.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • VITA@VITA-MLLM

    ✨✨[NeurIPS 2025] VITA-1.5: Rumo à interação de visão e fala em tempo real no nível do GPT-4o

    2.532-1Variação de estrelas nos últimos 7 dias
  • [ICCV 2025] Implementação para Describe Anything: Legendas detalhadas e localizadas de imagens e vídeos

    1.517+3Variação de estrelas nos últimos 7 dias
  • Catálogo visual com curadoria de mais de 155 arquiteturas de modelos de linguagem visual (VLM/MLLM): artigos, diagramas, receitas de treinamento, conjuntos de dados e uma linha do tempo de lançamentos para agentes de IA multimodal.

    1.310+2Variação de estrelas nos últimos 7 dias
  • ShareGPT4Video@ShareGPT4Omni

    [NeurIPS 2024] Uma implementação oficial de "ShareGPT4Video: Improving Video Understanding and Generation with Better Captions"

    1.094+1Variação de estrelas nos últimos 7 dias
  • TinyLLaVA_Factory@TinyLLaVA

    Um framework para modelos multimodais grandes de pequena escala.

    1.004+1Variação de estrelas nos últimos 7 dias
  • Uma coleção de recursos sobre aplicações de aprendizado multimodal em imagens médicas.

    975+1Variação de estrelas nos últimos 7 dias
  • LLaVA-Plus-Codebase@LLaVA-VL

    LLaVA-Plus: Assistentes de linguagem e visão de grande escala que se conectam e aprendem a usar habilidades

    770+0Variação de estrelas nos últimos 7 dias
  • MMMU@MMMU-Benchmark

    Este repositório contém código de avaliação para o artigo "MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI"

    593+1Variação de estrelas nos últimos 7 dias
  • LLaVA-Mini@ictnlp

    LLaVA-Mini é um modelo multimodal grande (LMM) unificado que suporta a compreensão de imagens, imagens de alta resolução e vídeos de forma eficiente.

    577+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos