Aller au contenu principal
buildradar
Sign in
Sujet · large-multimodal-models

large-multimodal-models

Dépôts open source suivis étiquetés large-multimodal-models, triés par étoiles.

Dépôts
9
Total d'étoiles
10 371
Étoiles en moyenne
1 152
Part
0,00%

Sujets qui apparaissent souvent aux côtés de large-multimodal-models sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés large-multimodal-models.

Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.

  • VITA@VITA-MLLM

    ✨✨[NeurIPS 2025] VITA-1.5 : Vers une interaction vision et parole en temps réel au niveau de GPT-4o.

    2 532-1Évolution des étoiles sur les 7 derniers jours
  • [ICCV 2025] Implémentation de Describe Anything : sous-titrage détaillé et localisé d'images et de vidéos

    1 517+3Évolution des étoiles sur les 7 derniers jours
  • Catalogue visuel organisé de plus de 155 architectures de modèles vision-langage (VLM/MLLM) : articles, diagrammes, recettes d'entraînement, jeux de données et chronologie des versions pour les agents IA multimodaux.

    1 310+2Évolution des étoiles sur les 7 derniers jours
  • ShareGPT4Video@ShareGPT4Omni

    [NeurIPS 2024] Implémentation officielle de "ShareGPT4Video: Improving Video Understanding and Generation with Better Captions"

    1 094+1Évolution des étoiles sur les 7 derniers jours
  • TinyLLaVA_Factory@TinyLLaVA

    Un framework de modèles multimodaux à petite échelle.

    1 004+1Évolution des étoiles sur les 7 derniers jours
  • Une collection de ressources sur les applications de l'apprentissage multimodal en imagerie médicale

    975+1Évolution des étoiles sur les 7 derniers jours
  • LLaVA-Plus-Codebase@LLaVA-VL

    LLaVA-Plus : assistants de langage et de vision capables d'apprendre et d'utiliser des compétences.

    770+0Évolution des étoiles sur les 7 derniers jours
  • MMMU@MMMU-Benchmark

    Ce dépôt contient le code d'évaluation pour l'article "MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI"

    593+1Évolution des étoiles sur les 7 derniers jours
  • LLaVA-Mini@ictnlp

    LLaVA-Mini est un grand modèle multimodal (LMM) unifié capable de prendre en charge la compréhension d'images, d'images haute résolution et de vidéos de manière efficace.

    577+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets