visual-language-learning
Dépôts open source suivis étiquetés visual-language-learning, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de visual-language-learning sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés visual-language-learning.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
[NeurIPS'23 Oral] Visual Instruction Tuning (LLaVA) conçu pour atteindre et dépasser les capacités de GPT-4V
★ 25 014+12Évolution des étoiles sur les 7 derniers jours - #2
Code et modèles pour l'article ICML 2024, NExT-GPT : un modèle de langage multimodal Any-to-Any.
★ 3 634-3Évolution des étoiles sur les 7 derniers jours - #3
Otter, un modèle multimodal basé sur OpenFlamingo (version open source du Flamingo de DeepMind), entraîné sur MIMIC-IT, offrant de meilleures capacités de suivi d'instructions et d'apprentissage en contexte.
★ 3 438+2Évolution des étoiles sur les 7 derniers jours - #4
InternLM-XComposer2.5-OmniLive : un système multimodal complet pour les interactions vidéo et audio en streaming à long terme.
★ 2 925+0Évolution des étoiles sur les 7 derniers jours