llava
Dépôts open source suivis étiquetés llava, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de llava sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés llava.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
[NeurIPS'23 Oral] Visual Instruction Tuning (LLaVA) conçu pour atteindre et dépasser les capacités de GPT-4V
★ 25 014+12Évolution des étoiles sur les 7 derniers jours - #2
SUPIR vise à développer des algorithmes pratiques pour la restauration d'images photoréalistes en conditions réelles. Notre nouvelle démo en ligne est disponible sur suppixel.ai.
★ 5 649+0Évolution des étoiles sur les 7 derniers jours - #3
MLX-VLM est un package pour l'inférence et le réglage fin de modèles de vision par langage (VLM) sur Mac via MLX.
★ 5 462+41Évolution des étoiles sur les 7 derniers jours - #4
Boîte à outils d'évaluation open-source pour grands modèles multimodaux (LMM), prenant en charge plus de 220 LMM et 80 benchmarks
★ 4 375+15Évolution des étoiles sur les 7 derniers jours - #5
Solutions NLP en chinois (grands modèles, données, modèles, entraînement, inférence).
★ 3 836+2Évolution des étoiles sur les 7 derniers jours - #6
Une bibliothèque C#/.NET pour exécuter efficacement des LLM (🦙LLaMA/LLaVA) sur votre appareil local.
★ 3 790+3Évolution des étoiles sur les 7 derniers jours - #7★ 3 511+46Évolution des étoiles sur les 7 derniers jours
- #8
[EMNLP-2024] Création d'agents linguistiques multimodaux pour le prototypage rapide et la production
★ 2 666+1Évolution des étoiles sur les 7 derniers jours - #9
[ACL 2024 🔥] Video-ChatGPT est un modèle de conversation vidéo capable de générer des échanges pertinents sur des vidéos. Il combine les capacités des LLM avec un encodeur visuel pré-entraîné adapté à la représentation spatio-temporelle des vidéos. Nous introduisons également un banc d'essai d'évaluation quantitative rigoureux pour les modèles conversationnels basés sur la vidéo.
★ 1 507+1Évolution des étoiles sur les 7 derniers jours - #10★ 1 348+2Évolution des étoiles sur les 7 derniers jours
- #11
IA multimodale de poche pour la compréhension et la génération de contenu textuel, image et bientôt vidéo, jusqu'à 5 fois plus rapide qu'OpenAI CLIP et LLaVA
★ 1 247+2Évolution des étoiles sur les 7 derniers jours - #12
Framework entièrement ouvert pour la démocratisation de l'entraînement multimodal.
★ 1 195+3Évolution des étoiles sur les 7 derniers jours - #13
Un framework de modèles multimodaux à petite échelle.
★ 1 004+1Évolution des étoiles sur les 7 derniers jours - #14
🔥🔥 LLaVA++ : Extension de LLaVA avec Phi-3 et LLaMA-3 (LLaVA LLaMA-3, LLaVA Phi-3)
★ 842+0Évolution des étoiles sur les 7 derniers jours - #15★ 794+1Évolution des étoiles sur les 7 derniers jours
- #16
Paddle Multimodal Integration and eXploration, prenant en charge les tâches multimodales courantes, incluant des modèles de pré-entraînement multimodaux à grande échelle et une boîte à outils de modèles de diffusion, alliant haute performance et flexibilité.
★ 724+1Évolution des étoiles sur les 7 derniers jours - #17
Une collection frontend et un état de l'art complets des articles et modèles vision-langage sur GitHub. Mises à jour continues.
★ 705+5Évolution des étoiles sur les 7 derniers jours - #18
👁️ + 💬 + 🎧 = 🤖 Liste sélectionnée des principaux modèles de fondation et multimodaux ! [Article + Code + Exemples + Tutoriels]
★ 637+0Évolution des étoiles sur les 7 derniers jours - #19
Nœuds ComfyUI pour les modèles vision-langage : Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Inclut également la détection à vocabulaire ouvert, la segmentation SAM2/SAM3, le raisonnement temporel vidéo, GGUF via llama.cpp et des API LLM/VLM hébergées.
★ 589+1Évolution des étoiles sur les 7 derniers jours - #20
LLaVA-Mini est un grand modèle multimodal (LMM) unifié capable de prendre en charge la compréhension d'images, d'images haute résolution et de vidéos de manière efficace.
★ 577+0Évolution des étoiles sur les 7 derniers jours - #21
Assistant alimenté par l'IA pour vous aider dans vos tâches quotidiennes, propulsé par Llama 3, DeepSeek R1 et de nombreux autres modèles sur HuggingFace.
★ 530+0Évolution des étoiles sur les 7 derniers jours