Aller au contenu principal
buildradar
Sign in
Sujet · llava

llava

Dépôts open source suivis étiquetés llava, triés par étoiles.

Dépôts
21
Total d'étoiles
66 002
Étoiles en moyenne
3 143
Part
0,00%

Sujets qui apparaissent souvent aux côtés de llava sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés llava.

Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.

  • LLaVA@haotian-liu

    [NeurIPS'23 Oral] Visual Instruction Tuning (LLaVA) conçu pour atteindre et dépasser les capacités de GPT-4V

    25 014+12Évolution des étoiles sur les 7 derniers jours
  • SUPIR@Fanghua-Yu

    SUPIR vise à développer des algorithmes pratiques pour la restauration d'images photoréalistes en conditions réelles. Notre nouvelle démo en ligne est disponible sur suppixel.ai.

    5 649+0Évolution des étoiles sur les 7 derniers jours
  • mlx-vlm@Blaizzy

    MLX-VLM est un package pour l'inférence et le réglage fin de modèles de vision par langage (VLM) sur Mac via MLX.

    5 462+41Évolution des étoiles sur les 7 derniers jours
  • VLMEvalKit@open-compass

    Boîte à outils d'évaluation open-source pour grands modèles multimodaux (LMM), prenant en charge plus de 220 LMM et 80 benchmarks

    4 375+15Évolution des étoiles sur les 7 derniers jours
  • zero_nlp@yuanzhoulvpi2017

    Solutions NLP en chinois (grands modèles, données, modèles, entraînement, inférence).

    3 836+2Évolution des étoiles sur les 7 derniers jours
  • LLamaSharp@SciSharp

    Une bibliothèque C#/.NET pour exécuter efficacement des LLM (🦙LLaMA/LLaVA) sur votre appareil local.

    3 790+3Évolution des étoiles sur les 7 derniers jours
  • Eagle@NVlabs

    Eagle : Modèles Vision-Langage de pointe avec des stratégies centrées sur les données.

    3 511+46Évolution des étoiles sur les 7 derniers jours
  • OmAgent@om-ai-lab

    [EMNLP-2024] Création d'agents linguistiques multimodaux pour le prototypage rapide et la production

    2 666+1Évolution des étoiles sur les 7 derniers jours
  • Video-ChatGPT@mbzuai-oryx

    [ACL 2024 🔥] Video-ChatGPT est un modèle de conversation vidéo capable de générer des échanges pertinents sur des vidéos. Il combine les capacités des LLM avec un encodeur visuel pré-entraîné adapté à la représentation spatio-temporelle des vidéos. Nous introduisons également un banc d'essai d'évaluation quantitative rigoureux pour les modèles conversationnels basés sur la vidéo.

    1 507+1Évolution des étoiles sur les 7 derniers jours
  • taggui@jhc13

    Gestionnaire de tags et outil de légende pour les jeux de données d'images

    1 348+2Évolution des étoiles sur les 7 derniers jours
  • UForm@unum-cloud

    IA multimodale de poche pour la compréhension et la génération de contenu textuel, image et bientôt vidéo, jusqu'à 5 fois plus rapide qu'OpenAI CLIP et LLaVA

    1 247+2Évolution des étoiles sur les 7 derniers jours
  • LLaVA-OneVision-2@EvolvingLMMs-Lab

    Framework entièrement ouvert pour la démocratisation de l'entraînement multimodal.

    1 195+3Évolution des étoiles sur les 7 derniers jours
  • TinyLLaVA_Factory@TinyLLaVA

    Un framework de modèles multimodaux à petite échelle.

    1 004+1Évolution des étoiles sur les 7 derniers jours
  • LLaVA-pp@mbzuai-oryx

    🔥🔥 LLaVA++ : Extension de LLaVA avec Phi-3 et LLaMA-3 (LLaVA LLaMA-3, LLaVA Phi-3)

    842+0Évolution des étoiles sur les 7 derniers jours
  • machina@PsyChip

    Système de vidéosurveillance basé sur OpenCV, YOLO et LLAVA

    794+1Évolution des étoiles sur les 7 derniers jours
  • PaddleMIX@PaddlePaddle

    Paddle Multimodal Integration and eXploration, prenant en charge les tâches multimodales courantes, incluant des modèles de pré-entraînement multimodaux à grande échelle et une boîte à outils de modèles de diffusion, alliant haute performance et flexibilité.

    724+1Évolution des étoiles sur les 7 derniers jours
  • Une collection frontend et un état de l'art complets des articles et modèles vision-langage sur GitHub. Mises à jour continues.

    705+5Évolution des étoiles sur les 7 derniers jours
  • 👁️ + 💬 + 🎧 = 🤖 Liste sélectionnée des principaux modèles de fondation et multimodaux ! [Article + Code + Exemples + Tutoriels]

    637+0Évolution des étoiles sur les 7 derniers jours
  • ComfyUI_VLM_nodes@gokayfem

    Nœuds ComfyUI pour les modèles vision-langage : Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Inclut également la détection à vocabulaire ouvert, la segmentation SAM2/SAM3, le raisonnement temporel vidéo, GGUF via llama.cpp et des API LLM/VLM hébergées.

    589+1Évolution des étoiles sur les 7 derniers jours
  • LLaVA-Mini@ictnlp

    LLaVA-Mini est un grand modèle multimodal (LMM) unifié capable de prendre en charge la compréhension d'images, d'images haute résolution et de vidéos de manière efficace.

    577+0Évolution des étoiles sur les 7 derniers jours
  • llama-assistant@nrl-ai

    Assistant alimenté par l'IA pour vous aider dans vos tâches quotidiennes, propulsé par Llama 3, DeepSeek R1 et de nombreux autres modèles sur HuggingFace.

    530+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets