Saltar al contenido principal
buildradar
Sign in
Tema · llava

llava

Repositorios de código abierto monitorizados etiquetados con llava, ordenados por estrellas.

Repositorios
21
Estrellas totales
66.002
Estrellas de media
3143
Proporción
0,00%

Temas que aparecen con frecuencia junto a llava en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con llava.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • LLaVA@haotian-liu

    [NeurIPS'23 Oral] Ajuste de instrucciones visuales (LLaVA) diseñado para alcanzar capacidades del nivel de GPT-4V y superiores.

    25.014+9Variación de estrellas de los últimos 7 días
  • SUPIR@Fanghua-Yu

    SUPIR tiene como objetivo desarrollar algoritmos prácticos para la restauración fotorrealista de imágenes en entornos reales. Nuestra nueva demo en línea también está disponible en suppixel.ai.

    5649-3Variación de estrellas de los últimos 7 días
  • mlx-vlm@Blaizzy

    MLX-VLM es un paquete para la inferencia y ajuste fino de modelos de lenguaje visual (VLM) en tu Mac utilizando MLX.

    5462+25Variación de estrellas de los últimos 7 días
  • VLMEvalKit@open-compass

    Kit de herramientas de evaluación de código abierto para grandes modelos multimodales (LMMs), compatible con más de 220 LMMs y más de 80 benchmarks

    4375+13Variación de estrellas de los últimos 7 días
  • zero_nlp@yuanzhoulvpi2017

    Solución NLP en chino (grandes modelos, datos, modelos, entrenamiento, inferencia)

    3836+2Variación de estrellas de los últimos 7 días
  • LLamaSharp@SciSharp

    Una biblioteca de C#/.NET para ejecutar LLM (🦙LLaMA/LLaVA) en tu dispositivo local de manera eficiente.

    3790+2Variación de estrellas de los últimos 7 días
  • Eagle@NVlabs

    Eagle: Modelos de lenguaje y visión de vanguardia con estrategias centradas en datos

    3511+32Variación de estrellas de los últimos 7 días
  • OmAgent@om-ai-lab

    [EMNLP-2024] Construye agentes de lenguaje multimodales para prototipado rápido y producción

    2666+1Variación de estrellas de los últimos 7 días
  • Video-ChatGPT@mbzuai-oryx

    [ACL 2024] Video-ChatGPT es un modelo de conversación de video capaz de generar diálogos significativos sobre videos. Combina las capacidades de los LLMs con un codificador visual preentrenado adaptado para la representación espaciotemporal de video. También introducimos un riguroso 'Quantitative Evaluation Benchmarking' para modelos conversacionales basados en video.

    1507+1Variación de estrellas de los últimos 7 días
  • taggui@jhc13

    Gestor de etiquetas y generador de subtítulos para conjuntos de datos de imágenes

    1348+2Variación de estrellas de los últimos 7 días
  • UForm@unum-cloud

    IA multimodal de bolsillo para la comprensión y generación de contenido en textos multilingües, imágenes y próximamente video, hasta 5 veces más rápida que OpenAI CLIP y LLaVA.

    1247+1Variación de estrellas de los últimos 7 días
  • LLaVA-OneVision-2@EvolvingLMMs-Lab

    Framework totalmente abierto para el entrenamiento multimodal democratizado.

    1195+1Variación de estrellas de los últimos 7 días
  • TinyLLaVA_Factory@TinyLLaVA

    Un framework de modelos multimodales grandes a pequeña escala

    1004+1Variación de estrellas de los últimos 7 días
  • LLaVA-pp@mbzuai-oryx

    🔥🔥 LLaVA++: Extensión de LLaVA con Phi-3 y LLaMA-3 (LLaVA LLaMA-3, LLaVA Phi-3).

    842+0Variación de estrellas de los últimos 7 días
  • machina@PsyChip

    Sistema de videovigilancia impulsado por OpenCV, YOLO y LLAVA.

    794+1Variación de estrellas de los últimos 7 días
  • PaddleMIX@PaddlePaddle

    Paddle Multimodal Integration and eXploration, que soporta tareas multimodales convencionales, incluyendo modelos de preentrenamiento multimodal a gran escala de extremo a extremo y un conjunto de herramientas de modelos de difusión. Equipado con alto rendimiento y flexibilidad.

    723-1Variación de estrellas de los últimos 7 días
  • Una colección completa de recursos sobre modelos de lenguaje visual, incluyendo artículos y repositorios de modelos. Actualización continua.

    706+3Variación de estrellas de los últimos 7 días
  • 👁️ + 💬 + 🎧 = 🤖 Lista curada de los mejores modelos fundamentales y multimodales. [Artículos + Código + Ejemplos + Tutoriales]

    637+0Variación de estrellas de los últimos 7 días
  • ComfyUI_VLM_nodes@gokayfem

    Nodos de ComfyUI para modelos de lenguaje visual: Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Incluye detección de vocabulario abierto, segmentación SAM2/SAM3, razonamiento temporal de video, GGUF mediante llama.cpp y APIs de LLM/VLM alojadas.

    588-1Variación de estrellas de los últimos 7 días
  • LLaVA-Mini@ictnlp

    LLaVA-Mini es un modelo multimodal grande (LMM) unificado que admite la comprensión de imágenes, imágenes de alta resolución y videos de manera eficiente.

    577+0Variación de estrellas de los últimos 7 días
  • llama-assistant@nrl-ai

    Asistente impulsado por IA para ayudar con las tareas diarias, basado en Llama 3, DeepSeek R1 y muchos otros modelos de HuggingFace.

    530+0Variación de estrellas de los últimos 7 días
← Volver a temas