llava
Repositorios de código abierto monitorizados etiquetados con llava, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a llava en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con llava.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
[NeurIPS'23 Oral] Ajuste de instrucciones visuales (LLaVA) diseñado para alcanzar capacidades del nivel de GPT-4V y superiores.
★ 25.014+9Variación de estrellas de los últimos 7 días - #2
SUPIR tiene como objetivo desarrollar algoritmos prácticos para la restauración fotorrealista de imágenes en entornos reales. Nuestra nueva demo en línea también está disponible en suppixel.ai.
★ 5649-3Variación de estrellas de los últimos 7 días - #3
MLX-VLM es un paquete para la inferencia y ajuste fino de modelos de lenguaje visual (VLM) en tu Mac utilizando MLX.
★ 5462+25Variación de estrellas de los últimos 7 días - #4
Kit de herramientas de evaluación de código abierto para grandes modelos multimodales (LMMs), compatible con más de 220 LMMs y más de 80 benchmarks
★ 4375+13Variación de estrellas de los últimos 7 días - #5
Solución NLP en chino (grandes modelos, datos, modelos, entrenamiento, inferencia)
★ 3836+2Variación de estrellas de los últimos 7 días - #6
Una biblioteca de C#/.NET para ejecutar LLM (🦙LLaMA/LLaVA) en tu dispositivo local de manera eficiente.
★ 3790+2Variación de estrellas de los últimos 7 días - #7★ 3511+32Variación de estrellas de los últimos 7 días
- #8
[EMNLP-2024] Construye agentes de lenguaje multimodales para prototipado rápido y producción
★ 2666+1Variación de estrellas de los últimos 7 días - #9
[ACL 2024] Video-ChatGPT es un modelo de conversación de video capaz de generar diálogos significativos sobre videos. Combina las capacidades de los LLMs con un codificador visual preentrenado adaptado para la representación espaciotemporal de video. También introducimos un riguroso 'Quantitative Evaluation Benchmarking' para modelos conversacionales basados en video.
★ 1507+1Variación de estrellas de los últimos 7 días - #10★ 1348+2Variación de estrellas de los últimos 7 días
- #11
IA multimodal de bolsillo para la comprensión y generación de contenido en textos multilingües, imágenes y próximamente video, hasta 5 veces más rápida que OpenAI CLIP y LLaVA.
★ 1247+1Variación de estrellas de los últimos 7 días - #12
Framework totalmente abierto para el entrenamiento multimodal democratizado.
★ 1195+1Variación de estrellas de los últimos 7 días - #13
Un framework de modelos multimodales grandes a pequeña escala
★ 1004+1Variación de estrellas de los últimos 7 días - #14
🔥🔥 LLaVA++: Extensión de LLaVA con Phi-3 y LLaMA-3 (LLaVA LLaMA-3, LLaVA Phi-3).
★ 842+0Variación de estrellas de los últimos 7 días - #15★ 794+1Variación de estrellas de los últimos 7 días
- #16
Paddle Multimodal Integration and eXploration, que soporta tareas multimodales convencionales, incluyendo modelos de preentrenamiento multimodal a gran escala de extremo a extremo y un conjunto de herramientas de modelos de difusión. Equipado con alto rendimiento y flexibilidad.
★ 723-1Variación de estrellas de los últimos 7 días - #17
Una colección completa de recursos sobre modelos de lenguaje visual, incluyendo artículos y repositorios de modelos. Actualización continua.
★ 706+3Variación de estrellas de los últimos 7 días - #18
👁️ + 💬 + 🎧 = 🤖 Lista curada de los mejores modelos fundamentales y multimodales. [Artículos + Código + Ejemplos + Tutoriales]
★ 637+0Variación de estrellas de los últimos 7 días - #19
Nodos de ComfyUI para modelos de lenguaje visual: Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Incluye detección de vocabulario abierto, segmentación SAM2/SAM3, razonamiento temporal de video, GGUF mediante llama.cpp y APIs de LLM/VLM alojadas.
★ 588-1Variación de estrellas de los últimos 7 días - #20
LLaVA-Mini es un modelo multimodal grande (LMM) unificado que admite la comprensión de imágenes, imágenes de alta resolución y videos de manera eficiente.
★ 577+0Variación de estrellas de los últimos 7 días - #21
Asistente impulsado por IA para ayudar con las tareas diarias, basado en Llama 3, DeepSeek R1 y muchos otros modelos de HuggingFace.
★ 530+0Variación de estrellas de los últimos 7 días