Saltar al contenido principal
buildradar
Sign in
Tema · vision-and-language

vision-and-language

Repositorios de código abierto monitorizados etiquetados con vision-and-language, ordenados por estrellas.

Repositorios
23
Estrellas totales
63.821
Estrellas de media
2775
Proporción
0,00%

Temas que aparecen con frecuencia junto a vision-and-language en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con vision-and-language.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • Un repositorio integral para actualizaciones de investigación en IA generativa, recursos de entrevistas, notebooks y mucho más.

    29.211+213Variación de estrellas de los últimos 7 días
  • LAVIS@salesforce

    LAVIS - Una biblioteca integral para inteligencia de lenguaje y visión

    11.261-1Variación de estrellas de los últimos 7 días
  • maestro@roboflow

    Optimiza el proceso de ajuste fino (fine-tuning) para modelos multimodales: PaliGemma 2, Florence-2 y Qwen2.5-VL.

    2695+1Variación de estrellas de los últimos 7 días
  • OmAgent@om-ai-lab

    [EMNLP-2024] Construye agentes de lenguaje multimodales para prototipado rápido y producción

    2666+1Variación de estrellas de los últimos 7 días
  • ViLT@dandelin

    Código para el artículo de ICML 2021 (charla larga): "ViLT: Vision-and-Language Transformer Without Convolution or Region Supervision"

    1538+0Variación de estrellas de los últimos 7 días
  • awesome-japanese-llm@llm-jp

    Resumen de LLM en japonés - Descripción general de los LLM japoneses.

    1428+1Variación de estrellas de los últimos 7 días
  • OmDet@om-ai-lab

    Detección de objetos de extremo a extremo, en tiempo real y con vocabulario abierto

    1393+0Variación de estrellas de los últimos 7 días
  • prismer@NVlabs

    Implementación de Prismer: un modelo de lenguaje y visión con expertos multitarea

    1309+0Variación de estrellas de los últimos 7 días
  • Aria@rhymes-ai

    Base de código para Aria, un MoE nativo multimodal abierto.

    1088+1Variación de estrellas de los últimos 7 días
  • ONE-PEACE@OFA-Sys

    Un modelo de representación general para modalidades de visión, audio y lenguaje. Artículo: ONE-PEACE: Explorando un modelo de representación general hacia modalidades ilimitadas.

    1060+0Variación de estrellas de los últimos 7 días
  • PointLLM@InternRobotics

    [Candidato a mejor artículo en ECCV 2024 y TPAMI 2025] PointLLM: Potenciando a los modelos de lenguaje extenso para comprender nubes de puntos.

    1053+2Variación de estrellas de los últimos 7 días
  • DoRA@NVlabs

    [ICML2024 (Oral)] Implementación oficial en PyTorch de DoRA: Weight-Decomposed Low-Rank Adaptation

    994+1Variación de estrellas de los últimos 7 días
  • calvin@mees

    CALVIN: un benchmark para el aprendizaje de políticas condicionadas por lenguaje en tareas de manipulación robótica de largo horizonte

    985+8Variación de estrellas de los últimos 7 días
  • groundingLMM@mbzuai-oryx

    [CVPR 2024 🔥] Grounding Large Multimodal Model (GLaMM), el primer modelo de su clase capaz de generar respuestas en lenguaje natural integradas perfectamente con máscaras de segmentación de objetos.

    967+0Variación de estrellas de los últimos 7 días
  • Este repositorio es una colección curada de los artículos más interesantes e influyentes de CVPR 2025. 🔥 [Artículo + Código + Demo]

    895+1Variación de estrellas de los últimos 7 días
  • AlphaCLIP@SunzeY

    [CVPR 2024] Alpha-CLIP: un modelo CLIP que se enfoca donde tú quieras.

    874+0Variación de estrellas de los últimos 7 días
  • Este repositorio es una colección curada de los artículos más interesantes e influyentes de CVPR 2024. 🔥 [Artículo + Código + Demo]

    735+0Variación de estrellas de los últimos 7 días
  • Matterport3DSimulator@peteanderson80

    Plataforma de investigación de IA para aprendizaje por refuerzo a partir de imágenes panorámicas reales.

    713+2Variación de estrellas de los últimos 7 días
  • Este repositorio es una colección curada de los artículos más interesantes e influyentes de CVPR 2023. 🔥 [Artículo + Código]

    649+0Variación de estrellas de los últimos 7 días
  • Proctoring-AI@vardanagarwal

    Creación de software para la supervisión automática en exámenes en línea.

    634-1Variación de estrellas de los últimos 7 días
  • Una lista curada para navegación de visión y lenguaje. Artículo de ACL 2022 "Vision-and-Language Navigation: A Survey of Tasks, Methods, and Future Directions".

    607+2Variación de estrellas de los últimos 7 días
  • Una lista curada de recursos sobre visión y lenguaje (aún en construcción... ¡mantente atento!)

    564+0Variación de estrellas de los últimos 7 días
  • Este repositorio enumera los artículos relevantes resumidos en nuestro estudio: Un estudio sistemático de la ingeniería de prompts en modelos fundacionales de visión-lenguaje.

    513+0Variación de estrellas de los últimos 7 días
← Volver a temas