Saltar al contenido principal
buildradar
Sign in
Tema · vision-language-pretraining

vision-language-pretraining

Repositorios de código abierto monitorizados etiquetados con vision-language-pretraining, ordenados por estrellas.

Repositorios
5
Estrellas totales
37.849
Estrellas de media
7570
Proporción
0,00%

Temas que aparecen con frecuencia junto a vision-language-pretraining en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con vision-language-pretraining.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • Janus@deepseek-ai

    Serie Janus: Modelos unificados de comprensión y generación multimodal

    17.763+6Variación de estrellas de los últimos 7 días
  • LAVIS@salesforce

    LAVIS - Una biblioteca integral para inteligencia de lenguaje y visión

    11.261-1Variación de estrellas de los últimos 7 días
  • DeepSeek-VL@deepseek-ai

    DeepSeek-VL: Hacia la comprensión del lenguaje y la visión en el mundo real

    4177+2Variación de estrellas de los últimos 7 días
  • Video-LLaMA@DAMO-NLP-SG

    [EMNLP 2023 Demo] Video-LLaMA: un modelo de lenguaje audiovisual sintonizado por instrucciones para la comprensión de video

    3141+2Variación de estrellas de los últimos 7 días
  • Video-ChatGPT@mbzuai-oryx

    [ACL 2024] Video-ChatGPT es un modelo de conversación de video capaz de generar diálogos significativos sobre videos. Combina las capacidades de los LLMs con un codificador visual preentrenado adaptado para la representación espaciotemporal de video. También introducimos un riguroso 'Quantitative Evaluation Benchmarking' para modelos conversacionales basados en video.

    1507+1Variación de estrellas de los últimos 7 días
← Volver a temas