Aller au contenu principal
buildradar
Sign in
Sujet · vision-language-pretraining

vision-language-pretraining

Dépôts open source suivis étiquetés vision-language-pretraining, triés par étoiles.

Dépôts
5
Total d'étoiles
37 849
Étoiles en moyenne
7 570
Part
0,00%

Sujets qui apparaissent souvent aux côtés de vision-language-pretraining sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés vision-language-pretraining.

Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.

  • Janus@deepseek-ai

    Janus-Series : Modèles unifiés de compréhension et de génération multimodale.

    17 763+6Évolution des étoiles sur les 7 derniers jours
  • LAVIS@salesforce

    LAVIS - Une bibliothèque tout-en-un pour l'intelligence langage-vision.

    11 261-1Évolution des étoiles sur les 7 derniers jours
  • DeepSeek-VL@deepseek-ai

    DeepSeek-VL : Vers une compréhension vision-langage en conditions réelles

    4 177+2Évolution des étoiles sur les 7 derniers jours
  • Video-LLaMA@DAMO-NLP-SG

    [EMNLP 2023 Demo] Video-LLaMA : Un modèle de langage audio-visuel ajusté par instructions pour la compréhension vidéo.

    3 141+2Évolution des étoiles sur les 7 derniers jours
  • Video-ChatGPT@mbzuai-oryx

    [ACL 2024 🔥] Video-ChatGPT est un modèle de conversation vidéo capable de générer des échanges pertinents sur des vidéos. Il combine les capacités des LLM avec un encodeur visuel pré-entraîné adapté à la représentation spatio-temporelle des vidéos. Nous introduisons également un banc d'essai d'évaluation quantitative rigoureux pour les modèles conversationnels basés sur la vidéo.

    1 507+1Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets