Zum Hauptinhalt springen
buildradar
Sign in
Thema · vision-language-pretraining

vision-language-pretraining

Erfasste Open-Source-Repos mit dem Tag vision-language-pretraining, sortiert nach Sternen.

Repos
5
Sterne gesamt
37.849
Sterne im Schnitt
7.570
Anteil
0,00%

Themen, die häufig gemeinsam mit vision-language-pretraining am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit vision-language-pretraining getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • Janus@deepseek-ai

    Janus-Series: Unified Multimodal Understanding and Generation Models

    17.763+1Sterne-Änderung der letzten 7 Tage
  • LAVIS@salesforce

    LAVIS – Eine All-in-One-Bibliothek für Language-Vision Intelligence

    11.261-1Sterne-Änderung der letzten 7 Tage
  • DeepSeek-VL@deepseek-ai

    DeepSeek-VL: Auf dem Weg zum realen Vision-Language-Verständnis

    4.177+2Sterne-Änderung der letzten 7 Tage
  • Video-LLaMA@DAMO-NLP-SG

    [EMNLP 2023 Demo] Video-LLaMA: Ein instruktionsoptimiertes audio-visuelles Sprachmodell für das Videoverständnis

    3.141+2Sterne-Änderung der letzten 7 Tage
  • Video-ChatGPT@mbzuai-oryx

    [ACL 2024 🔥] Video-ChatGPT ist ein Video-Konversationsmodell, das sinnvolle Gespräche über Videos generieren kann. Es kombiniert die Fähigkeiten von LLMs mit einem vortrainierten visuellen Encoder, der für die spatiotemporale Videorepräsentation angepasst ist. Wir stellen außerdem ein rigoroses 'Quantitative Evaluation Benchmarking' für videobasierte Konversationsmodelle vor.

    1.507+1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen