Zum Hauptinhalt springen
buildradar
Sign in
Thema · large-vision-language-models

large-vision-language-models

Erfasste Open-Source-Repos mit dem Tag large-vision-language-models, sortiert nach Sternen.

Repos
6
Sterne gesamt
22.924
Sterne im Schnitt
3.821
Anteil
0,00%

Themen, die häufig gemeinsam mit large-vision-language-models am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit large-vision-language-models getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • :sparkles::sparkles: Neueste Fortschritte bei multimodalen Large Language Models

    17.996+8Sterne-Änderung der letzten 7 Tage
  • Ressourcen und Literaturverzeichnis für „Thinking with Images for LVLMs“. Dieses Repository begleitet unsere Übersichtsarbeit darüber, wie LVLMs visuelle Informationen für komplexe Schlussfolgerungen, Planung und Generierung nutzen können.

    1.502-1Sterne-Änderung der letzten 7 Tage
  • ShareGPT4Video@ShareGPT4Omni

    [NeurIPS 2024] Eine offizielle Implementierung von „ShareGPT4Video: Improving Video Understanding and Generation with Better Captions“

    1.094+0Sterne-Änderung der letzten 7 Tage
  • DoRA@NVlabs

    [ICML2024 (Oral)] Offizielle PyTorch-Implementierung von DoRA: Weight-Decomposed Low-Rank Adaptation

    991+0Sterne-Änderung der letzten 7 Tage
  • Video-MME@MME-Benchmarks

    ✨✨ [CVPR 2025] Video-MME: Der allererste umfassende Evaluierungsbenchmark für multimodale LLMs in der Videoanalyse

    791+3Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von Forschungsarbeiten zur LLM-basierten multimodalen Generierung (Bild, Video, 3D und Audio).

    552+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen