Zum Hauptinhalt springen
buildradar
Sign in
Thema · multimodal-learning

multimodal-learning

Erfasste Open-Source-Repos mit dem Tag multimodal-learning, sortiert nach Sternen.

Repos
19
Sterne gesamt
31.776
Sterne im Schnitt
1.672
Anteil
0,00%

Themen, die häufig gemeinsam mit multimodal-learning am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit multimodal-learning getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • maths-cs-ai-compendium@HenryNdubuaku

    Werde zu einem herausragenden KI/ML-Forscher bzw. -Ingenieur mit diesem unkonventionellen Lehrbuch, das Mathematik, Computing und ML mit Intuition vermittelt.

    7.379+33Sterne-Änderung der letzten 7 Tage
  • Leseliste für Forschungsthemen im Bereich multimodales maschinelles Lernen.

    6.925+0Sterne-Änderung der letzten 7 Tage
  • open_flamingo@mlfoundations

    Ein Open-Source-Framework zum Training großer multimodaler Modelle.

    4.117-2Sterne-Änderung der letzten 7 Tage
  • CoOp@KaiyangZhou

    Prompt Learning für Vision-Language-Modelle (IJCV'22, CVPR'22)

    2.221+1Sterne-Änderung der letzten 7 Tage
  • UniRepLKNet@AILab-CVC

    [CVPR 2024 & TPAMI 2025] UniRepLKNet

    1.073+1Sterne-Änderung der letzten 7 Tage
  • cornac@PreferredAI

    Ein Vergleichs-Framework für multimodale Empfehlungssysteme

    1.053+0Sterne-Änderung der letzten 7 Tage
  • CLIP4Clip@ArrowLuo

    Eine offizielle Implementierung für „CLIP4Clip: An Empirical Study of CLIP for End to End Video Clip Retrieval“

    1.031+0Sterne-Änderung der letzten 7 Tage
  • Eine Sammlung von Ressourcen zu Anwendungen des multimodalen Lernens in der medizinischen Bildgebung.

    974+0Sterne-Änderung der letzten 7 Tage
  • ICCV-2023-25-Papers@DmitryRyumin

    ICCV 2023-2025 Papers: Entdecken Sie bahnbrechende Forschung von der ICCV 2023-25, der führenden Computer-Vision-Konferenz. Bleiben Sie auf dem neuesten Stand bei Computer Vision und Deep Learning, inklusive Code. ⭐ Unterstützen Sie die Entwicklung visueller Intelligenz!

    968-1Sterne-Änderung der letzten 7 Tage
  • MINT-1T@mlfoundations

    🍃 MINT-1T: Ein multimodaler, verschränkter Datensatz mit einer Billion Token.

    832+0Sterne-Änderung der letzten 7 Tage
  • ReLA@henghuiding

    [CVPR 2023 Highlight & IJCV 2026] GRES: Generalized Referring Expression Segmentation

    689+0Sterne-Änderung der letzten 7 Tage
  • MultiBench@pliang279

    [NeurIPS 2021] Multiskalen-Benchmarks für multimodales Repräsentationslernen

    636+0Sterne-Änderung der letzten 7 Tage
  • Multimodal-Toolkit@georgian-io

    Multimodales Modell für Text- und Tabellendaten mit HuggingFace Transformers als Baustein für Textdaten

    619+0Sterne-Änderung der letzten 7 Tage
  • MMMU@MMMU-Benchmark

    Dieses Repository enthält Evaluierungscode für das Paper "MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI"

    593+0Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste großartiger Ressourcen zu Vision und Sprache (noch im Aufbau... bleiben Sie dran!)

    564+1Sterne-Änderung der letzten 7 Tage
  • Eine Übersicht zur multimodalen Retrieval-Augmented Generation

    543+1Sterne-Änderung der letzten 7 Tage
  • ICASSP-2023-24-Papers@DmitryRyumin

    ICASSP 2023-2024 Papers: Eine vollständige Sammlung einflussreicher und spannender Forschungsarbeiten der ICASSP 2023-24 Konferenzen. Entdecken Sie die neuesten Fortschritte in Akustik, Sprach- und Signalverarbeitung. Inklusive Code.

    525+0Sterne-Änderung der letzten 7 Tage
  • MeViS@henghuiding

    [ICCV 2023 & TPAMI 2025] MeViS: Ein groß angelegter Benchmark für Videosegmentierung mit Bewegungsausdrücken

    525+0Sterne-Änderung der letzten 7 Tage
  • XPretrain@microsoft

    Multimodales Vortraining

    510-2Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen