Zum Hauptinhalt springen
buildradar
Sign in
Thema · multimodal-deep-learning

multimodal-deep-learning

Erfasste Open-Source-Repos mit dem Tag multimodal-deep-learning, sortiert nach Sternen.

Repos
13
Sterne gesamt
34.819
Sterne im Schnitt
2.678
Anteil
0,00%

Themen, die häufig gemeinsam mit multimodal-deep-learning am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit multimodal-deep-learning getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • LAVIS@salesforce

    LAVIS – Eine All-in-One-Bibliothek für Language-Vision Intelligence

    11.261-1Sterne-Änderung der letzten 7 Tage
  • FinRobot@AI4Finance-Foundation

    FinRobot: Eine Open-Source-KI-Agentenplattform für Finanzanwendungen unter Verwendung von Large Language Models 🚀

    7.902+33Sterne-Änderung der letzten 7 Tage
  • Time-LLM@KimMeen

    [ICLR 2024] Offizielle Implementierung von „ 🦙 Time-LLM: Time Series Forecasting by Reprogramming Large Language Models“

    2.688+3Sterne-Änderung der letzten 7 Tage
  • (ෆ`꒳´ෆ) Eine Übersicht über Text-zu-Bild-Generierung und -Synthese.

    2.444+0Sterne-Änderung der letzten 7 Tage
  • BitNet@kyegomez

    Implementierung von „BitNet: Scaling 1-bit Transformers for Large Language Models“ in PyTorch

    1.946+1Sterne-Änderung der letzten 7 Tage
  • AdvancedLiterateMachinery@AlibabaResearch

    Eine Sammlung originaler, innovativer Ideen und Algorithmen für Advanced Literate Machinery. Dieses Projekt wird vom OCR-Team im Language Technology Lab, Tongyi Lab der Alibaba Group gepflegt.

    1.835+1Sterne-Änderung der letzten 7 Tage
  • pytorch-widedeep@jrzaurin

    Ein flexibles Paket für multimodales Deep Learning zur Kombination von tabellarischen Daten mit Text und Bildern mithilfe von Wide- und Deep-Modellen in PyTorch

    1.416+0Sterne-Änderung der letzten 7 Tage
  • Sammlung der neuesten CVPR-Ergebnisse, einschließlich Arbeiten, Code und Demo-Videos. Empfehlungen sind herzlich willkommen!

    1.411+0Sterne-Änderung der letzten 7 Tage
  • Awesome Grounding: Eine kuratierte Liste von Forschungspapieren zum Visual Grounding

    1.127+0Sterne-Änderung der letzten 7 Tage
  • Eine Sammlung von Ressourcen zu Anwendungen des multimodalen Lernens in der medizinischen Bildgebung.

    975+1Sterne-Änderung der letzten 7 Tage
  • blended-latent-diffusion@omriav

    Offizielle Implementierung für „Blended Latent Diffusion“ [SIGGRAPH 2023]

    632+0Sterne-Änderung der letzten 7 Tage
  • MMMU@MMMU-Benchmark

    Dieses Repository enthält Evaluierungscode für das Paper "MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI"

    593+1Sterne-Änderung der letzten 7 Tage
  • VQASynth@remyxai

    Erstellung multimodaler Datensätze

    589+1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen