visual-language-learning
Erfasste Open-Source-Repos mit dem Tag visual-language-learning, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit visual-language-learning am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit visual-language-learning getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
[NeurIPS'23 Oral] Visual Instruction Tuning (LLaVA) in Richtung GPT-4V-Niveaufähigkeiten und darüber hinaus gebaut.
★ 25.005+9Sterne-Änderung der letzten 7 Tage - #2
Code und Modelle für das ICML 2024-Paper, NExT-GPT: Any-to-Any Multimodal Large Language Model
★ 3.635-1Sterne-Änderung der letzten 7 Tage - #3
🦦 Otter, ein multimodales Modell basierend auf OpenFlamingo (Open-Source-Version von DeepMinds Flamingo), trainiert auf MIMIC-IT mit verbesserten Fähigkeiten zur Befehlsausfolgung und zum In-Context-Lernen.
★ 3.437+2Sterne-Änderung der letzten 7 Tage - #4
InternLM-XComposer2.5-OmniLive: Ein umfassendes multimodales System für langfristige Streaming-Video- und Audio-Interaktionen
★ 2.925+1Sterne-Änderung der letzten 7 Tage