large-multimodal-models
large-multimodal-models टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर large-multimodal-models के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और large-multimodal-models टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1★ 2,532-1पिछले 7 दिनों में स्टार का बदलाव
- #2
[ICCV 2025] Describe Anything के लिए इम्प्लीमेंटेशन: विस्तृत स्थानीयकृत इमेज और वीडियो कैप्शनिंग
★ 1,517+3पिछले 7 दिनों में स्टार का बदलाव - #3
155+ विजन-लैंग्वेज मॉडल (VLM/MLLM) आर्किटेक्चर की क्यूरेटेड विजुअल कैटलॉग: पेपर, आरेख, ट्रेनिंग रेसिपी, डेटासेट, और मल्टीमॉडल AI एजेंटों के लिए रिलीज़ टाइमलाइन।
★ 1,310+2पिछले 7 दिनों में स्टार का बदलाव - #4
[NeurIPS 2024] "ShareGPT4Video: Improving Video Understanding and Generation with Better Captions" का आधिकारिक कार्यान्वयन
★ 1,094+1पिछले 7 दिनों में स्टार का बदलाव - #5
छोटे पैमाने के लार्ज मल्टीमॉडल मॉडल्स का एक फ्रेमवर्क
★ 1,004+1पिछले 7 दिनों में स्टार का बदलाव - #6
मेडिकल इमेजिंग में मल्टी-मोडल लर्निंग के अनुप्रयोगों पर संसाधनों का एक संग्रह
★ 975+1पिछले 7 दिनों में स्टार का बदलाव - #7
LLaVA-Plus: बड़े भाषा और विजन सहायक जो कौशल का उपयोग करना प्लग और सीख सकते हैं
★ 770+0पिछले 7 दिनों में स्टार का बदलाव - #8
यह रिपॉजिटरी "MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI" पेपर के लिए मूल्यांकन कोड प्रदान करती है।
★ 593+1पिछले 7 दिनों में स्टार का बदलाव - #9
LLaVA-Mini एक एकीकृत बड़ा मल्टीмодальный मॉडल (LMM) है जो छवियों, उच्च-रिज़ॉल्यूशन छवियों और वीडियो की समझ को कुशलता से समर्थन कर सकता है।
★ 577+0पिछले 7 दिनों में स्टार का बदलाव