multi-modal
multi-modal टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर multi-modal के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और multi-modal टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
ऐसे एजेंट बनाएँ और चलाएँ जिन्हें आप देख सकें, समझ सकें और जिन पर भरोसा कर सकें।
★ 30,463+420पिछले 7 दिनों में स्टार का बदलाव - #2★ 26,283+27पिछले 7 दिनों में स्टार का बदलाव
- #3
बातचीत वाले वॉइस AI एजेंटों के लिए ओपन-सोर्स फ्रेमवर्क
★ 11,102+10पिछले 7 दिनों में स्टार का बदलाव - #4
[CVPR 2024 Oral] InternVL Family: GPT-4o का एक अग्रणी ओपन-सोर्स विकल्प। GPT-4o जैसा प्रदर्शन देने वाला ओपन-सोर्स मल्टीमॉडल वार्ता मॉडल
★ 10,150+3पिछले 7 दिनों में स्टार का बदलाव - #5
ModelScope: Model-as-a-Service की अवधारणा को साकार करना।
★ 9,121+4पिछले 7 दिनों में स्टार का बदलाव - #6
अत्याधुनिक मॉडलों द्वारा संचालित AI सूट जो उन्नत AI/AGI कार्य प्रदान करता है। इसमें AI पर्सना, AGI कार्य, विश्व स्तरीय Beam मल्टी-मॉडल चैट, टेक्स्ट-टू-इमेज, वॉयस, रिस्पांस स्ट्रीमिंग, कोड हाइलाइटिंग और निष्पादन, PDF आयात, डेवलपर्स के लिए प्रीसेट और बहुत कुछ शामिल है। ऑन-प्रिमाइसेस या क्लाउड में तैनात करें।
★ 7,108+1पिछले 7 दिनों में स्टार का बदलाव - #7
फाउंडेशन मॉडल के लिए और उनके साथ डेटा प्रोसेसिंग! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷
★ 6,975+26पिछले 7 दिनों में स्टार का बदलाव - #8★ 6,744+0पिछले 7 दिनों में स्टार का बदलाव
- #9★ 6,154+24पिछले 7 दिनों में स्टार का बदलाव
- #10
CLIP का चीनी संस्करण जो चीनी क्रॉस-मोडल पुनर्प्राप्ति और प्रतिनिधित्व पीढ़ी को प्राप्त करता है।
★ 6,001+1पिछले 7 दिनों में स्टार का बदलाव - #11
Pytorch में OpenAI के टेक्स्ट टू इमेज ट्रांसफॉर्मर, DALL-E का कार्यान्वयन / प्रतिकृति
★ 5,626-2पिछले 7 दिनों में स्टार का बदलाव - #12★ 5,031-1पिछले 7 दिनों में स्टार का बदलाव
- #13★ 4,476+1पिछले 7 दिनों में स्टार का बदलाव
- #14
लार्ज मल्टी-मोडालिटी मॉडल (LMMs) का ओपन-सोर्स मूल्यांकन टूलकिट, 220+ LMMs, 80+ बेंचमार्क का समर्थन करता है।
★ 4,375+13पिछले 7 दिनों में स्टार का बदलाव - #15
OmniGen: एकीकृत छवि निर्माण (Unified Image Generation)। https://arxiv.org/pdf/2409.11340
★ 4,342+1पिछले 7 दिनों में स्टार का बदलाव - #16
चीनी और अंग्रेजी मल्टीमोडल संवादात्मक भाषा मॉडल | 多模态中英双语对话语言模型
★ 4,155+0पिछले 7 दिनों में स्टार का बदलाव - #17
आपके स्थानीय डिवाइस पर LLM (🦙LLaMA/LLaVA) को कुशलतापूर्वक चलाने के लिए एक C#/.NET लाइब्रेरी।
★ 3,790+2पिछले 7 दिनों में स्टार का बदलाव - #18
[EMNLP 2024🔥] Video-LLaVA: प्रोजेक्शन से पहले एलाइनमेंट द्वारा यूनाइटेड विजुअल रिप्रेजेंटेशन सीखना
★ 3,500+1पिछले 7 दिनों में स्टार का बदलाव - #19
MCP इंटीग्रेशन, मल्टीमॉडल वर्कफ़्लो, IoT समर्थन और क्रॉस-प्लेटफ़ॉर्म वॉयस इंटरैक्शन के साथ ओपन-सोर्स AI सहायक生态系统।
★ 3,463+9पिछले 7 दिनों में स्टार का बदलाव - #20★ 3,123-1पिछले 7 दिनों में स्टार का बदलाव
- #21★ 2,674+0पिछले 7 दिनों में स्टार का बदलाव
- #22★ 2,433+0पिछले 7 दिनों में स्टार का बदलाव
- #23★ 2,322+0पिछले 7 दिनों में स्टार का बदलाव
- #24
सिफ़ारिश (Recommendation), विज्ञापन (Advertising) और खोज (Search) के क्षेत्र में उद्योग के क्लासिक और अत्याधुनिक शोध पत्रों का संग्रह।
★ 2,188-1पिछले 7 दिनों में स्टार का बदलाव - #25
[NeurIPS 2023] MotionGPT: मानव गति को एक विदेशी भाषा के रूप में, LLMs का उपयोग करने वाला एक एकीकृत गति-भाषा जनरेशन मॉडल
★ 1,963+1पिछले 7 दिनों में स्टार का बदलाव - #26
Discord के लिए एक मजबूत, ऑल-इन-वन GPT इंटरफेस। ChatGPT-शैली की बातचीत, इमेज जनरेशन, AI-मॉडरेशन, कस्टम इंडेक्स/नॉलेजबेस, YouTube सारांशकर्ता, और बहुत कुछ!
★ 1,853-2पिछले 7 दिनों में स्टार का बदलाव - #27★ 1,521+3पिछले 7 दिनों में स्टार का बदलाव
- #28
[pip install medmnist] 2D और 3D बायोमेडिकल इमेज क्लासिफ़िकेशन के लिए 18x मानकीकृत डेटासेट
★ 1,399+0पिछले 7 दिनों में स्टार का बदलाव - #29
MetaAI के "Predict the Next Token and Diffuse Images with One Multi-Modal Model" (Transfusion) का Pytorch कार्यान्वयन
★ 1,398+3पिछले 7 दिनों में स्टार का बदलाव - #30
यह रिपॉजिटरी "A Survey on Knowledge Distillation of Large Language Models" के लिए पेपर एकत्र करती है। हम KD को नॉलेज एलिसिटेशन और डिस्टिलेशन एल्गोरिदम में विभाजित करते हैं, और LLM के स्किल और वर्टिकल डिस्टिलेशन का पता लगाते हैं।
★ 1,306+1पिछले 7 दिनों में स्टार का बदलाव