मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · multi-modal

multi-modal

multi-modal टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
42
कुल स्टार
1,89,535
औसत स्टार
4,513
हिस्सा
0.01%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर multi-modal के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और multi-modal टैग वाली रिपॉजिटरी।

पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।

  • agentscope@agentscope-ai

    ऐसे एजेंट बनाएँ और चलाएँ जिन्हें आप देख सकें, समझ सकें और जिन पर भरोसा कर सकें।

    30,463+420पिछले 7 दिनों में स्टार का बदलाव
  • MiniCPM-V@OpenBMB

    आपके फ़ोन पर अत्यधिक कुशल छवि और वीडियो समझ के लिए पॉकेट-साइज़्ड MLLM

    26,283+27पिछले 7 दिनों में स्टार का बदलाव
  • ten-framework@TEN-framework

    बातचीत वाले वॉइस AI एजेंटों के लिए ओपन-सोर्स फ्रेमवर्क

    11,102+10पिछले 7 दिनों में स्टार का बदलाव
  • InternVL@OpenGVLab

    [CVPR 2024 Oral] InternVL Family: GPT-4o का एक अग्रणी ओपन-सोर्स विकल्प। GPT-4o जैसा प्रदर्शन देने वाला ओपन-सोर्स मल्टीमॉडल वार्ता मॉडल

    10,150+3पिछले 7 दिनों में स्टार का बदलाव
  • modelscope@modelscope

    ModelScope: Model-as-a-Service की अवधारणा को साकार करना।

    9,121+4पिछले 7 दिनों में स्टार का बदलाव
  • big-AGI@enricoros

    अत्याधुनिक मॉडलों द्वारा संचालित AI सूट जो उन्नत AI/AGI कार्य प्रदान करता है। इसमें AI पर्सना, AGI कार्य, विश्व स्तरीय Beam मल्टी-मॉडल चैट, टेक्स्ट-टू-इमेज, वॉयस, रिस्पांस स्ट्रीमिंग, कोड हाइलाइटिंग और निष्पादन, PDF आयात, डेवलपर्स के लिए प्रीसेट और बहुत कुछ शामिल है। ऑन-प्रिमाइसेस या क्लाउड में तैनात करें।

    7,108+1पिछले 7 दिनों में स्टार का बदलाव
  • data-juicer@datajuicer

    फाउंडेशन मॉडल के लिए और उनके साथ डेटा प्रोसेसिंग! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

    6,975+26पिछले 7 दिनों में स्टार का बदलाव
  • CogVLM@zai-org

    एक अत्याधुनिक ओपन विजुअल लैंग्वेज मॉडल | मल्टी-मोडल प्री-ट्रेनिंग मॉडल

    6,744+0पिछले 7 दिनों में स्टार का बदलाव
  • valhalla@valhalla

    OpenStreetMap के लिए ओपन सोर्स रूटिंग इंजन

    6,154+24पिछले 7 दिनों में स्टार का बदलाव
  • Chinese-CLIP@OFA-Sys

    CLIP का चीनी संस्करण जो चीनी क्रॉस-मोडल पुनर्प्राप्ति और प्रतिनिधित्व पीढ़ी को प्राप्त करता है।

    6,001+1पिछले 7 दिनों में स्टार का बदलाव
  • DALLE-pytorch@lucidrains

    Pytorch में OpenAI के टेक्स्ट टू इमेज ट्रांसफॉर्मर, DALL-E का कार्यान्वयन / प्रतिकृति

    5,626-2पिछले 7 दिनों में स्टार का बदलाव
  • marqo@marqo-ai

    ईकॉमर्स सर्च और डिस्कवरी - marqo.ai

    5,031-1पिछले 7 दिनों में स्टार का बदलाव
  • DeepKE@zjunlp

    [EMNLP 2022] ज्ञान ग्राफ निष्कर्षण और निर्माण के लिए एक ओपन टूलकिट

    4,476+1पिछले 7 दिनों में स्टार का बदलाव
  • VLMEvalKit@open-compass

    लार्ज मल्टी-मोडालिटी मॉडल (LMMs) का ओपन-सोर्स मूल्यांकन टूलकिट, 220+ LMMs, 80+ बेंचमार्क का समर्थन करता है।

    4,375+13पिछले 7 दिनों में स्टार का बदलाव
  • OmniGen@VectorSpaceLab

    OmniGen: एकीकृत छवि निर्माण (Unified Image Generation)। https://arxiv.org/pdf/2409.11340

    4,342+1पिछले 7 दिनों में स्टार का बदलाव
  • VisualGLM-6B@zai-org

    चीनी और अंग्रेजी मल्टीमोडल संवादात्मक भाषा मॉडल | 多模态中英双语对话语言模型

    4,155+0पिछले 7 दिनों में स्टार का बदलाव
  • LLamaSharp@SciSharp

    आपके स्थानीय डिवाइस पर LLM (🦙LLaMA/LLaVA) को कुशलतापूर्वक चलाने के लिए एक C#/.NET लाइब्रेरी।

    3,790+2पिछले 7 दिनों में स्टार का बदलाव
  • Video-LLaVA@PKU-YuanGroup

    [EMNLP 2024🔥] Video-LLaVA: प्रोजेक्शन से पहले एलाइनमेंट द्वारा यूनाइटेड विजुअल रिप्रेजेंटेशन सीखना

    3,500+1पिछले 7 दिनों में स्टार का बदलाव
  • py-xiaozhi@huangjunsen0406

    MCP इंटीग्रेशन, मल्टीमॉडल वर्कफ़्लो, IoT समर्थन और क्रॉस-प्लेटफ़ॉर्म वॉयस इंटरैक्शन के साथ ओपन-सोर्स AI सहायक生态系统।

    3,463+9पिछले 7 दिनों में स्टार का बदलाव
  • docarray@docarray

    मल्टीमॉडल डेटा का प्रतिनिधित्व करें, भेजें, स्टोर करें और खोजें

    3,123-1पिछले 7 दिनों में स्टार का बदलाव
  • LISA@JIA-Lab-research

    "LISA: Reasoning Segmentation via Large Language Model" के लिए प्रोजेक्ट पेज

    2,674+0पिछले 7 दिनों में स्टार का बदलाव
  • CogVLM2@zai-org

    Llama3-8B पर आधारित GPT4V-स्तर का ओपन-सोर्स मल्टी-मोडल मॉडल

    2,433+0पिछले 7 दिनों में स्टार का बदलाव
  • MoE-LLaVA@PKU-YuanGroup

    【TMM 2025🔥】 Large Vision-Language Models के लिए Mixture-of-Experts

    2,322+0पिछले 7 दिनों में स्टार का बदलाव
  • RecSysPapers@tangxyw

    सिफ़ारिश (Recommendation), विज्ञापन (Advertising) और खोज (Search) के क्षेत्र में उद्योग के क्लासिक और अत्याधुनिक शोध पत्रों का संग्रह।

    2,188-1पिछले 7 दिनों में स्टार का बदलाव
  • MotionGPT@OpenMotionLab

    [NeurIPS 2023] MotionGPT: मानव गति को एक विदेशी भाषा के रूप में, LLMs का उपयोग करने वाला एक एकीकृत गति-भाषा जनरेशन मॉडल

    1,963+1पिछले 7 दिनों में स्टार का बदलाव
  • GPTDiscord@Kav-K

    Discord के लिए एक मजबूत, ऑल-इन-वन GPT इंटरफेस। ChatGPT-शैली की बातचीत, इमेज जनरेशन, AI-मॉडरेशन, कस्टम इंडेक्स/नॉलेजबेस, YouTube सारांशकर्ता, और बहुत कुछ!

    1,853-2पिछले 7 दिनों में स्टार का बदलाव
  • SALMONN@bytedance

    SALMONN परिवार: उन्नत मल्टी-मोडल LLMs का एक सूट

    1,521+3पिछले 7 दिनों में स्टार का बदलाव
  • MedMNIST@MedMNIST

    [pip install medmnist] 2D और 3D बायोमेडिकल इमेज क्लासिफ़िकेशन के लिए 18x मानकीकृत डेटासेट

    1,399+0पिछले 7 दिनों में स्टार का बदलाव
  • transfusion-pytorch@lucidrains

    MetaAI के "Predict the Next Token and Diffuse Images with One Multi-Modal Model" (Transfusion) का Pytorch कार्यान्वयन

    1,398+3पिछले 7 दिनों में स्टार का बदलाव
  • यह रिपॉजिटरी "A Survey on Knowledge Distillation of Large Language Models" के लिए पेपर एकत्र करती है। हम KD को नॉलेज एलिसिटेशन और डिस्टिलेशन एल्गोरिदम में विभाजित करते हैं, और LLM के स्किल और वर्टिकल डिस्टिलेशन का पता लगाते हैं।

    1,306+1पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस