मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · multi-modality

multi-modality

multi-modality टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
11
कुल स्टार
70,438
औसत स्टार
6,403
हिस्सा
0.00%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर multi-modality के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और multi-modality टैग वाली रिपॉजिटरी।

पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।

  • LLaVA@haotian-liu

    [NeurIPS'23 Oral] GPT-4V स्तर की क्षमताओं और उससे आगे की ओर निर्मित Visual Instruction Tuning (LLaVA)।

    25,005+9पिछले 7 दिनों में स्टार का बदलाव
  • मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स पर नवीनतम प्रगति।

    17,994+8पिछले 7 दिनों में स्टार का बदलाव
  • clip-as-service@jina-ai

    🏄 CLIP के साथ छवियों और वाक्यों के लिए स्केलेबल एम्बेडिंग, रीजनिंग और रैंकिंग

    12,835+0पिछले 7 दिनों में स्टार का बदलाव
  • MOSS-TTS-Nano@OpenMOSS

    MOSS-TTS-Nano MOSI.AI और OpenMOSS टीम का एक ओपन-सोर्स बहुभाषी छोटा स्पीच जनरेशन मॉडल है। केवल 0.1B पैरामीटर के साथ, इसे रीयल-टाइम स्पीच जनरेशन के लिए डिज़ाइन किया गया है, यह बिना GPU के सीधे CPU पर चल सकता है, और स्थानीय डेमो, वेब सर्विंग और हल्के उत्पाद एकीकरण के लिए डिप्लॉयमेंट स्टैक को सरल रखता है।

    4,279+51पिछले 7 दिनों में स्टार का बदलाव
  • Otter@EvolvingLMMs-Lab

    🦦 Otter, OpenFlamingo (DeepMind के Flamingo का ओपन-सोर्स संस्करण) पर आधारित एक मल्टी-मोडल मॉडल, जिसे MIMIC-IT पर प्रशिक्षित किया गया है और जो बेहतर निर्देश-पालन तथा इन-कंटेक्स्ट लर्निंग क्षमता प्रदर्शित करता है।

    3,437+2पिछले 7 दिनों में स्टार का बदलाव
  • InternLM-XComposer@InternLM

    InternLM-XComposer2.5-OmniLive: लॉन्ग-टर्म स्ट्रीमिंग वीडियो और ऑडियो इंटरैक्शन के लिए एक व्यापक मल्टीमॉडल सिस्टम

    2,925+1पिछले 7 दिनों में स्टार का बदलाव
  • 3D ऑब्जेक्ट ट्रैकिंग पर एल्गोरिदम और प्रकाशन

    1,028+2पिछले 7 दिनों में स्टार का बदलाव
  • VisRAG@OpenBMB

    VLM द्वारा समर्थित पार्सिंग-मुक्त RAG।

    979+1पिछले 7 दिनों में स्टार का बदलाव
  • Long-RL@NVlabs

    Long-RL: लंबी अनुक्रमों के लिए RL को स्केल करना (NeurIPS 2025)।

    729+2पिछले 7 दिनों में स्टार का बदलाव
  • MINIMA@LSXI7

    [CVPR 2025] MINIMA: मोडालिटी इनवेरिएंट इमेज मैचिंग

    671+2पिछले 7 दिनों में स्टार का बदलाव
  • Multi-Modality-Arena@OpenGVLab

    Chatbot Arena अब मल्टी-मोडैलिटी के साथ! Multi-Modality Arena आपको इनपुट के रूप में इमेज प्रदान करते हुए विज़न-लैंग्वेज मॉडल की तुलना करने की सुविधा देता है। यह MiniGPT-4, LLaMA-Adapter V2, LLaVA, BLIP-2 और कई अन्य का समर्थन करता है।

    566+0पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस