मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · vision-language-models

vision-language-models

vision-language-models टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
8
कुल स्टार
6,164
औसत स्टार
771
हिस्सा
0.00%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर vision-language-models के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और vision-language-models टैग वाली रिपॉजिटरी।

पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।

  • 155+ विजन-लैंग्वेज मॉडल (VLM/MLLM) आर्किटेक्चर की क्यूरेटेड विजुअल कैटलॉग: पेपर, आरेख, ट्रेनिंग रेसिपी, डेटासेट, और मल्टीमॉडल AI एजेंटों के लिए रिलीज़ टाइमलाइन।

    1,310+4पिछले 7 दिनों में स्टार का बदलाव
  • JarvisArt@LYL1015

    [NeurIPS' 2025] JarvisArt: एक बुद्धिमान फोटो रीटचिंग एजेंट के माध्यम से मानवीय कलात्मक रचनात्मकता को स्वतंत्र करना

    862+1पिछले 7 दिनों में स्टार का बदलाव
  • 4KAgent@taco-group

    [NeurIPS 2025] 4KAgent: एजेंटिक एनी इमेज टू 4K सुपर-रिज़ॉल्यूशन। एक बुद्धिमान कंप्यूटर विजन एजेंट जो किसी भी इमेज को जादुई रूप से परफेक्ट 4K में रिस्टोर कर सकता है।

    821+0पिछले 7 दिनों में स्टार का बदलाव
  • स्थानिक तर्क (spatial reasoning) के लिए शोध पत्रों की सूची

    780+3पिछले 7 दिनों में स्टार का बदलाव
  • विज़न-लैंग्वेज मॉडल पेपर और मॉडल्स का एक प्रमुख फ़्रंटएंड कलेक्शन और सर्वे GitHub रिपॉजिटरी। निरंतर अपडेट।

    706+5पिछले 7 दिनों में स्टार का बदलाव
  • recogdrive@xiaomi-research

    [ICLR 2026] ReCogDrive: एंड-टू-एंड ऑटोनॉमस ड्राइविंग के लिए एक रीइन्फोर्स्ड कॉग्निटिव फ्रेमवर्क।

    599+4पिछले 7 दिनों में स्टार का बदलाव
  • MOSS-VL@OpenMOSS

    An open-weight 11B model series for long-form and real-time video understanding

    582पिछले 7 दिनों में स्टार का बदलाव
  • ParseBench@run-llama

    ParseBench - AI एजेंटों के लिए एक दस्तावेज़ पार्सिंग बेंचमार्क

    560+6पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस