मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · dataset

dataset

dataset टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

148 रिपॉजिटरी
  • LLM की शक्ति को अनलॉक करें: अपना खुद का ChatGPT ट्रेन करने के लिए इन डेटासेट को एक्सप्लोर करें

    768+0पिछले 7 दिनों में स्टार का बदलाव
  • tech.ml.dataset@techascent

    एक Clojure उच्च-प्रदर्शन डेटा प्रोसेसिंग सिस्टम

    760+0पिछले 7 दिनों में स्टार का बदलाव
  • TACO@pedropro

    🌮 संदर्भ डेटासेट टूलकिट में ट्रैश एनोटेशन

    756+1पिछले 7 दिनों में स्टार का बदलाव
  • couplet-dataset@wb14123

    युग्मों (couplets) के लिए डेटासेट। 7 लाख युगल डेटाबेस।

    747+1पिछले 7 दिनों में स्टार का बदलाव
  • person_search@ShuangLI59

    व्यक्ति खोज के लिए संयुक्त पहचान और पहचान सुविधा सीखना

    746+0पिछले 7 दिनों में स्टार का बदलाव
  • dataset-serialize@viniciussanchez

    Delphi और Lazarus (FPC) के लिए JSON से DataSet और DataSet से JSON कन्वर्टर।

    744+1पिछले 7 दिनों में स्टार का बदलाव
  • io@tensorflow

    TensorFlow SIG-IO द्वारा बनाए रखा गया डेटासेट, स्ट्रीमिंग और फाइल सिस्टम एक्सटेंशन

    739+0पिछले 7 दिनों में स्टार का बदलाव
  • Thorsten-Voice@thorstenMueller

    Thorsten-Voice: एक मुफ्त, ऑफलाइन काम करने वाली, उच्च गुणवत्ता वाली जर्मन TTS आवाज़, जो बिना किसी लाइसेंस समस्या के हर प्रोजेक्ट के लिए उपलब्ध होनी चाहिए।

    729+1पिछले 7 दिनों में स्टार का बदलाव
  • OpenAI-CLIP@moein-shariatnia

    PyTorch में OpenAI CLIP मॉडल का सरल कार्यान्वयन।

    726+0पिछले 7 दिनों में स्टार का बदलाव
  • MovieChat@wenhaochai

    [CVPR 2024] MovieChat: लंबे वीडियो को समझने के लिए डेंस टोकन से स्पार्स मेमोरी

    706+0पिछले 7 दिनों में स्टार का बदलाव
  • PointTinyBenchmark@ucas-vg

    UCAS-VG का पॉइंट-आधारित और छोटा ऑब्जेक्ट डिटेक्शन और लोकलाइजेशन कोड सेट।

    694+1पिछले 7 दिनों में स्टार का बदलाव
  • long-form-factuality@google-deepmind

    लार्ज लैंग्वेज मॉडल में लॉन्ग-फॉर्म तथ्यात्मकता की बेंचमार्किंग। हमारे पेपर "लॉन्ग-फॉर्म फैक्चुअलिटी इन लार्ज लैंग्वेज मॉडल्स" के लिए मूल कोड।

    693+2पिछले 7 दिनों में स्टार का बदलाव
  • datumaro@open-edge-platform

    डेटासेट मैनेजमेंट फ्रेमवर्क, कंप्यूटर विज़न डेटासेट बनाने, विश्लेषण करने और प्रबंधित करने के लिए एक Python लाइब्रेरी और CLI टूल।

    689+2पिछले 7 दिनों में स्टार का बदलाव
  • Structured3D@bertjiazheng

    [ECCV'20] Structured3D: स्ट्रक्चर्ड 3D मॉडलिंग के लिए एक बड़ा फोटो-रियलिस्टिक डेटासेट।

    682+2पिछले 7 दिनों में स्टार का बदलाव
  • FX-1-Minute-Data@philipperemy

    HISTDATA - सभी FX ट्रेडिंग जोड़े / क्रूड ऑयल / स्टॉक इंडेक्स से बना डेटासेट। 1 मिनट का डेटा (और टिक डेटा) ऐतिहासिक FX कीमतें (अप-टू-डेट) प्राप्त करने के लिए सरल API।

    681+0पिछले 7 दिनों में स्टार का बदलाव
  • बोले गए अंकों का एक मुफ्त ऑडियो डेटासेट। MNIST का एक ऑडियो संस्करण।

    678+0पिछले 7 दिनों में स्टार का बदलाव
  • ACM Multimedia2020 University-1652: ड्रोन-आधारित जियो-लोकलाइजेशन के लिए एक मल्टी-व्यू मल्टी-सोर्स बेंचमार्क, जो दुनिया भर के 72 विश्वविद्यालयों में 1652 इमारतों को एनोटेट करता है।

    677+5पिछले 7 दिनों में स्टार का बदलाव
  • ClawBench@TIGER-AI-Lab

    दैनिक कार्यों पर ब्राउज़र AI एजेंटों के लिए ओपन-सोर्स बेंचमार्क।

    675+72पिछले 7 दिनों में स्टार का बदलाव
  • video2dataset@iejMac

    वीडियो URL से आसानी से बड़े वीडियो डेटासेट बनाएं

    664+1पिछले 7 दिनों में स्टार का बदलाव
  • datalad@datalad

    git और git-annex के साथ कोड, डेटा और कंटेनरों को नियंत्रित रखें।

    660+3पिछले 7 दिनों में स्टार का बदलाव
  • Awesome-LLM-Eval: मुख्य रूप से LLM मूल्यांकन के लिए टूल, डेटासेट/बेंचमार्क, डेमो, लीडरबोर्ड, पेपर, डॉक्स और मॉडल की एक क्यूरेटेड सूची।

    656-2पिछले 7 दिनों में स्टार का बदलाव
  • datasets@benedekrozemberczki

    नेटवर्क साइंस और मशीन लर्निंग रिसर्च के लिए मेरे द्वारा एकत्रित किए गए बहुत अच्छे डेटासेट का एक रिपॉजिटरी।

    655+0पिछले 7 दिनों में स्टार का बदलाव
  • डेटा साइंस प्रोजेक्ट का संपूर्ण जीवन चक्र

    653+0पिछले 7 दिनों में स्टार का बदलाव
  • comma2k19@commaai

    फ्यूज्ड पोज़ एस्टिमेटर्स और मैपिंग एल्गोरिदम के विकास और सत्यापन के लिए एक ड्राइविंग डेटासेट

    653+3पिछले 7 दिनों में स्टार का बदलाव
  • ConvoKit@CornellNLP

    ConvoKit बातचीत में सामाजिक घटनाओं का विश्लेषण करने और संवादात्मक सुविधाओं को निकालने के लिए एक टूलकिट है। इसमें कई बड़े संवादात्मक डेटासेट और इन डेटासेट पर टूलकिट के उपयोग को दर्शाने वाली स्क्रिप्ट शामिल हैं

    648+1पिछले 7 दिनों में स्टार का बदलाव
  • NAS-Bench-201@D-X-Y

    NAS-Bench-201 API और निर्देश

    646+1पिछले 7 दिनों में स्टार का बदलाव
  • Ego4d@facebookresearch

    Ego4d डेटासेट रिपॉजिटरी। डेटासेट डाउनलोड करें, विज़ुअलाइज़ करें, फीचर्स निकालें और डेटासेट के उपयोग के उदाहरण देखें।

    644+5पिछले 7 दिनों में स्टार का बदलाव
  • सेगमेंटेशन / सेलियंसी डिटेक्शन के लिए डेटासेट का संग्रह। PR का स्वागत है।

    640+0पिछले 7 दिनों में स्टार का बदलाव
  • Exclusively Dark (ExDARK) डेटासेट, जो हमारी जानकारी के अनुसार, बहुत कम रोशनी वाले वातावरण से लेकर गोधूलि (यानी 10 अलग-अलग स्थितियां) तक ली गई कम रोशनी वाली छवियों का अब तक का सबसे बड़ा संग्रह है, जिसमें इमेज क्लास और ऑब्जेक्ट लेवल एनोटेशन शामिल हैं।

    640-1पिछले 7 दिनों में स्टार का बदलाव
  • TrustLLM@HowieHwong

    [ICML 2024] TrustLLM: लार्ज लैंग्वेज मॉडल में विश्वसनीयता

    632+2पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस