मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · dataset

dataset

dataset टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

148 रिपॉजिटरी
  • 2020 से सार्वजनिक BTC ट्रेडिंग संदर्भ।

    1,216+1पिछले 7 दिनों में स्टार का बदलाव
  • M2DGR@SJTU-ViSYS

    M2DGR: ग्राउंड रोबोट्स के लिए एक मल्टी-मॉडल और मल्टी-परिदृश्य डेटासेट (RA-L2021 & ICRA2022)

    1,201+5पिछले 7 दिनों में स्टार का बदलाव
  • chat-dataset-baseline@hikariming

    मैन्युअल रूप से फाइन-ट्यून किया गया चीनी संवाद डेटासेट और ChatGLM के लिए फाइन-ट्यूनिंग कोड का एक टुकड़ा

    1,191+0पिछले 7 दिनों में स्टार का बदलाव
  • torchxrayvision@mlmed

    TorchXRayVision: छाती के एक्स-रे डेटासेट और मॉडल की एक लाइब्रेरी। क्लासिफायर, सेगमेंटेशन और ऑटोएन्कोडर।

    1,188+3पिछले 7 दिनों में स्टार का बदलाव
  • covid-19@datasets

    मामलों पर Novel Coronavirus 2019 समय श्रृंखला डेटा

    1,165+1पिछले 7 दिनों में स्टार का बदलाव
  • domains@tb0hdan

    दुनिया का सबसे बड़ा इंटरनेट डोमेन डेटासेट।

    1,157+1पिछले 7 दिनों में स्टार का बदलाव
  • Twitter डेटासेट और संबंधित संसाधनों की एक सूची।

    1,125+1पिछले 7 दिनों में स्टार का बदलाव
  • game-datasets@leomaurodesenv

    गेम डेटासेट और गेम में आर्टिफिशियल इंटेलिजेंस के लिए टूल्स की एक क्यूरेटेड सूची।

    1,118+9पिछले 7 दिनों में स्टार का बदलाव
  • SoundMind@xid32

    हम Audio Logical Reasoning (ALR) डेटासेट पेश करते हैं, जिसमें जटिल तर्क कार्यों के लिए विशेष रूप से डिज़ाइन किए गए 6,446 टेक्स्ट-ऑडियो एनोटेटेड नमूने शामिल हैं। इस संसाधन के आधार पर, हम SoundMind का प्रस्ताव करते हैं, जो ऑडियो लैंग्वेज मॉडल (ALMs) को गहरी द्विमोडल तर्क क्षमताओं से लैस करने के लिए तैयार किया गया एक नियम-आधारित सुदृढीकरण शिक्षण (RL) एल्गोरिदम है।

    1,113+0पिछले 7 दिनों में स्टार का बदलाव
  • insuranceqa-corpus-zh@chatopera

    बीमा उद्योग के लिए कॉर्पस और चैटबॉट।

    1,064-1पिछले 7 दिनों में स्टार का बदलाव
  • hagrid@hukenovs

    हैंड जेस्चर रिकग्निशन इमेज डेटासेट

    1,059+8पिछले 7 दिनों में स्टार का बदलाव
  • TransportationNetworks@bstabler

    अनुसंधान के लिए परिवहन नेटवर्क

    1,051+2पिछले 7 दिनों में स्टार का बदलाव
  • MMSA@thuiar

    MMSA मल्टीमॉडल सेंटीमेंट एनालिसिस के लिए एक एकीकृत फ्रेमवर्क है

    1,046+4पिछले 7 दिनों में स्टार का बदलाव
  • name-dataset@philipperemy

    नामों के लिए Python लाइब्रेरी।

    1,019-1पिछले 7 दिनों में स्टार का बदलाव
  • ThoughtSource@OpenBioLink

    लार्ज लैंग्वेज मॉडल्स में चेन-ऑफ-थॉट रीजनिंग से संबंधित डेटा और टूल्स के लिए एक केंद्रीय, ओपन रिसोर्स। Samwald रिसर्च ग्रुप द्वारा विकसित: https://samwald.info/

    1,015+0पिछले 7 दिनों में स्टार का बदलाव
  • बायोमैकेनिक्स और मानव गति विश्लेषण के लिए संसाधनों की एक क्यूरेटेड सार्वजनिक सूची: डेटासेट, प्रोसेसिंग टूल्स, सिमुलेशन सॉफ़्टवेयर, शैक्षिक वीडियो, व्याख्यान आदि।

    1,010+1पिछले 7 दिनों में स्टार का बदलाव
  • githut@madnight

    GitHub भाषा सांख्यिकी।

    1,004-1पिछले 7 दिनों में स्टार का बदलाव
  • Mobius@microsoft

    Apache Spark के लिए C# और F# भाषा बाइंडिंग और एक्सटेंशन।

    948+0पिछले 7 दिनों में स्टार का बदलाव
  • OmniAnomaly@NetManAIOps

    KDD 2019: स्टोकेस्टिक रीकरेंट न्यूरल नेटवर्क के माध्यम से मल्टीवेरिएट टाइम सीरीज़ के लिए मजबूत एनोमली डिटेक्शन

    948+5पिछले 7 दिनों में स्टार का बदलाव
  • semantic-segmentation@sithu31296

    PyTorch में SOTA सिमेंटिक सेगमेंटेशन मॉडल्स

    942-1पिछले 7 दिनों में स्टार का बदलाव
  • tfrecord@vahidk

    PyTorch डेटा लोडर्स के साथ स्टैंडअलोन TFRecord रीडर/राइटर

    902+0पिछले 7 दिनों में स्टार का बदलाव
  • डेटासेट विज़ुअलाइज़ेशन, डेटा प्रोसेसिंग और परिणामों के मूल्यांकन के लिए SemanticKITTI API

    899+3पिछले 7 दिनों में स्टार का बदलाव
  • deepfabric@nolabs-ai

    एक ही पाइपलाइन में उच्च-गुणवत्ता वाले सिंथेटिक्स उत्पन्न करें, प्रशिक्षित करें, मापें और मूल्यांकन करें

    885+3पिछले 7 दिनों में स्टार का बदलाव
  • magpie@magpie-align

    [ICLR 2025] संरेखित LLMs को कुछ भी न देकर प्रॉम्प्टिंग के माध्यम से शून्य से संरेखण डेटा संश्लेषण। आपका कुशल और उच्च गुणवत्ता वाला सिंथेटिक डेटा जनरेशन पाइपलाइन!

    882+2पिछले 7 दिनों में स्टार का बदलाव
  • OpenCUA@xlang-ai

    [NeurIPS 2025 स्पॉटलाइट] OpenCUA: कंप्यूटर-उपयोग एजेंटों के लिए ओपन फाउंडेशन।

    834+4पिछले 7 दिनों में स्टार का बदलाव
  • MINT-1T@mlfoundations

    🍃 MINT-1T: एक ट्रिलियन टोकन वाला मल्टीमॉडल इंटरलीव्ड डेटासेट।

    833+0पिछले 7 दिनों में स्टार का बदलाव
  • PrimeKG@mims-harvard

    प्रिसिजन मेडिसिन नॉलेज ग्राफ (PrimeKG)

    823+6पिछले 7 दिनों में स्टार का बदलाव
  • opendata@NationalGalleryOfArt

    नेशनल गैलरी ऑफ आर्ट ओपन डेटा प्रोग्राम।

    820+6पिछले 7 दिनों में स्टार का बदलाव
  • pycococreator@waspinator

    COCO डेटासेट बनाने के लिए हेल्पर फ़ंक्शंस

    783-1पिछले 7 दिनों में स्टार का बदलाव
  • Total-Text-Dataset@cs-chan

    Total Text Dataset। इसमें 1555 चित्र शामिल हैं जिनमें 3 से अधिक विभिन्न टेक्स्ट ओरिएंटेशन हैं: हॉरिजॉन्टल, मल्टी-ओरिएंटेड और कर्व्ड, जो अपनी तरह का अनूठा है।

    771-1पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस