मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · dataset

dataset

dataset टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
147
कुल स्टार
8,28,882
औसत स्टार
5,639
हिस्सा
0.04%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर dataset के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और dataset टैग वाली रिपॉजिटरी।

पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।

  • public-apis@public-apis

    मुफ़्त API की एक सामूहिक सूची

    4,72,776+4,663पिछले 7 दिनों में स्टार का बदलाव
  • label-studio@HumanSignal

    Label Studio मानकीकृत आउटपुट प्रारूप के साथ एक बहु-प्रकार डेटा लेबलिंग और एनोटेशन टूल है।

    28,162+56पिछले 7 दिनों में स्टार का बदलाव
  • exercises-dataset@hasaneyldrm

    1,324-व्यायाम फिटनेस डेटासेट — एनिमेशन GIF, 180×180 थंबनेल, मांसपेशी-समूह और उपकरण डेटा, और 6 भाषाओं में चरण-दर-चरण निर्देश। LogPress ऐप के पीछे का व्यायाम डेटा लेयर।

    21,087+523पिछले 7 दिनों में स्टार का बदलाव
  • faker@joke2k

    Faker एक Python पैकेज है जो आपके लिए नकली डेटा उत्पन्न करता है।

    19,383+9पिछले 7 दिनों में स्टार का बदलाव
  • cvat@cvat-ai

    कंप्यूटर विजन एनोटेशन टूल (CVAT) विजन AI के लिए उच्च गुणवत्ता वाले विजुअल डेटासेट बनाने का एक अग्रणी प्लेटफॉर्म है। यह इमेज, वीडियो और 3D एनोटेशन के लिए AI-असिस्टेड लेबलिंग, गुणवत्ता आश्वासन, टीम सहयोग, एनालिटिक्स और डेवलपर API के साथ ओपन-सोर्स, क्लाउड और एंटरप्राइज उत्पाद प्रदान करता है।

    16,618+51पिछले 7 दिनों में स्टार का बदलाव
  • LaTeX-OCR@lukas-blecher

    pix2tex: समीकरणों की छवियों को LaTeX कोड में बदलने के लिए ViT का उपयोग करना।

    16,549+5पिछले 7 दिनों में स्टार का बदलाव
  • easy-dataset@ConardLi

    LLM फाइन-ट्यूनिंग, RAG और Eval के लिए डेटासेट बनाने का एक शक्तिशाली टूल।

    14,854+43पिछले 7 दिनों में स्टार का बदलाव
  • doccano@doccano

    मशीन लर्निंग प्रैक्टिशनर्स के लिए ओपन सोर्स एनोटेशन टूल।

    10,760+7पिछले 7 दिनों में स्टार का बदलाव
  • techniques@satellite-image-deep-learning

    उपग्रह और हवाई छवियों के साथ डीप लर्निंग के लिए तकनीकें

    10,240+6पिछले 7 दिनों में स्टार का बदलाव
  • NLP के लिए बड़े पैमाने पर चीनी भाषा का कॉर्पस

    9,910+1पिछले 7 दिनों में स्टार का बदलाव
  • MDN पर प्रदर्शित वेब तकनीकों के लिए ब्राउज़र संगतता डेटा

    5,730+7पिछले 7 दिनों में स्टार का बदलाव
  • शानदार प्रीट्रेनड चीनी NLP मॉडल, उच्च गुणवत्ता वाले चीनी प्रीट्रेनड मॉडल, बड़े मॉडल, मल्टीमॉडल मॉडल और लार्ज लैंग्वेज मॉडल का संग्रह

    5,582+0पिछले 7 दिनों में स्टार का बदलाव
  • पोस्ट-ट्रेनिंग के लिए डेटासेट और टूल की क्यूरेटेड सूची।

    4,759+12पिछले 7 दिनों में स्टार का बदलाव
  • esProc@SPLWare

    esProc SPL एक JVM-आधारित प्रोग्रामिंग भाषा है जिसे संरचित डेटा गणना के लिए डिज़ाइन किया गया है, जो डेटा विश्लेषण टूल और एम्बेडेड कंप्यूटिंग इंजन दोनों के रूप में कार्य करती है।

    4,684-2पिछले 7 दिनों में स्टार का बदलाव
  • transformer@hyunwoongko

    Transformer: "Attention Is All You Need" का PyTorch कार्यान्वयन।

    4,648+10पिछले 7 दिनों में स्टार का बदलाव
  • datasets@tensorflow

    TFDS TensorFlow, Jax, ... के साथ उपयोग के लिए तैयार डेटासेट का एक संग्रह है।

    4,581+1पिछले 7 दिनों में स्टार का बदलाव
  • img2dataset@rom1504

    छवियों के यूआरएल के बड़े सेट को आसानी से इमेज डेटासेट में बदलें। एक मशीन पर 20 घंटों में 100M यूआरएल डाउनलोड, आकार बदल और पैकेज कर सकता है।

    4,443+1पिछले 7 दिनों में स्टार का बदलाव
  • चीनी लोगों के नामों का कॉर्पस। नाम जनरेटर। चीनी नाम, उपनाम, दिए गए नाम, उपाधि, जापानी नाम, अनुवादित नाम, अंग्रेजी नाम। चीनी शब्द विभाजन और नाम इकाई पहचान के लिए उपयोग किया जा सकता है।

    4,327+1पिछले 7 दिनों में स्टार का बदलाव
  • sql-translator@whoiskatrin

    SQL Translator कृत्रिम बुद्धिमत्ता का उपयोग करके प्राकृतिक भाषा के प्रश्नों को SQL कोड में बदलने का एक टूल है। यह प्रोजेक्ट 100% मुफ़्त और ओपन सोर्स है।

    4,321-2पिछले 7 दिनों में स्टार का बदलाव
  • CLUE@CLUEbenchmark

    Chinese Language Understanding Evaluation Benchmark: डेटासेट, बेसलाइन, प्री-ट्रेन किए गए मॉडल, कॉर्पस और लीडरबोर्ड

    4,279+0पिछले 7 दिनों में स्टार का बदलाव
  • 📈 वर्तमान में सबसे बड़ा औद्योगिक दोष पहचान डेटाबेस और शोधपत्र संग्रह। सतह दोष अनुसंधान के क्षेत्र में अत्यधिक महत्व रखने वाले ओपन-सोर्स डेटासेट और महत्वपूर्ण पत्रों का निरंतर सारांश।

    4,103+4पिछले 7 दिनों में स्टार का बदलाव
  • csghub@OpenCSGs

    CSGHub OpenCSG टीम द्वारा विकसित LLM को प्रबंधित करने के लिए एक बिल्कुल नया ओपन-सोर्स प्लेटफ़ॉर्म है। यह Hugging Face के बराबर की सुविधाओं के साथ ओपन-सोर्स और ऑन-प्रिमाइसेस/SaaS दोनों समाधान प्रदान करता है। Hugging Face के साथ Python SDK संगतता के साथ LLM, डेटासेट और एजेंटों के जीवनचक्र पर पूर्ण नियंत्रण प्राप्त करें। हमसे जुड़ें! ⭐️

    4,101+3पिछले 7 दिनों में स्टार का बदलाव
  • औद्योगिक छवि विसंगति/दोष का पता लगाने के लिए पेपर सूची और डेटासेट (अपडेट हो रहा है)।

    3,749+5पिछले 7 दिनों में स्टार का बदलाव
  • टेक्स्ट रिकग्निशन के लिए एक सिंथेटिक डेटा जनरेटर

    3,691+0पिछले 7 दिनों में स्टार का बदलाव
  • dataset@linhandev

    चिकित्सा इमेजिंग डेटासेट की सूची 'मेडिकल इमेजिंग डेटासेट के लिए एक सूचकांक'

    3,605+0पिछले 7 दिनों में स्टार का बदलाव
  • StringZilla@ashvardanian

    NEON, AVX2, AVX-512, SVE, GPGPU, और SWAR का लाभ उठाते हुए C, C++, CUDA, Python, Rust, Swift, JS, और Go के लिए 100x तक तेज़ स्ट्रिंग्स, जो खोज, हैशिंग, छँटाई, संपादन दूरियों, स्केच और मेमोरी संचालन को गति देती हैं 🦖

    3,543+7पिछले 7 दिनों में स्टार का बदलाव
  • waymo-open-dataset@waymo-research

    Waymo Open Dataset

    3,400+8पिछले 7 दिनों में स्टार का बदलाव
  • विभिन्न प्रकार के इंटरनेट स्रोतों से डेटा निकालकर pandas DataFrame में बदलना।

    3,238+2पिछले 7 दिनों में स्टार का बदलाव
  • color-names@meodai

    हाथ से चुने गए रंग के नामों की बड़ी सूची 🌈

    2,984+6पिछले 7 दिनों में स्टार का बदलाव
  • whylogs@whylabs

    मशीन लर्निंग मॉडल और डेटा पाइपलाइन के लिए एक ओपन-सोर्स डेटा लॉगिंग लाइब्रेरी। 📚 समय के साथ डेटा की गुणवत्ता और मॉडल के प्रदर्शन की दृश्यता प्रदान करता है। 🛡️ गोपनीयता-संरक्षण डेटा संग्रह का समर्थन करता है, सुरक्षा और मजबूती सुनिश्चित करता है। 📈

    2,831-1पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस