dataset
dataset टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर dataset के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और dataset टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
मुफ़्त API की एक सामूहिक सूची
★ 4,72,776+4,663पिछले 7 दिनों में स्टार का बदलाव - #2
Label Studio मानकीकृत आउटपुट प्रारूप के साथ एक बहु-प्रकार डेटा लेबलिंग और एनोटेशन टूल है।
★ 28,162+56पिछले 7 दिनों में स्टार का बदलाव - #3
1,324-व्यायाम फिटनेस डेटासेट — एनिमेशन GIF, 180×180 थंबनेल, मांसपेशी-समूह और उपकरण डेटा, और 6 भाषाओं में चरण-दर-चरण निर्देश। LogPress ऐप के पीछे का व्यायाम डेटा लेयर।
★ 21,087+523पिछले 7 दिनों में स्टार का बदलाव - #4★ 19,383+9पिछले 7 दिनों में स्टार का बदलाव
- #5
कंप्यूटर विजन एनोटेशन टूल (CVAT) विजन AI के लिए उच्च गुणवत्ता वाले विजुअल डेटासेट बनाने का एक अग्रणी प्लेटफॉर्म है। यह इमेज, वीडियो और 3D एनोटेशन के लिए AI-असिस्टेड लेबलिंग, गुणवत्ता आश्वासन, टीम सहयोग, एनालिटिक्स और डेवलपर API के साथ ओपन-सोर्स, क्लाउड और एंटरप्राइज उत्पाद प्रदान करता है।
★ 16,618+51पिछले 7 दिनों में स्टार का बदलाव - #6
pix2tex: समीकरणों की छवियों को LaTeX कोड में बदलने के लिए ViT का उपयोग करना।
★ 16,549+5पिछले 7 दिनों में स्टार का बदलाव - #7
LLM फाइन-ट्यूनिंग, RAG और Eval के लिए डेटासेट बनाने का एक शक्तिशाली टूल।
★ 14,854+43पिछले 7 दिनों में स्टार का बदलाव - #8★ 10,760+7पिछले 7 दिनों में स्टार का बदलाव
- #9
उपग्रह और हवाई छवियों के साथ डीप लर्निंग के लिए तकनीकें
★ 10,240+6पिछले 7 दिनों में स्टार का बदलाव - #10
NLP के लिए बड़े पैमाने पर चीनी भाषा का कॉर्पस
★ 9,910+1पिछले 7 दिनों में स्टार का बदलाव - #11
MDN पर प्रदर्शित वेब तकनीकों के लिए ब्राउज़र संगतता डेटा
★ 5,730+7पिछले 7 दिनों में स्टार का बदलाव - #12
शानदार प्रीट्रेनड चीनी NLP मॉडल, उच्च गुणवत्ता वाले चीनी प्रीट्रेनड मॉडल, बड़े मॉडल, मल्टीमॉडल मॉडल और लार्ज लैंग्वेज मॉडल का संग्रह
★ 5,582+0पिछले 7 दिनों में स्टार का बदलाव - #13
पोस्ट-ट्रेनिंग के लिए डेटासेट और टूल की क्यूरेटेड सूची।
★ 4,759+12पिछले 7 दिनों में स्टार का बदलाव - #14
esProc SPL एक JVM-आधारित प्रोग्रामिंग भाषा है जिसे संरचित डेटा गणना के लिए डिज़ाइन किया गया है, जो डेटा विश्लेषण टूल और एम्बेडेड कंप्यूटिंग इंजन दोनों के रूप में कार्य करती है।
★ 4,684-2पिछले 7 दिनों में स्टार का बदलाव - #15
Transformer: "Attention Is All You Need" का PyTorch कार्यान्वयन।
★ 4,648+10पिछले 7 दिनों में स्टार का बदलाव - #16★ 4,581+1पिछले 7 दिनों में स्टार का बदलाव
- #17
छवियों के यूआरएल के बड़े सेट को आसानी से इमेज डेटासेट में बदलें। एक मशीन पर 20 घंटों में 100M यूआरएल डाउनलोड, आकार बदल और पैकेज कर सकता है।
★ 4,443+1पिछले 7 दिनों में स्टार का बदलाव - #18
चीनी लोगों के नामों का कॉर्पस। नाम जनरेटर। चीनी नाम, उपनाम, दिए गए नाम, उपाधि, जापानी नाम, अनुवादित नाम, अंग्रेजी नाम। चीनी शब्द विभाजन और नाम इकाई पहचान के लिए उपयोग किया जा सकता है।
★ 4,327+1पिछले 7 दिनों में स्टार का बदलाव - #19
SQL Translator कृत्रिम बुद्धिमत्ता का उपयोग करके प्राकृतिक भाषा के प्रश्नों को SQL कोड में बदलने का एक टूल है। यह प्रोजेक्ट 100% मुफ़्त और ओपन सोर्स है।
★ 4,321-2पिछले 7 दिनों में स्टार का बदलाव - #20
Chinese Language Understanding Evaluation Benchmark: डेटासेट, बेसलाइन, प्री-ट्रेन किए गए मॉडल, कॉर्पस और लीडरबोर्ड
★ 4,279+0पिछले 7 दिनों में स्टार का बदलाव - #21
📈 वर्तमान में सबसे बड़ा औद्योगिक दोष पहचान डेटाबेस और शोधपत्र संग्रह। सतह दोष अनुसंधान के क्षेत्र में अत्यधिक महत्व रखने वाले ओपन-सोर्स डेटासेट और महत्वपूर्ण पत्रों का निरंतर सारांश।
★ 4,103+4पिछले 7 दिनों में स्टार का बदलाव - #22
CSGHub OpenCSG टीम द्वारा विकसित LLM को प्रबंधित करने के लिए एक बिल्कुल नया ओपन-सोर्स प्लेटफ़ॉर्म है। यह Hugging Face के बराबर की सुविधाओं के साथ ओपन-सोर्स और ऑन-प्रिमाइसेस/SaaS दोनों समाधान प्रदान करता है। Hugging Face के साथ Python SDK संगतता के साथ LLM, डेटासेट और एजेंटों के जीवनचक्र पर पूर्ण नियंत्रण प्राप्त करें। हमसे जुड़ें! ⭐️
★ 4,101+3पिछले 7 दिनों में स्टार का बदलाव - #23
औद्योगिक छवि विसंगति/दोष का पता लगाने के लिए पेपर सूची और डेटासेट (अपडेट हो रहा है)।
★ 3,749+5पिछले 7 दिनों में स्टार का बदलाव - #24
टेक्स्ट रिकग्निशन के लिए एक सिंथेटिक डेटा जनरेटर
★ 3,691+0पिछले 7 दिनों में स्टार का बदलाव - #25★ 3,605+0पिछले 7 दिनों में स्टार का बदलाव
- #26
NEON, AVX2, AVX-512, SVE, GPGPU, और SWAR का लाभ उठाते हुए C, C++, CUDA, Python, Rust, Swift, JS, और Go के लिए 100x तक तेज़ स्ट्रिंग्स, जो खोज, हैशिंग, छँटाई, संपादन दूरियों, स्केच और मेमोरी संचालन को गति देती हैं 🦖
★ 3,543+7पिछले 7 दिनों में स्टार का बदलाव - #27
Waymo Open Dataset
★ 3,400+8पिछले 7 दिनों में स्टार का बदलाव - #28
विभिन्न प्रकार के इंटरनेट स्रोतों से डेटा निकालकर pandas DataFrame में बदलना।
★ 3,238+2पिछले 7 दिनों में स्टार का बदलाव - #29
हाथ से चुने गए रंग के नामों की बड़ी सूची 🌈
★ 2,984+6पिछले 7 दिनों में स्टार का बदलाव - #30
मशीन लर्निंग मॉडल और डेटा पाइपलाइन के लिए एक ओपन-सोर्स डेटा लॉगिंग लाइब्रेरी। 📚 समय के साथ डेटा की गुणवत्ता और मॉडल के प्रदर्शन की दृश्यता प्रदान करता है। 🛡️ गोपनीयता-संरक्षण डेटा संग्रह का समर्थन करता है, सुरक्षा और मजबूती सुनिश्चित करता है। 📈
★ 2,831-1पिछले 7 दिनों में स्टार का बदलाव