big-data
big-data टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर big-data के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और big-data टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
स्केलेबल, विश्वसनीय और उच्च-प्रदर्शन वाले बड़े पैमाने के सिस्टम के पैटर्न
★ 73,602+155पिछले 7 दिनों में स्टार का बदलाव - #2
ClickHouse® एक रियल-टाइम एनालिटिक्स डेटाबेस मैनेजमेंट सिस्टम है
★ 49,523+136पिछले 7 दिनों में स्टार का बदलाव - #3★ 43,901+49पिछले 7 दिनों में स्टार का बदलाव
- #4
डेटा साइंस Python नोटबुक्स: डीप लर्निंग (TensorFlow, Theano, Caffe, Keras), scikit-learn, Kaggle, बिग डेटा (Spark, Hadoop MapReduce, HDFS), matplotlib, pandas, NumPy, SciPy, Python आवश्यक चीज़ें, AWS, और विभिन्न कमांड लाइन्स।
★ 29,334+27पिछले 7 दिनों में स्टार का बदलाव - #5★ 26,302+27पिछले 7 दिनों में स्टार का बदलाव
- #6
ओपन-सोर्स IoT प्लेटफॉर्म - डिवाइस प्रबंधन, डेटा संग्रह, प्रोसेसिंग और विज़ुअलाइज़ेशन।
★ 22,327+34पिछले 7 दिनों में स्टार का बदलाव - #7★ 19,128+5पिछले 7 दिनों में स्टार का बदलाव
- #8
बिग डेटा के लिए शुरुआती गाइड।
★ 16,958+6पिछले 7 दिनों में स्टार का बदलाव - #9★ 16,725+3पिछले 7 दिनों में स्टार का बदलाव
- #10★ 15,383+36पिछले 7 दिनों में स्टार का बदलाव
- #11
Trino की आधिकारिक रिपॉजिटरी, जो बिग डेटा के लिए वितरित SQL क्वेरी इंजन है, जिसे पहले PrestoSQL (https://trino.io) के रूप में जाना जाता था
★ 13,194+24पिछले 7 दिनों में स्टार का बदलाव - #12
एक वितरित, तेज़ ओपन-सोर्स ग्राफ़ डेटाबेस जिसमें हॉरिजॉन्टल स्केलेबिलिटी और उच्च उपलब्धता की सुविधा है
★ 12,367+12पिछले 7 दिनों में स्टार का बदलाव - #13★ 12,272+12पिछले 7 दिनों में स्टार का बदलाव
- #14
डेटा लेकहाउस पर और बाहर दोनों जगह सब-सेकंड एनालिटिक्स के लिए दुनिया का सबसे तेज़ ओपन क्वेरी इंजन। लगभग किसी भी परिदृश्य का समर्थन करने की लचीलेपन के साथ, StarRocks बहु-आयामी एनालिटिक्स, वास्तविक समय एनालिटिक्स और एड-हॉक क्वेरी के लिए सर्वश्रेष्ठ प्रदर्शन प्रदान करता है। एक Linux Foundation प्रोजेक्ट।
★ 12,057+28पिछले 7 दिनों में स्टार का बदलाव - #15★ 11,556+21पिछले 7 दिनों में स्टार का बदलाव
- #16★ 10,836+6पिछले 7 दिनों में स्टार का बदलाव
- #17
Apache DataFusion SQL Query Engine
★ 9,248+71पिछले 7 दिनों में स्टार का बदलाव - #18
Python, R, Java, C++ के लिए रैंकिंग, वर्गीकरण, रिग्रेशन और अन्य मशीन लर्निंग कार्यों के लिए उपयोग की जाने वाली एक तेज़, स्केलेबल, उच्च-प्रदर्शन Gradient Boosting on Decision Trees लाइब्रेरी। CPU और GPU पर गणना का समर्थन करती है।
★ 9,085+13पिछले 7 दिनों में स्टार का बदलाव - #19
एक ओपन-सोर्स स्टोरेज फ्रेमवर्क जो Spark, PrestoDB, Flink, Trino, और Hive सहित कंप्यूट इंजन और API के साथ Lakehouse आर्किटेक्चर बनाने में सक्षम बनाता है
★ 8,962+17पिछले 7 दिनों में स्टार का बदलाव - #20★ 8,653+5पिछले 7 दिनों में स्टार का बदलाव
- #21
H2O एक ओपन सोर्स, वितरित, तेज़ और स्केलेबल मशीन लर्निंग प्लेटफ़ॉर्म है: डीप लर्निंग, ग्रेडिएंट बूस्टिंग (GBM) और XGBoost, रैंडम फ़ॉरेस्ट, जनरलाइज्ड लीनियर मॉडलिंग (GLM with Elastic Net), K-Means, PCA, जनरलाइज्ड एडिटिव मॉडल (GAM), रूलफिट, सपोर्ट वेक्टर मशीन (SVM), स्टैक्ड एनसेम्बल्स, ऑटोमैटिक मशीन लर्निंग (AutoML), आदि।
★ 7,496+1पिछले 7 दिनों में स्टार का बदलाव - #22
Arkime एक ओपन-सोर्स, बड़े पैमाने पर, पूर्ण पैकेट कैप्चरिंग, इंडेक्सिंग और डेटाबेस सिस्टम है।
★ 7,460+12पिछले 7 दिनों में स्टार का बदलाव - #23★ 7,239+15पिछले 7 दिनों में स्टार का बदलाव
- #24★ 7,072+14पिछले 7 दिनों में स्टार का बदलाव
- #25
विश्वसनीयता के लिए डिज़ाइन किया गया एक सहज HTTP/JSON API के साथ सहज मल्टी-प्राइमरी सिंकिंग डेटाबेस
★ 6,944+5पिछले 7 दिनों में स्टार का बदलाव - #26
वेब-आधारित नोटबुक जो SQL, Scala और अन्य के साथ डेटा-संचालित, इंटरैक्टिव डेटा एनालिटिक्स और सहयोगात्मक दस्तावेज़ सक्षम करती है।
★ 6,655+3पिछले 7 दिनों में स्टार का बदलाव - #27
Hazelcast एक एकीकृत रियल-टाइम डेटा प्लेटफ़ॉर्म है जो स्ट्रीम प्रोसेसिंग को तेज़ डेटा स्टोर के साथ जोड़ता है, जिससे ग्राहकों को रियल-टाइम इंसights के लिए डेटा-इन-मशन पर तुरंत कार्रवाई करने की अनुमति मिलती है।
★ 6,604+3पिछले 7 दिनों में स्टार का बदलाव - #28★ 6,385+2पिछले 7 दिनों में स्टार का बदलाव
- #29★ 6,308+1पिछले 7 दिनों में स्टार का बदलाव
- #30★ 6,015+1पिछले 7 दिनों में स्टार का बदलाव