big-data
big-data टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #61★ 1,766-1पिछले 7 दिनों में स्टार का बदलाव
- #62
AWS पर पेटाबाइट पैमाने पर थ्रेट हंटिंग, डिटेक्शन और रिस्पॉन्स, और साइबर सुरक्षा एनालिटिक्स के लिए ओपन सोर्स सुरक्षा डेटा झील
★ 1,694+0पिछले 7 दिनों में स्टार का बदलाव - #63
बिग डेटा एनालिसिस और मशीन लर्निंग के लिए Apache Spark और Python (pySpark) ट्यूटोरियल IPython / Jupyter नोटबुक्स के रूप में
★ 1,660+0पिछले 7 दिनों में स्टार का बदलाव - #64★ 1,618+3पिछले 7 दिनों में स्टार का बदलाव
- #65
:bar_chart: :clipboard: YAML या JSON फ़ाइलों का उपयोग करने वाले डैशबोर्ड
★ 1,582+1पिछले 7 दिनों में स्टार का बदलाव - #66
Dremio - आधुनिक डेटा में गायब कड़ी
★ 1,492+1पिछले 7 दिनों में स्टार का बदलाव - #67
उच्च प्रदर्शन डेटा स्टोर समाधान
★ 1,452+0पिछले 7 दिनों में स्टार का बदलाव - #68★ 1,384+0पिछले 7 दिनों में स्टार का बदलाव
- #69
एक उन्नत और परिपक्व ओपन-सोर्स MPP (Massively Parallel Processing) डेटाबेस। Greenplum Database का ओपन-सोर्स विकल्प।
★ 1,382+5पिछले 7 दिनों में स्टार का बदलाव - #70
Scikit-learn के लिए एक्सटेंशन आपके Scikit-learn एप्लिकेशन को गति देने का एक सहज तरीका है
★ 1,356+0पिछले 7 दिनों में स्टार का बदलाव - #71
PySpark-Tutorial PySpark का उपयोग करके बुनियादी एल्गोरिदम प्रदान करता है
★ 1,280+0पिछले 7 दिनों में स्टार का बदलाव - #72
डेटा एनालिटिक्स और ऑब्जेक्ट स्टोर वर्कलोड के लिए अनुकूलित स्केलेबल, विश्वसनीय, वितरित स्टोरेज सिस्टम।
★ 1,270+1पिछले 7 दिनों में स्टार का बदलाव - #73
Apache Parquet फ़ाइलों को देखने और क्वेरी करने के लिए सरल Windows डेस्कटॉप एप्लिकेशन
★ 1,231+2पिछले 7 दिनों में स्टार का बदलाव - #74
GraphFrames, Apache Spark के लिए एक पैकेज है जो DataFrame-आधारित Graphs प्रदान करता है
★ 1,202+0पिछले 7 दिनों में स्टार का बदलाव - #75
Apache Amoro (इन्क्यूबेटिंग) ओपन डेटा लेक फॉर्मेट पर निर्मित एक Lakehouse प्रबंधन प्रणाली है।
★ 1,171+0पिछले 7 दिनों में स्टार का बदलाव - #76★ 1,165+2पिछले 7 दिनों में स्टार का बदलाव
- #77
ClickBench: विश्लेषणात्मक डेटाबेस के लिए एक बेंचमार्क
★ 1,101+9पिछले 7 दिनों में स्टार का बदलाव - #78
बेहतरीन डेटा कैटलॉग और ऑब्जर्वेबिलिटी प्लेटफॉर्म।
★ 1,068+5पिछले 7 दिनों में स्टार का बदलाव - #79
ADAM एक जीनोमिक्स विश्लेषण प्लेटफ़ॉर्म है जिसमें Apache Avro, Apache Spark और Apache Parquet का उपयोग करके बनाए गए विशेष फ़ाइल फॉर्मेट शामिल हैं। Apache 2 लाइसेंस प्राप्त।
★ 1,059+2पिछले 7 दिनों में स्टार का बदलाव - #80
एक ClickHouse फोर्क जो हाई-परफॉर्मेंस वेक्टर सर्च और फुल-टेक्स्ट सर्च को सपोर्ट करता है।
★ 1,041+1पिछले 7 दिनों में स्टार का बदलाव - #81
Apache Flink Kubernetes ऑपरेटर
★ 1,031+3पिछले 7 दिनों में स्टार का बदलाव - #82
डेटा साइंस, मशीन लर्निंग, बिग डेटा और बिजनेस एनालिटिक्स करियर के लिए संसाधन रिपॉजिटरी
★ 1,021+1पिछले 7 दिनों में स्टार का बदलाव - #83
ListenBrainz प्रोजेक्ट के लिए सर्वर, जिसमें फ्रंट-एंड (javascript/react) कोड और LB द्वारा उपयोग किए जाने वाले सभी डेटा प्रोसेसिंग घटक शामिल हैं।
★ 1,007+5पिछले 7 दिनों में स्टार का बदलाव - #84
Apache Spark के लिए NVIDIA cuDF प्लगइन - GPU के साथ Apache Spark को गति दें
★ 999+2पिछले 7 दिनों में स्टार का बदलाव - #85
Sparkling Water Spark क्लस्टर के भीतर H2O कार्यक्षमता प्रदान करता है
★ 980+1पिछले 7 दिनों में स्टार का बदलाव - #86
सुरक्षित डेटा शेयरिंग के लिए एक ओपन प्रोटोकॉल।
★ 958+0पिछले 7 दिनों में स्टार का बदलाव - #87
सांख्यिकी के लिए सिंगल-पास एल्गोरिदम
★ 897+0पिछले 7 दिनों में स्टार का बदलाव - #88
स्पेनिश में डेटा इंजीनियरिंग के बुनियादी सिद्धांतों, तकनीकी चुनौतियों और संसाधनों का एक संग्रह
★ 896+1पिछले 7 दिनों में स्टार का बदलाव - #89
अत्याधुनिक लर्नड डेटा स्ट्रक्चर जो अरबों आइटम वाली ऐरे में तेज़ लुकअप, प्रेडिसेसर, रेंज सर्च और अपडेट को पारंपरिक इंडेक्स की तुलना में बहुत कम जगह में सक्षम बनाता है
★ 873+1पिछले 7 दिनों में स्टार का बदलाव - #90
AI प्रोजेक्ट्स
★ 868+1पिछले 7 दिनों में स्टार का बदलाव