spark
spark टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #61
उच्च प्रदर्शन डेटा स्टोर समाधान
★ 1,452+0पिछले 7 दिनों में स्टार का बदलाव - #62
यह Learning Spark: Lightning-Fast Data Analytics [2nd Edition] के लिए गिटहब रेपो है
★ 1,402+2पिछले 7 दिनों में स्टार का बदलाव - #63
Docker और Kubernetes के लिए 50+ DockerHub पब्लिक इमेज - DevOps, CI/CD, GitHub Actions, CircleCI, Jenkins, TeamCity, Alpine, CentOS, Debian, Fedora, Ubuntu, Hadoop, Kafka, ZooKeeper, HBase, Cassandra, Solr, SolrCloud, Presto, Apache Drill, Nifi, Spark, Consul, Riak
★ 1,379+0पिछले 7 दिनों में स्टार का बदलाव - #64
रिमोट Spark क्लस्टर के साथ काम करने के लिए Jupyter मैजिक और कर्नेल
★ 1,365-1पिछले 7 दिनों में स्टार का बदलाव - #65
Taier सबमिशन, शेड्यूलिंग, ऑपरेशन और मेंटेनेंस, और इंडिकेटर जानकारी डिस्प्ले के लिए एक बिग डेटा डेवलपमेंट प्लेटफॉर्म है
★ 1,284+0पिछले 7 दिनों में स्टार का बदलाव - #66
PySpark-Tutorial PySpark का उपयोग करके बुनियादी एल्गोरिदम प्रदान करता है
★ 1,280+0पिछले 7 दिनों में स्टार का बदलाव - #67
Apache DataFusion Comet Spark Accelerator
★ 1,262+2पिछले 7 दिनों में स्टार का बदलाव - #68
ML का उपयोग करके स्केलेबल मास्टर डेटा प्रबंधन, पहचान समाधान, एंटिटी समाधान और डुप्लीकेट हटाना।
★ 1,243+5पिछले 7 दिनों में स्टार का बदलाव - #69
GraphFrames, Apache Spark के लिए एक पैकेज है जो DataFrame-आधारित Graphs प्रदान करता है
★ 1,202+0पिछले 7 दिनों में स्टार का बदलाव - #70
Apache Amoro (इन्क्यूबेटिंग) ओपन डेटा लेक फॉर्मेट पर निर्मित एक Lakehouse प्रबंधन प्रणाली है।
★ 1,171+0पिछले 7 दिनों में स्टार का बदलाव - #71
एक डेटा इंजीनियरिंग और मशीन लर्निंग नॉलेज हब
★ 1,146+0पिछले 7 दिनों में स्टार का बदलाव - #72
Apache Celeborn शफल और स्पिल्ड डेटा के लिए एक इलास्टिक और उच्च-प्रदर्शन वाली सेवा है
★ 1,062+2पिछले 7 दिनों में स्टार का बदलाव - #73
ADAM एक जीनोमिक्स विश्लेषण प्लेटफ़ॉर्म है जिसमें Apache Avro, Apache Spark और Apache Parquet का उपयोग करके बनाए गए विशेष फ़ाइल फॉर्मेट शामिल हैं। Apache 2 लाइसेंस प्राप्त।
★ 1,059+2पिछले 7 दिनों में स्टार का बदलाव - #74
ListenBrainz प्रोजेक्ट के लिए सर्वर, जिसमें फ्रंट-एंड (javascript/react) कोड और LB द्वारा उपयोग किए जाने वाले सभी डेटा प्रोसेसिंग घटक शामिल हैं।
★ 1,007+4पिछले 7 दिनों में स्टार का बदलाव - #75
Apache Spark के लिए NVIDIA cuDF प्लगइन - GPU के साथ Apache Spark को गति दें
★ 999+1पिछले 7 दिनों में स्टार का बदलाव - #76
Apache Spark के लिए एक मुफ्त ट्यूटोरियल
★ 988+0पिछले 7 दिनों में स्टार का बदलाव - #77
Sparkling Water Spark क्लस्टर के भीतर H2O कार्यक्षमता प्रदान करता है
★ 980+1पिछले 7 दिनों में स्टार का बदलाव - #78★ 971-1पिछले 7 दिनों में स्टार का बदलाव
- #79
Apache Livy कहीं से भी Apache Spark के साथ इंटरैक्ट करने के लिए एक ओपन सोर्स REST इंटरफ़ेस है।
★ 962+2पिछले 7 दिनों में स्टार का बदलाव - #80
सुरक्षित डेटा शेयरिंग के लिए एक ओपन प्रोटोकॉल।
★ 958-1पिछले 7 दिनों में स्टार का बदलाव - #81
GenAI एप्लिकेशन के लिए डेटा तैयार करने हेतु ओपन सोर्स प्रोजेक्ट।
★ 958+2पिछले 7 दिनों में स्टार का बदलाव - #82★ 948+0पिछले 7 दिनों में स्टार का बदलाव
- #83
Spark के लिए एक कनेक्टर जो Redis क्लस्टर से डेटा पढ़ने और लिखने की अनुमति देता है
★ 945+0पिछले 7 दिनों में स्टार का बदलाव - #84★ 895-2पिछले 7 दिनों में स्टार का बदलाव
- #85★ 889+0पिछले 7 दिनों में स्टार का बदलाव
- #86
Ada और SPARK प्रोग्रामिंग भाषा से संबंधित बेहतरीन संसाधनों की एक क्यूरेटेड सूची
★ 865+2पिछले 7 दिनों में स्टार का बदलाव - #87
DoEKS Amazon EKS पर डेटा प्लेटफॉर्म बनाने, डिप्लॉय करने और स्केल करने के लिए एक टूल है
★ 856-1पिछले 7 दिनों में स्टार का बदलाव - #88
इस रिपॉजिटरी में sparkMeasure के लिए विकास कोड है, जो एक Apache Spark प्रदर्शन विश्लेषण और समस्या निवारण लाइब्रेरी है। यह स्पार्क टास्क/स्टेज मेट्रिक्स को एकत्र करने, समेकित करने और निर्यात करने को सरल बनाता है, और इंटरैक्टिव विश्लेषण, परीक्षण और उत्पादन निगरानी वर्कफ़्लो में डेवलपर्स और डेटा इंजीनियरों द्वारा व्यावहारिक उपयोग के लिए डिज़ाइन किया गया है।
★ 827-2पिछले 7 दिनों में स्टार का बदलाव - #89
80+ DevOps और Data CLI टूल्स - AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, Spark Data Converters & Validators (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr आदि
★ 824+0पिछले 7 दिनों में स्टार का बदलाव - #90
Scriptis स्क्रिप्ट डेवलपमेंट (SQL, Pyspark, HiveQL), टास्क सबमिशन (Spark, Hive), UDF, फंक्शन, रिसोर्स मैनेजमेंट और इंटेलिजेंट डायग्नोसिस के साथ इंटरैक्टिव डेटा एनालिसिस के लिए है।
★ 814+0पिछले 7 दिनों में स्टार का बदलाव