pyspark
pyspark टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर pyspark के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और pyspark टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1★ 6,650+1पिछले 7 दिनों में स्टार का बदलाव
- #2
Spark के लिए ML एल्गोरिदम पोर्ट करने वाली सरल और वितरित मशीन लर्निंग Python लाइब्रेरी
★ 5,245+3पिछले 7 दिनों में स्टार का बदलाव - #3★ 4,160+1पिछले 7 दिनों में स्टार का बदलाव
- #4
Apache Linkis ऊपरी अनुप्रयोगों और अंतर्निहित डेटा इंजन के बीच कनेक्शन, शासन और ऑर्केस्ट्रेश को सुविधाजनक बनाने के लिए एक कंप्यूटेशन मिडलवेयर लेयर बनाता है।
★ 3,409+2पिछले 7 दिनों में स्टार का बदलाव - #5
Rust में लिखा गया ड्रॉप-इन Apache Spark रिप्लेसमेंट, जो बैच प्रोसेसिंग, स्ट्रीम प्रोसेसिंग और कंप्यूट-इंटेंसिव AI वर्कलोड को एकजुट करता है।
★ 3,341+4पिछले 7 दिनों में स्टार का बदलाव - #6
शानदार Apache Spark पैकेज और संसाधनों की एक क्यूरेटेड सूची।
★ 1,893+0पिछले 7 दिनों में स्टार का बदलाव - #7
Petastorm लाइब्रेरी Apache Parquet फॉर्मेट में डेटासेट से डीप लर्निंग मॉडल के सिंगल-मशीन या वितरित प्रशिक्षण और मूल्यांकन को सक्षम बनाती है। यह Tensorflow, Pytorch, और PySpark जैसे ML फ्रेमवर्क का समर्थन करती है और इसका उपयोग शुद्ध Python कोड से किया जा सकता है।
★ 1,892+0पिछले 7 दिनों में स्टार का बदलाव - #8★ 1,714+4पिछले 7 दिनों में स्टार का बदलाव
- #9
बिग डेटा एनालिसिस और मशीन लर्निंग के लिए Apache Spark और Python (pySpark) ट्यूटोरियल IPython / Jupyter नोटबुक्स के रूप में
★ 1,660+0पिछले 7 दिनों में स्टार का बदलाव - #10
:truck: Pandas, Dask, cuDF, Dask-cuDF, Vaex और PySpark के साथ एगिले डेटा प्रिपरेशन वर्कफ़्लो को आसान बनाया गया
★ 1,536+0पिछले 7 दिनों में स्टार का बदलाव - #11
रिमोट Spark क्लस्टर के साथ काम करने के लिए Jupyter मैजिक और कर्नेल
★ 1,365-1पिछले 7 दिनों में स्टार का बदलाव - #12★ 1,304+1पिछले 7 दिनों में स्टार का बदलाव
- #13
PySpark-Tutorial PySpark का उपयोग करके बुनियादी एल्गोरिदम प्रदान करता है
★ 1,280+0पिछले 7 दिनों में स्टार का बदलाव - #14
GraphFrames, Apache Spark के लिए एक पैकेज है जो DataFrame-आधारित Graphs प्रदान करता है
★ 1,202+0पिछले 7 दिनों में स्टार का बदलाव - #15
डेटा एल्गोरिदम बुक के लिए MapReduce, Spark, Java और Scala
★ 1,080-2पिछले 7 दिनों में स्टार का बदलाव - #16
Sparkling Water Spark क्लस्टर के भीतर H2O कार्यक्षमता प्रदान करता है
★ 980+1पिछले 7 दिनों में स्टार का बदलाव - #17
80+ DevOps और Data CLI टूल्स - AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, Spark Data Converters & Validators (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr आदि
★ 824+0पिछले 7 दिनों में स्टार का बदलाव - #18
कुशल डेटा पाइपलाइन बनाने के लिए Python फ्रेमवर्क। यह मॉड्यूलरिटी और सहयोग को बढ़ावा देता है, जिससे सरल, पुन: प्रयोज्य घटकों से जटिल पाइपलाइन बनाना संभव होता है।
★ 818+0पिछले 7 दिनों में स्टार का बदलाव - #19
Scriptis स्क्रिप्ट डेवलपमेंट (SQL, Pyspark, HiveQL), टास्क सबमिशन (Spark, Hive), UDF, फंक्शन, रिसोर्स मैनेजमेंट और इंटेलिजेंट डायग्नोसिस के साथ इंटरैक्टिव डेटा एनालिसिस के लिए है।
★ 814+0पिछले 7 दिनों में स्टार का बदलाव - #20★ 772-1पिछले 7 दिनों में स्टार का बदलाव
- #21★ 689+0पिछले 7 दिनों में स्टार का बदलाव
- #22★ 658+0पिछले 7 दिनों में स्टार का बदलाव
- #23
Docker पर JupyterLab इंटरफ़ेस के साथ अपना खुद का क्लस्टर बनाकर Scala, Python (PySpark) और R (SparkR) में Apache Spark सीखें। :zap:
★ 512+0पिछले 7 दिनों में स्टार का बदलाव