spark
spark टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर spark के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और spark टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
डेटा इंजीनियरिंग ज़ूमकैंप प्रोडक्शन-रेडी डेटा पाइपलाइन बनाने पर एक मुफ़्त 9-सप्ताह का कोर्स है। अगला बैच जनवरी 2026 में शुरू होगा। यहाँ कोर्स में शामिल हों 👇🏼
★ 45,183+114पिछले 7 दिनों में स्टार का बदलाव - #2★ 43,943+42पिछले 7 दिनों में स्टार का बदलाव
- #3
डेटा साइंस Python नोटबुक्स: डीप लर्निंग (TensorFlow, Theano, Caffe, Keras), scikit-learn, Kaggle, बिग डेटा (Spark, Hadoop MapReduce, HDFS), matplotlib, pandas, NumPy, SciPy, Python आवश्यक चीज़ें, AWS, और विभिन्न कमांड लाइन्स।
★ 29,339+5पिछले 7 दिनों में स्टार का बदलाव - #4
अपनी कंपनी को डेटा-संचालित बनाएं। किसी भी डेटा स्रोत से जुड़ें, आसानी से विज़ुअलाइज़ करें, डैशबोर्ड बनाएं और अपना डेटा साझा करें।
★ 28,778+11पिछले 7 दिनों में स्टार का बदलाव - #5
नवीनतम Docker कंटेनर तकनीक, वास्तविक मामलों से सर्वोत्तम अभ्यास सीखें! | वास्तविक DevOps अभ्यास के साथ Docker और कंटेनर तकनीकों को सीखें और समझें!
★ 26,231+7पिछले 7 दिनों में स्टार का बदलाव - #6
बिग डेटा के लिए शुरुआती गाइड।
★ 16,962+4पिछले 7 दिनों में स्टार का बदलाव - #7
दुनिया पर राज करने के लिए डेटा साइंस चीटशीट की सूची
★ 16,329-1पिछले 7 दिनों में स्टार का बदलाव - #8
ChatGPT API और कई LLM के लिए GUI। एजेंट, फ़ाइल-आधारित QA, GPT फ़ाइनट्यूनिंग और वेब खोज के साथ क्वेरी का समर्थन करता है। एक साफ-सुथरे UI के साथ।
★ 15,274-2पिछले 7 दिनों में स्टार का बदलाव - #9
flink सीखने का ब्लॉग। http://www.54tianzhisheng.cn/ जिसमें Flink परिचय, अवधारणाएं, सिद्धांत, व्यावहारिक, प्रदर्शन ट्यूनिंग, स्रोत कोड विश्लेषण आदि सामग्री शामिल है। Flink Connector, Metrics, Library, DataStream API, Table API और SQL आदि सीखने के मामलों को शामिल करता है, और Flink के वास्तविक दुनिया के अनुप्रयोगों (PVUV, लॉग स्टोरेज, अरबों डेटा रीयल-टाइम डिडुप्लीकेशन, मॉनिटरिंग और अलर्ट) के बड़े प्रोजेक्ट केस शेयरिंग भी हैं। मेरे कॉलम "大数据实时计算引擎 Flink 实战与性能优化" का समर्थन करने के लिए सभी का स्वागत है।
★ 15,096+1पिछले 7 दिनों में स्टार का बदलाव - #10
[बड़े उद्यम साक्षात्कार कॉलम] Java प्रोग्रामर्स के लिए एक तकनीकी गाइड, जिसमें साक्षात्कार के प्रश्न, सिस्टम आर्किटेक्चर, करियर टिप्स और मुख्यधारा के मिडलवेयर शामिल हैं, ताकि आप खुद को बेहतर बना सकें!
★ 14,733-1पिछले 7 दिनों में स्टार का बदलाव - #11
JVM का उपयोग करके डीप लर्निंग मॉडल को तैनात और प्रशिक्षित करने के लिए टूल का सुइट। मुख्य विशेषताओं में keras, tensorflow, और onnx/pytorch के लिए मॉडल आयात, गणित कोड चलाने के लिए एक मॉड्यूलर और छोटी c++ लाइब्रेरी और कोर c++ लाइब्रेरी के शीर्ष पर एक जावा-आधारित गणित लाइब्रेरी शामिल है। इसमें samediff भी शामिल है: डीप लर्निंग चलाने के लिए एक pytorch/tensorflow जैसी लाइब्रेरी...
★ 14,248+0पिछले 7 दिनों में स्टार का बदलाव - #12★ 9,588+9पिछले 7 दिनों में स्टार का बदलाव
- #13
एक ओपन-सोर्स स्टोरेज फ्रेमवर्क जो Spark, PrestoDB, Flink, Trino, और Hive सहित कंप्यूट इंजन और API के साथ Lakehouse आर्किटेक्चर बनाने में सक्षम बनाता है
★ 8,984+22पिछले 7 दिनों में स्टार का बदलाव - #14
🧙 डेटा को एकीकृत और रूपांतरित करने के लिए डेटा पाइपलाइन का निर्माण, संचालन और प्रबंधन करें।
★ 8,818+4पिछले 7 दिनों में स्टार का बदलाव - #15
H2O एक ओपन सोर्स, वितरित, तेज़ और स्केलेबल मशीन लर्निंग प्लेटफ़ॉर्म है: डीप लर्निंग, ग्रेडिएंट बूस्टिंग (GBM) और XGBoost, रैंडम फ़ॉरेस्ट, जनरलाइज्ड लीनियर मॉडलिंग (GLM with Elastic Net), K-Means, PCA, जनरलाइज्ड एडिटिव मॉडल (GAM), रूलफिट, सपोर्ट वेक्टर मशीन (SVM), स्टैक्ड एनसेम्बल्स, ऑटोमैटिक मशीन लर्निंग (AutoML), आदि।
★ 7,499+3पिछले 7 दिनों में स्टार का बदलाव - #16★ 7,234+3पिछले 7 दिनों में स्टार का बदलाव
- #17★ 6,788+1पिछले 7 दिनों में स्टार का बदलाव
- #18
वेब-आधारित नोटबुक जो SQL, Scala और अन्य के साथ डेटा-संचालित, इंटरैक्टिव डेटा एनालिटिक्स और सहयोगात्मक दस्तावेज़ सक्षम करती है।
★ 6,655+0पिछले 7 दिनों में स्टार का बदलाव - #19
Spark के लिए ML एल्गोरिदम पोर्ट करने वाली सरल और वितरित मशीन लर्निंग Python लाइब्रेरी
★ 5,245+3पिछले 7 दिनों में स्टार का बदलाव - #20
cube studio ओपन-सोर्स क्लाउड-नेटिव वन-स्टॉप मशीन लर्निंग/डीप लर्निंग/लार्ज मॉडल AI प्लेटफॉर्म।
★ 5,078+3पिछले 7 दिनों में स्टार का बदलाव - #21★ 4,160+1पिछले 7 दिनों में स्टार का बदलाव
- #22★ 3,931+0पिछले 7 दिनों में स्टार का बदलाव
- #23
Java में एक बेहतर संपीड़ित बिटसेट: Apache Spark, Netflix Atlas, Apache Pinot, Tablesaw और कई अन्य द्वारा उपयोग किया जाता है
★ 3,921+2पिछले 7 दिनों में स्टार का बदलाव - #24
Deequ, Apache Spark पर बनी एक लाइब्रेरी है जो "डेटा के लिए यूनिट टेस्ट" परिभाषित करती है, जो बड़े डेटासेट में डेटा गुणवत्ता को मापती है।
★ 3,642+0पिछले 7 दिनों में स्टार का बदलाव - #25
🔨 JSON का उपयोग करके संरचित SQL स्टेटमेंट जनरेट करें, जो Vue3 + TypeScript + Vite + Ant Design + MonacoEditor के साथ कार्यान्वित है। प्रोजेक्ट सरल है (लॉजिक पर अधिक और यूआई पर कम ध्यान), अभ्यास के लिए उपयुक्त ~
★ 3,424+0पिछले 7 दिनों में स्टार का बदलाव - #26
Apache Linkis ऊपरी अनुप्रयोगों और अंतर्निहित डेटा इंजन के बीच कनेक्शन, शासन और ऑर्केस्ट्रेश को सुविधाजनक बनाने के लिए एक कंप्यूटेशन मिडलवेयर लेयर बनाता है।
★ 3,409+2पिछले 7 दिनों में स्टार का बदलाव - #27
Apache Paimon एक लेक फॉर्मेट है जो स्ट्रीमिंग और बैच दोनों ऑपरेशनों के लिए Flink और Spark के साथ रियलटाइम लेकहाउस आर्किटेक्चर के निर्माण को सक्षम बनाता है।
★ 3,388+3पिछले 7 दिनों में स्टार का बदलाव - #28★ 3,374+1पिछले 7 दिनों में स्टार का बदलाव
- #29
Rust में लिखा गया ड्रॉप-इन Apache Spark रिप्लेसमेंट, जो बैच प्रोसेसिंग, स्ट्रीम प्रोसेसिंग और कंप्यूट-इंटेंसिव AI वर्कलोड को एकजुट करता है।
★ 3,341+4पिछले 7 दिनों में स्टार का बदलाव - #30
DataSphereStudio एक वन-स्टॉप डेटा एप्लिकेशन विकास और प्रबंधन पोर्टल है, जिसमें डेटा एक्सचेंज, डीसेंसिटाइजेशन/क्लींजिंग, विश्लेषण/माइनिंग, गुणवत्ता माप, विज़ुअलाइज़ेशन और टास्क शेड्यूलिंग शामिल हैं।
★ 3,262-1पिछले 7 दिनों में स्टार का बदलाव