big-data
big-data टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #31
AI और मल्टीमॉडल वर्कलोड के लिए हाई-परफॉर्मेंस डेटा इंजन। किसी भी पैमाने पर इमेज, ऑडियो, वीडियो और स्ट्रक्चर्ड डेटा को प्रोसेस करें
★ 5,736+4पिछले 7 दिनों में स्टार का बदलाव - #32
Spark के लिए ML एल्गोरिदम पोर्ट करने वाली सरल और वितरित मशीन लर्निंग Python लाइब्रेरी
★ 5,245+3पिछले 7 दिनों में स्टार का बदलाव - #33★ 5,180+2पिछले 7 दिनों में स्टार का बदलाव
- #34★ 5,082+2पिछले 7 दिनों में स्टार का बदलाव
- #35
Stream Framework एक पायथन लाइब्रेरी है, जो आपको Cassandra या Redis का उपयोग करके न्यूज़ फ़ीड, एक्टिविटी स्ट्रीम और नोटिफिकेशन सिस्टम बनाने की सुविधा देती है।
★ 4,742-2पिछले 7 दिनों में स्टार का बदलाव - #36
⚡️ एक Vue कंपोनेंट जो उच्च रेंडर प्रदर्शन और दक्षता के साथ बड़ी मात्रा में डेटा सूची का समर्थन करता है।
★ 4,505-1पिछले 7 दिनों में स्टार का बदलाव - #37
छवियों के यूआरएल के बड़े सेट को आसानी से इमेज डेटासेट में बदलें। एक मशीन पर 20 घंटों में 100M यूआरएल डाउनलोड, आकार बदल और पैकेज कर सकता है।
★ 4,445+2पिछले 7 दिनों में स्टार का बदलाव - #38
CrateDB जटिल प्रश्नों के साथ भी, वास्तविक समय के करीब भारी मात्रा में डेटा को संग्रहीत और विश्लेषण करने के लिए एक वितरित और स्केलेबल SQL डेटाबेस है। यह PostgreSQL-संगत है, और Lucene पर आधारित है।
★ 4,432+3पिछले 7 दिनों में स्टार का बदलाव - #39★ 4,399+2पिछले 7 दिनों में स्टार का बदलाव
- #40
A से Z तक डेटा साइंस रोडमैप
★ 4,354+3पिछले 7 दिनों में स्टार का बदलाव - #41
🔨 🍇 💻 🚀 GraphScope: अलीबाबा का एक वन-स्टॉप लार्ज-स्केल ग्राफ कंप्यूटिंग सिस्टम
★ 3,557+1पिछले 7 दिनों में स्टार का बदलाव - #42
Rust के लिए एक्स्टेंसिबल SQL Lexer और Parser
★ 3,446+9पिछले 7 दिनों में स्टार का बदलाव - #43
Apache Paimon एक लेक फॉर्मेट है जो स्ट्रीमिंग और बैच दोनों ऑपरेशनों के लिए Flink और Spark के साथ रियलटाइम लेकहाउस आर्किटेक्चर के निर्माण को सक्षम बनाता है।
★ 3,388+3पिछले 7 दिनों में स्टार का बदलाव - #44★ 3,374+1पिछले 7 दिनों में स्टार का बदलाव
- #45
Rust में लिखा गया ड्रॉप-इन Apache Spark रिप्लेसमेंट, जो बैच प्रोसेसिंग, स्ट्रीम प्रोसेसिंग और कंप्यूट-इंटेंसिव AI वर्कलोड को एकजुट करता है।
★ 3,341+4पिछले 7 दिनों में स्टार का बदलाव - #46
एक ग्राफ़ डेटाबेस जो 100+ बिलियन से अधिक डेटा, उच्च प्रदर्शन और मापनीयता का समर्थन करता है (OLTP इंजन और REST-API और बैकएंड शामिल हैं)
★ 3,167+6पिछले 7 दिनों में स्टार का बदलाव - #47★ 3,098+1पिछले 7 दिनों में स्टार का बदलाव
- #48★ 2,656+14पिछले 7 दिनों में स्टार का बदलाव
- #49
ArcticDB एक उच्च-प्रदर्शन, सर्वर रहित DataFrame डेटाबेस है जिसे Python डेटा साइंस इकोसिस्टम के लिए बनाया गया है।
★ 2,505+8पिछले 7 दिनों में स्टार का बदलाव - #50★ 2,379+2पिछले 7 दिनों में स्टार का बदलाव
- #51
Apache Ambari, Apache Hadoop क्लस्टर के प्रोविजनिंग, प्रबंधन और मॉनिटरिंग को सरल बनाता है।
★ 2,311+0पिछले 7 दिनों में स्टार का बदलाव - #52★ 2,203+0पिछले 7 दिनों में स्टार का बदलाव
- #53★ 2,131+11पिछले 7 दिनों में स्टार का बदलाव
- #54
Apache DataFusion Ballista वितरित क्वेरी इंजन
★ 2,127+7पिछले 7 दिनों में स्टार का बदलाव - #55★ 2,022+0पिछले 7 दिनों में स्टार का बदलाव
- #56
Apache BookKeeper - अपेंड-ओनली वर्कलोड के लिए अनुकूलित एक स्केलेबल, फॉल्ट-टॉलरेंट और कम विलंबता वाला स्टोरेज सर्विस।
★ 2,011+1पिछले 7 दिनों में स्टार का बदलाव - #57
क्लाउड में BigData/AI अनुप्रयोगों के लिए फ़्लूइड, इलास्टिक डेटा एब्स्ट्रैक्शन और एक्सीलरेशन। (CNCF के तहत प्रोजेक्ट)
★ 1,967+0पिछले 7 दिनों में स्टार का बदलाव - #58★ 1,913+0पिछले 7 दिनों में स्टार का बदलाव
- #59
🚀 डेटा एनालिसिस और डेटा साइंस के लिए 500+ क्यूरेटेड संसाधन: Python, SQL, सांख्यिकी, ML, AI, विज़ुअलाइज़ेशन, चीटशीट, रोडमैप, इंटरव्यू की तैयारी। शुरुआती और विशेषज्ञों दोनों के लिए।
★ 1,890+8पिछले 7 दिनों में स्टार का बदलाव - #60
वितरित कंप्यूटिंग फ्रेमवर्क (जैसे Spark) के लिए Auron एक्सीलरेटर, जो क्वेरी प्रोसेसिंग को गति देने के लिए नेटिव वेक्टराइज्ड निष्पादन का लाभ उठाता है।
★ 1,798+2पिछले 7 दिनों में स्टार का बदलाव