datalake
datalake टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर datalake के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और datalake टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
अपने डेटाबेस या डेटालेक (SQL, CSV, parquet) के साथ चैट करें। PandasAI LLMs और RAG का उपयोग करके डेटा विश्लेषण को संवादात्मक बनाता है।
★ 23,788+10पिछले 7 दिनों में स्टार का बदलाव - #2
Trino की आधिकारिक रिपॉजिटरी, जो बिग डेटा के लिए वितरित SQL क्वेरी इंजन है, जिसे पहले PrestoSQL (https://trino.io) के रूप में जाना जाता था
★ 13,200+6पिछले 7 दिनों में स्टार का बदलाव - #3
डेटा लेकहाउस पर और बाहर दोनों जगह सब-सेकंड एनालिटिक्स के लिए दुनिया का सबसे तेज़ ओपन क्वेरी इंजन। लगभग किसी भी परिदृश्य का समर्थन करने की लचीलेपन के साथ, StarRocks बहु-आयामी एनालिटिक्स, वास्तविक समय एनालिटिक्स और एड-हॉक क्वेरी के लिए सर्वश्रेष्ठ प्रदर्शन प्रदान करता है। एक Linux Foundation प्रोजेक्ट।
★ 12,071+14पिछले 7 दिनों में स्टार का बदलाव - #4
Deeplake एजेंटों के लिए AI डेटा रनटाइम है। यह मल्टीमॉडल डेटालेक के साथ सर्वरलेस पोस्टग्रेस प्रदान करता है, जो स्केलेबल रिट्रीवल और ट्रेनिंग को सक्षम बनाता है।
★ 9,229-1पिछले 7 दिनों में स्टार का बदलाव - #5★ 6,232+5पिछले 7 दिनों में स्टार का बदलाव
- #6★ 5,510+11पिछले 7 दिनों में स्टार का बदलाव
- #7
Dinky Apache Flink पर आधारित एक वास्तविक समय डेटा विकास प्लेटफ़ॉर्म है, जो चुस्त डेटा विकास, तैनाती और संचालन को सक्षम बनाता है।
★ 3,754+0पिछले 7 दिनों में स्टार का बदलाव - #8
हाई-परफॉरमेंस, जियो-डिस्ट्रीब्यूटेड और फेडेरेटेड मेटाडेटा लेक बनाने के लिए दुनिया का सबसे शक्तिशाली ओपन डेटा कैटलॉग।
★ 3,192+3पिछले 7 दिनों में स्टार का बदलाव - #9
S3, PostgreSQL, SQLite, Apache Iceberg और Delta Lake के साथ Apache Kafka® संगत ब्रोकर
★ 1,853+1पिछले 7 दिनों में स्टार का बदलाव - #10★ 1,594+0पिछले 7 दिनों में स्टार का बदलाव
- #11
ML का उपयोग करके स्केलेबल मास्टर डेटा प्रबंधन, पहचान समाधान, एंटिटी समाधान और डुप्लीकेट हटाना।
★ 1,243+5पिछले 7 दिनों में स्टार का बदलाव - #12
ClickBench: विश्लेषणात्मक डेटाबेस के लिए एक बेंचमार्क
★ 1,100+8पिछले 7 दिनों में स्टार का बदलाव - #13
SQL Server के साथ आधुनिक डेटा वेयरहाउस बनाने के लिए एक व्यापक गाइड, जिसमें ETL प्रक्रियाएं, डेटा मॉडलिंग और एनालिटिक्स शामिल हैं।
★ 934+16पिछले 7 दिनों में स्टार का बदलाव - #14
डेटा एजेंट्स में प्रगति पर लगातार अपडेट की जाने वाली पेपर सूची। हमारे पेपर "A Survey of Data Agents: Emerging Paradigm or Overstated Hype?" की साथी रिपॉजिटरी
★ 733+13पिछले 7 दिनों में स्टार का बदलाव - #15
एनालिटिक्स प्लेटफॉर्म और डेटा इंजीनियरिंग इकोसिस्टम में उपयोग किए जाने वाले ओपन सोर्स टूल्स की एक क्यूरेटेड सूची
★ 604+4पिछले 7 दिनों में स्टार का बदलाव - #16
Data Vault 2.0 संगत डेटा वेयरहाउस बनाने और लोड करने के लिए एक निःशुल्क dbt पैकेज (dbt द्वारा संचालित, जो एक ओपन सोर्स डेटा इंजीनियरिंग टूल है, dbt Labs का एक पंजीकृत ट्रेडमार्क है)
★ 595+0पिछले 7 दिनों में स्टार का बदलाव - #17
Apache Hudi से संबंधित जानकारी का संकलन।
★ 556+0पिछले 7 दिनों में स्टार का बदलाव