data-engineering
data-engineering टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #61★ 1,498+0पिछले 7 दिनों में स्टार का बदलाव
- #62
पुस्तक के साथ आने वाला स्रोत कोड: Data Science on the Google Cloud Platform, Valliappa Lakshmanan, O'Reilly 2017
★ 1,429+1पिछले 7 दिनों में स्टार का बदलाव - #63
पहला ओपन-सोर्स डेटा डिस्कवरी और ऑब्ज़र्वेबिलिटी प्लेटफ़ॉर्म। हम डेटा प्रैक्टिशनर्स के जीवन को आसान बनाते हैं ताकि आप अपने व्यवसाय पर ध्यान केंद्रित कर सकें।
★ 1,427+1पिछले 7 दिनों में स्टार का बदलाव - #64
आपकी MLOps पहलों और डेटा पाइपलाइनों को किकस्टार्ट और मानकीकृत करने के लिए एक व्यापक Python पैकेज टेम्पलेट।
★ 1,416+0पिछले 7 दिनों में स्टार का बदलाव - #65
शीर्ष तकनीकी कंपनियों के 300+ इंजीनियरिंग ब्लॉग लेखों का एक क्यूरेटेड संग्रह। जानें कि सर्वश्रेष्ठ इंजीनियरिंग टीमें बड़े पैमाने पर वास्तविक दुनिया की समस्याओं को कैसे हल करती हैं।
★ 1,388+8पिछले 7 दिनों में स्टार का बदलाव - #66
वास्तविक दुनिया کے ایک ماہر کی طرف سے سب سے زیادہ جامع SQL گাইড! بنیادی باتوں سے لے کر جدید کوئریز، آپ্টিমাইজیشن اور حقیقی دنیا کے SQL تک سب کچھ سیکھیں۔
★ 1,384+7पिछले 7 दिनों में स्टार का बदलाव - #67
Quilt AWS पर एक वैज्ञानिक डेटा प्रबंधन प्लेटफ़ॉर्म है जो टीमों और AI को गहराई से वर्शन किए गए, संदर्भ-समृद्ध डेटा पैकेजों के माध्यम से डेटा खोजने, उस पर भरोसा करने और उसका पुन: उपयोग करने में मदद करता है।
★ 1,370+0पिछले 7 दिनों में स्टार का बदलाव - #68
ओपन-सोर्स ETL/ELT जिसे आप अपने सर्वर या क्लाउड पर तैनात कर सकते हैं। DuckDB पर निर्मित: नो-कोड/लो-कोड विजुअल पाइपलाइन या SQL, 385 घटक, dbt, CDC, डेटा गुणवत्ता, रिवर्स ETL, लाइनage, AI एजेंटों के लिए MCP। कोई वेंडर क्लाउड नहीं, प्रति-पंक्ति बिलिंग नहीं।
★ 1,262+15पिछले 7 दिनों में स्टार का बदलाव - #69
डेटा-केंद्रित AI संसाधनों की एक क्यूरेटेड, लेकिन अधूरी सूची।
★ 1,159+1पिछले 7 दिनों में स्टार का बदलाव - #70
एक डेटा इंजीनियरिंग और मशीन लर्निंग नॉलेज हब
★ 1,146+0पिछले 7 दिनों में स्टार का बदलाव - #71
Open Data Contract Standard (ODCS) का होम।
★ 1,118+18पिछले 7 दिनों में स्टार का बदलाव - #72
बेहतरीन डेटा कैटलॉग और ऑब्जर्वेबिलिटी प्लेटफॉर्म।
★ 1,068+5पिछले 7 दिनों में स्टार का बदलाव - #73
डेटा कॉन्ट्रैक्ट्स को लागू करें
★ 1,058+8पिछले 7 दिनों में स्टार का बदलाव - #74
Estuary के साथ डेटा प्रवाह को प्रबंधित करके, उन सिस्टम्स को लगातार सिंक्रोनाइज़ करें जहाँ आपका डेटा रहता है, उन सिस्टम्स के साथ जहाँ आप इसे रखना चाहते हैं।
★ 972+7पिछले 7 दिनों में स्टार का बदलाव - #75
FlyFish एक डेटा विज़ुअलाइज़ेशन कोडिंग प्लेटफ़ॉर्म है। हम सरल तरीके से डेटा मॉडल बना सकते हैं और ड्रैग-एंड-ड्रॉप के माध्यम से डेटा विज़ुअलाइज़ेशन समाधान तैयार कर सकते हैं।
★ 961+0पिछले 7 दिनों में स्टार का बदलाव - #76
SQL Server के साथ आधुनिक डेटा वेयरहाउस बनाने के लिए एक व्यापक गाइड, जिसमें ETL प्रक्रियाएं, डेटा मॉडलिंग और एनालिटिक्स शामिल हैं।
★ 932+14पिछले 7 दिनों में स्टार का बदलाव - #77★ 921+0पिछले 7 दिनों में स्टार का बदलाव
- #78
स्पेनिश में डेटा इंजीनियरिंग के बुनियादी सिद्धांतों, तकनीकी चुनौतियों और संसाधनों का एक संग्रह
★ 896+1पिछले 7 दिनों में स्टार का बदलाव - #79
डेटा पर तेज़, लागत प्रभावी वितरित कंप्यूट के लिए समुदाय-संचालित, सरल, फिर भी शक्तिशाली फ्रेमवर्क।
★ 871+1पिछले 7 दिनों में स्टार का बदलाव - #80
Neum AI बड़े पैमाने पर वेक्टर एम्बेडिंग के निर्माण और सिंक्रनाइज़ेशन को प्रबंधित करने के लिए एक बेहतरीन फ्रेमवर्क है।
★ 867+0पिछले 7 दिनों में स्टार का बदलाव - #81
The Complete dbt (Data Build Tool) Bootcamp Udemy कोर्स के लिए पूरक सामग्री
★ 827+0पिछले 7 दिनों में स्टार का बदलाव - #82
प्रैक्टिकल डेटा इंजीनियरिंग: एक हैंड्स-ऑन रियल-एस्टेट प्रोजेक्ट गाइड
★ 823+2पिछले 7 दिनों में स्टार का बदलाव - #83
कुशल डेटा पाइपलाइन बनाने के लिए Python फ्रेमवर्क। यह मॉड्यूलरिटी और सहयोग को बढ़ावा देता है, जिससे सरल, पुन: प्रयोज्य घटकों से जटिल पाइपलाइन बनाना संभव होता है।
★ 818+0पिछले 7 दिनों में स्टार का बदलाव - #84
dbt, SQL और क्लाउड वेयरहाउस के लिए ओपन-सोर्स एजेंटिक डेटा इंजीनियरिंग हार्नेस। 100+ टूल, 10 वेयरहाउस, AI-संचालित।
★ 805+3पिछले 7 दिनों में स्टार का बदलाव - #85
अपने डेटा को बेहतर तरीके से जानें! Datavines एक नेक्स्ट-जेन डेटा ऑब्जर्वेबिलिटी प्लेटफ़ॉर्म है, जो मेटाडेटा प्रबंधन और डेटा गुणवत्ता का समर्थन करता है।
★ 761+1पिछले 7 दिनों में स्टार का बदलाव - #86
BigFunctions के साथ BigQuery को सुपरचार्ज करें
★ 759+0पिछले 7 दिनों में स्टार का बदलाव - #87
असफल मशीन लर्निंग प्रोजेक्ट्स के वास्तविक दुनिया के प्रमुख उदाहरणों का संकलन
★ 751+0पिछले 7 दिनों में स्टार का बदलाव - #88
VectorFlow एक उच्च-वॉल्यूम वेक्टर एम्बेडिंग पाइपलाइन है जो कच्चे डेटा को इनजेस्ट करती है, उसे वेक्टर में बदलती है और आपकी पसंद के वेक्टर DB में लिखती है।
★ 703+0पिछले 7 दिनों में स्टार का बदलाव - #89
डेटा फ्लो इंजन डेटा एकीकरण, सिंक्रोनाइज़ेशन, एक्सचेंज, शेयरिंग, कॉन्फ़िगरेशन और शेड्यूलिंग के लिए एक अंतर्निहित डेटा-संचालित इंजन है। यह बड़े पैमाने पर डेटा कार्यों, उच्च-आवृत्ति रिपोर्टिंग, डेटा संग्रह और विषम डेटा संगतता को संभालने के लिए पाइपलाइन-निष्पादन पृथक्करण और प्लगइन लाइब्रेरी का उपयोग करता है।
★ 696+0पिछले 7 दिनों में स्टार का बदलाव - #90★ 626+2पिछले 7 दिनों में स्टार का बदलाव