मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · data-engineering

data-engineering

data-engineering टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

97 रिपॉजिटरी
  • pyjanitor@pyjanitor-devs

    डेटा क्लीनिंग के लिए स्वच्छ API। R पैकेज Janitor का Python कार्यान्वयन

    1,498+0पिछले 7 दिनों में स्टार का बदलाव
  • data-science-on-gcp@GoogleCloudPlatform

    पुस्तक के साथ आने वाला स्रोत कोड: Data Science on the Google Cloud Platform, Valliappa Lakshmanan, O'Reilly 2017

    1,429+1पिछले 7 दिनों में स्टार का बदलाव
  • odd-platform@opendatadiscovery

    पहला ओपन-सोर्स डेटा डिस्कवरी और ऑब्ज़र्वेबिलिटी प्लेटफ़ॉर्म। हम डेटा प्रैक्टिशनर्स के जीवन को आसान बनाते हैं ताकि आप अपने व्यवसाय पर ध्यान केंद्रित कर सकें।

    1,427+1पिछले 7 दिनों में स्टार का बदलाव
  • mlops-python-package@fmind

    आपकी MLOps पहलों और डेटा पाइपलाइनों को किकस्टार्ट और मानकीकृत करने के लिए एक व्यापक Python पैकेज टेम्पलेट।

    1,416+0पिछले 7 दिनों में स्टार का बदलाव
  • शीर्ष तकनीकी कंपनियों के 300+ इंजीनियरिंग ब्लॉग लेखों का एक क्यूरेटेड संग्रह। जानें कि सर्वश्रेष्ठ इंजीनियरिंग टीमें बड़े पैमाने पर वास्तविक दुनिया की समस्याओं को कैसे हल करती हैं।

    1,388+8पिछले 7 दिनों में स्टार का बदलाव
  • sql-ultimate-course@DataWithBaraa

    वास्तविक दुनिया کے ایک ماہر کی طرف سے سب سے زیادہ جامع SQL گাইড! بنیادی باتوں سے لے کر جدید کوئریز، آپ্টিমাইজیشن اور حقیقی دنیا کے SQL تک سب کچھ سیکھیں۔

    1,384+7पिछले 7 दिनों में स्टार का बदलाव
  • quilt@quiltdata

    Quilt AWS पर एक वैज्ञानिक डेटा प्रबंधन प्लेटफ़ॉर्म है जो टीमों और AI को गहराई से वर्शन किए गए, संदर्भ-समृद्ध डेटा पैकेजों के माध्यम से डेटा खोजने, उस पर भरोसा करने और उसका पुन: उपयोग करने में मदद करता है।

    1,370+0पिछले 7 दिनों में स्टार का बदलाव
  • duckle@slothflowlabs

    ओपन-सोर्स ETL/ELT जिसे आप अपने सर्वर या क्लाउड पर तैनात कर सकते हैं। DuckDB पर निर्मित: नो-कोड/लो-कोड विजुअल पाइपलाइन या SQL, 385 घटक, dbt, CDC, डेटा गुणवत्ता, रिवर्स ETL, लाइनage, AI एजेंटों के लिए MCP। कोई वेंडर क्लाउड नहीं, प्रति-पंक्ति बिलिंग नहीं।

    1,262+15पिछले 7 दिनों में स्टार का बदलाव
  • डेटा-केंद्रित AI संसाधनों की एक क्यूरेटेड, लेकिन अधूरी सूची।

    1,159+1पिछले 7 दिनों में स्टार का बदलाव
  • around-dataengineering@abhishek-ch

    एक डेटा इंजीनियरिंग और मशीन लर्निंग नॉलेज हब

    1,146+0पिछले 7 दिनों में स्टार का बदलाव
  • Open Data Contract Standard (ODCS) का होम।

    1,118+18पिछले 7 दिनों में स्टार का बदलाव
  • awesome-data-catalogs@opendatadiscovery

    बेहतरीन डेटा कैटलॉग और ऑब्जर्वेबिलिटी प्लेटफॉर्म।

    1,068+5पिछले 7 दिनों में स्टार का बदलाव
  • datacontract-cli@datacontract

    डेटा कॉन्ट्रैक्ट्स को लागू करें

    1,058+8पिछले 7 दिनों में स्टार का बदलाव
  • flow@estuary

    Estuary के साथ डेटा प्रवाह को प्रबंधित करके, उन सिस्टम्स को लगातार सिंक्रोनाइज़ करें जहाँ आपका डेटा रहता है, उन सिस्टम्स के साथ जहाँ आप इसे रखना चाहते हैं।

    972+7पिछले 7 दिनों में स्टार का बदलाव
  • FlyFish@CloudWise-OpenSource

    FlyFish एक डेटा विज़ुअलाइज़ेशन कोडिंग प्लेटफ़ॉर्म है। हम सरल तरीके से डेटा मॉडल बना सकते हैं और ड्रैग-एंड-ड्रॉप के माध्यम से डेटा विज़ुअलाइज़ेशन समाधान तैयार कर सकते हैं।

    961+0पिछले 7 दिनों में स्टार का बदलाव
  • SQL Server के साथ आधुनिक डेटा वेयरहाउस बनाने के लिए एक व्यापक गाइड, जिसमें ETL प्रक्रियाएं, डेटा मॉडलिंग और एनालिटिक्स शामिल हैं।

    932+14पिछले 7 दिनों में स्टार का बदलाव
  • egeria@odpi

    Egeria कोर।

    921+0पिछले 7 दिनों में स्टार का बदलाव
  • स्पेनिश में डेटा इंजीनियरिंग के बुनियादी सिद्धांतों, तकनीकी चुनौतियों और संसाधनों का एक संग्रह

    896+1पिछले 7 दिनों में स्टार का बदलाव
  • bacalhau@bacalhau-project

    डेटा पर तेज़, लागत प्रभावी वितरित कंप्यूट के लिए समुदाय-संचालित, सरल, फिर भी शक्तिशाली फ्रेमवर्क।

    871+1पिछले 7 दिनों में स्टार का बदलाव
  • NeumAI@NeumTry

    Neum AI बड़े पैमाने पर वेक्टर एम्बेडिंग के निर्माण और सिंक्रनाइज़ेशन को प्रबंधित करने के लिए एक बेहतरीन फ्रेमवर्क है।

    867+0पिछले 7 दिनों में स्टार का बदलाव
  • The Complete dbt (Data Build Tool) Bootcamp Udemy कोर्स के लिए पूरक सामग्री

    827+0पिछले 7 दिनों में स्टार का बदलाव
  • practical-data-engineering@ssp-data

    प्रैक्टिकल डेटा इंजीनियरिंग: एक हैंड्स-ऑन रियल-एस्टेट प्रोजेक्ट गाइड

    823+2पिछले 7 दिनों में स्टार का बदलाव
  • koheesio@Nike-Inc

    कुशल डेटा पाइपलाइन बनाने के लिए Python फ्रेमवर्क। यह मॉड्यूलरिटी और सहयोग को बढ़ावा देता है, जिससे सरल, पुन: प्रयोज्य घटकों से जटिल पाइपलाइन बनाना संभव होता है।

    818+0पिछले 7 दिनों में स्टार का बदलाव
  • altimate-code@AltimateAI

    dbt, SQL और क्लाउड वेयरहाउस के लिए ओपन-सोर्स एजेंटिक डेटा इंजीनियरिंग हार्नेस। 100+ टूल, 10 वेयरहाउस, AI-संचालित।

    805+3पिछले 7 दिनों में स्टार का बदलाव
  • datavines@datavane

    अपने डेटा को बेहतर तरीके से जानें! Datavines एक नेक्स्ट-जेन डेटा ऑब्जर्वेबिलिटी प्लेटफ़ॉर्म है, जो मेटाडेटा प्रबंधन और डेटा गुणवत्ता का समर्थन करता है।

    761+1पिछले 7 दिनों में स्टार का बदलाव
  • bigfunctions@unytics

    BigFunctions के साथ BigQuery को सुपरचार्ज करें

    759+0पिछले 7 दिनों में स्टार का बदलाव
  • Failed-ML@kennethleungty

    असफल मशीन लर्निंग प्रोजेक्ट्स के वास्तविक दुनिया के प्रमुख उदाहरणों का संकलन

    751+0पिछले 7 दिनों में स्टार का बदलाव
  • vectorflow@dgarnitz

    VectorFlow एक उच्च-वॉल्यूम वेक्टर एम्बेडिंग पाइपलाइन है जो कच्चे डेटा को इनजेस्ट करती है, उसे वेक्टर में बदलती है और आपकी पसंद के वेक्टर DB में लिखती है।

    703+0पिछले 7 दिनों में स्टार का बदलाव
  • DataFlow-Engine@risesoft-y9

    डेटा फ्लो इंजन डेटा एकीकरण, सिंक्रोनाइज़ेशन, एक्सचेंज, शेयरिंग, कॉन्फ़िगरेशन और शेड्यूलिंग के लिए एक अंतर्निहित डेटा-संचालित इंजन है। यह बड़े पैमाने पर डेटा कार्यों, उच्च-आवृत्ति रिपोर्टिंग, डेटा संग्रह और विषम डेटा संगतता को संभालने के लिए पाइपलाइन-निष्पादन पृथक्करण और प्लगइन लाइब्रेरी का उपयोग करता है।

    696+0पिछले 7 दिनों में स्टार का बदलाव
  • synmetrix@synmetrix

    Synmetrix – Cube पर प्रोडक्शन-रेडी ओपन सोर्स सिमेंटिक लेयर।

    626+2पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस