मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · spark

spark

spark टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

115 रिपॉजिटरी
  • carbondata@apache

    उच्च प्रदर्शन डेटा स्टोर समाधान

    1,452+0पिछले 7 दिनों में स्टार का बदलाव
  • LearningSparkV2@databricks

    यह Learning Spark: Lightning-Fast Data Analytics [2nd Edition] के लिए गिटहब रेपो है

    1,402+2पिछले 7 दिनों में स्टार का बदलाव
  • Dockerfiles@HariSekhon

    Docker और Kubernetes के लिए 50+ DockerHub पब्लिक इमेज - DevOps, CI/CD, GitHub Actions, CircleCI, Jenkins, TeamCity, Alpine, CentOS, Debian, Fedora, Ubuntu, Hadoop, Kafka, ZooKeeper, HBase, Cassandra, Solr, SolrCloud, Presto, Apache Drill, Nifi, Spark, Consul, Riak

    1,379+0पिछले 7 दिनों में स्टार का बदलाव
  • sparkmagic@jupyter-incubator

    रिमोट Spark क्लस्टर के साथ काम करने के लिए Jupyter मैजिक और कर्नेल

    1,365-1पिछले 7 दिनों में स्टार का बदलाव
  • Taier@DTStack

    Taier सबमिशन, शेड्यूलिंग, ऑपरेशन और मेंटेनेंस, और इंडिकेटर जानकारी डिस्प्ले के लिए एक बिग डेटा डेवलपमेंट प्लेटफॉर्म है

    1,284+0पिछले 7 दिनों में स्टार का बदलाव
  • pyspark-tutorial@mahmoudparsian

    PySpark-Tutorial PySpark का उपयोग करके बुनियादी एल्गोरिदम प्रदान करता है

    1,280+0पिछले 7 दिनों में स्टार का बदलाव
  • Apache DataFusion Comet Spark Accelerator

    1,262+2पिछले 7 दिनों में स्टार का बदलाव
  • zingg@zinggAI

    ML का उपयोग करके स्केलेबल मास्टर डेटा प्रबंधन, पहचान समाधान, एंटिटी समाधान और डुप्लीकेट हटाना।

    1,243+5पिछले 7 दिनों में स्टार का बदलाव
  • graphframes@graphframes

    GraphFrames, Apache Spark के लिए एक पैकेज है जो DataFrame-आधारित Graphs प्रदान करता है

    1,202+0पिछले 7 दिनों में स्टार का बदलाव
  • amoro@apache

    Apache Amoro (इन्क्यूबेटिंग) ओपन डेटा लेक फॉर्मेट पर निर्मित एक Lakehouse प्रबंधन प्रणाली है।

    1,171+0पिछले 7 दिनों में स्टार का बदलाव
  • around-dataengineering@abhishek-ch

    एक डेटा इंजीनियरिंग और मशीन लर्निंग नॉलेज हब

    1,146+0पिछले 7 दिनों में स्टार का बदलाव
  • celeborn@apache

    Apache Celeborn शफल और स्पिल्ड डेटा के लिए एक इलास्टिक और उच्च-प्रदर्शन वाली सेवा है

    1,062+2पिछले 7 दिनों में स्टार का बदलाव
  • adam@bigdatagenomics

    ADAM एक जीनोमिक्स विश्लेषण प्लेटफ़ॉर्म है जिसमें Apache Avro, Apache Spark और Apache Parquet का उपयोग करके बनाए गए विशेष फ़ाइल फॉर्मेट शामिल हैं। Apache 2 लाइसेंस प्राप्त।

    1,059+2पिछले 7 दिनों में स्टार का बदलाव
  • listenbrainz-server@metabrainz

    ListenBrainz प्रोजेक्ट के लिए सर्वर, जिसमें फ्रंट-एंड (javascript/react) कोड और LB द्वारा उपयोग किए जाने वाले सभी डेटा प्रोसेसिंग घटक शामिल हैं।

    1,007+4पिछले 7 दिनों में स्टार का बदलाव
  • cudf-spark@NVIDIA

    Apache Spark के लिए NVIDIA cuDF प्लगइन - GPU के साथ Apache Spark को गति दें

    999+1पिछले 7 दिनों में स्टार का बदलाव
  • spark-scala-tutorial@deanwampler

    Apache Spark के लिए एक मुफ्त ट्यूटोरियल

    988+0पिछले 7 दिनों में स्टार का बदलाव
  • Sparkling Water Spark क्लस्टर के भीतर H2O कार्यक्षमता प्रदान करता है

    980+1पिछले 7 दिनों में स्टार का बदलाव
  • sparklyr@sparklyr

    Apache Spark के लिए R इंटरफ़ेस

    971-1पिछले 7 दिनों में स्टार का बदलाव
  • livy@apache

    Apache Livy कहीं से भी Apache Spark के साथ इंटरैक्ट करने के लिए एक ओपन सोर्स REST इंटरफ़ेस है।

    962+2पिछले 7 दिनों में स्टार का बदलाव
  • delta-sharing@delta-io

    सुरक्षित डेटा शेयरिंग के लिए एक ओपन प्रोटोकॉल।

    958-1पिछले 7 दिनों में स्टार का बदलाव
  • data-prep-kit@data-prep-kit

    GenAI एप्लिकेशन के लिए डेटा तैयार करने हेतु ओपन सोर्स प्रोजेक्ट।

    958+2पिछले 7 दिनों में स्टार का बदलाव
  • Mobius@microsoft

    Apache Spark के लिए C# और F# भाषा बाइंडिंग और एक्सटेंशन।

    948+0पिछले 7 दिनों में स्टार का बदलाव
  • spark-redis@RedisLabs

    Spark के लिए एक कनेक्टर जो Redis क्लस्टर से डेटा पढ़ने और लिखने की अनुमति देता है

    945+0पिछले 7 दिनों में स्टार का बदलाव
  • frameless@typelevel

    Spark के लिए एक्सप्रेसिव टाइप्स।

    895-2पिछले 7 दिनों में स्टार का बदलाव
  • tispark@pingcap

    TiSpark को TiDB/TiKV के ऊपर Apache Spark चलाने के लिए बनाया गया है

    889+0पिछले 7 दिनों में स्टार का बदलाव
  • Ada और SPARK प्रोग्रामिंग भाषा से संबंधित बेहतरीन संसाधनों की एक क्यूरेटेड सूची

    865+2पिछले 7 दिनों में स्टार का बदलाव
  • data-on-eks@awslabs

    DoEKS Amazon EKS पर डेटा प्लेटफॉर्म बनाने, डिप्लॉय करने और स्केल करने के लिए एक टूल है

    856-1पिछले 7 दिनों में स्टार का बदलाव
  • sparkMeasure@LucaCanali

    इस रिपॉजिटरी में sparkMeasure के लिए विकास कोड है, जो एक Apache Spark प्रदर्शन विश्लेषण और समस्या निवारण लाइब्रेरी है। यह स्पार्क टास्क/स्टेज मेट्रिक्स को एकत्र करने, समेकित करने और निर्यात करने को सरल बनाता है, और इंटरैक्टिव विश्लेषण, परीक्षण और उत्पादन निगरानी वर्कफ़्लो में डेवलपर्स और डेटा इंजीनियरों द्वारा व्यावहारिक उपयोग के लिए डिज़ाइन किया गया है।

    827-2पिछले 7 दिनों में स्टार का बदलाव
  • DevOps-Python-tools@HariSekhon

    80+ DevOps और Data CLI टूल्स - AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, Spark Data Converters & Validators (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr आदि

    824+0पिछले 7 दिनों में स्टार का बदलाव
  • Scriptis@WeBankFinTech

    Scriptis स्क्रिप्ट डेवलपमेंट (SQL, Pyspark, HiveQL), टास्क सबमिशन (Spark, Hive), UDF, फंक्शन, रिसोर्स मैनेजमेंट और इंटेलिजेंट डायग्नोसिस के साथ इंटरैक्टिव डेटा एनालिसिस के लिए है।

    814+0पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस