Lompat ke konten utama
buildradar
Sign in
Topik · spark

spark

Repositori open source terpantau bertanda spark, diurutkan berdasarkan bintang.

115 repositori
  • carbondata@apache

    Solusi penyimpanan data performa tinggi

    1.452+0Perubahan bintang dalam 7 hari terakhir
  • LearningSparkV2@databricks

    Repositori GitHub untuk Learning Spark: Lightning-Fast Data Analytics [Edisi ke-2]

    1.402+2Perubahan bintang dalam 7 hari terakhir
  • Dockerfiles@HariSekhon

    50+ citra publik DockerHub untuk Docker & Kubernetes - DevOps, CI/CD, GitHub Actions, CircleCI, Jenkins, TeamCity, Alpine, CentOS, Debian, Fedora, Ubuntu, Hadoop, Kafka, ZooKeeper, HBase, Cassandra, Solr, SolrCloud, Presto, Apache Drill, Nifi, Spark, Consul, Riak

    1.379+0Perubahan bintang dalam 7 hari terakhir
  • sparkmagic@jupyter-incubator

    Jupyter magic dan kernel untuk bekerja dengan kluster Spark jarak jauh

    1.365-1Perubahan bintang dalam 7 hari terakhir
  • Taier@DTStack

    Taier adalah platform pengembangan big data untuk pengiriman, penjadwalan, operasional dan pemeliharaan, serta tampilan informasi indikator

    1.284+0Perubahan bintang dalam 7 hari terakhir
  • pyspark-tutorial@mahmoudparsian

    PySpark-Tutorial menyediakan algoritma dasar menggunakan PySpark

    1.280+0Perubahan bintang dalam 7 hari terakhir
  • Akselerator Apache DataFusion Comet Spark

    1.262+2Perubahan bintang dalam 7 hari terakhir
  • zingg@zinggAI

    Manajemen data master, resolusi identitas, resolusi entitas, dan deduplikasi yang dapat menskalakan menggunakan ML

    1.243+5Perubahan bintang dalam 7 hari terakhir
  • graphframes@graphframes

    GraphFrames adalah paket untuk Apache Spark yang menyediakan Graf berbasis DataFrame.

    1.202+0Perubahan bintang dalam 7 hari terakhir
  • amoro@apache

    Apache Amoro (incubating) adalah sistem manajemen Lakehouse yang dibangun di atas format open data lake.

    1.171+0Perubahan bintang dalam 7 hari terakhir
  • around-dataengineering@abhishek-ch

    Pusat Pengetahuan Data Engineering & Machine Learning

    1.146+0Perubahan bintang dalam 7 hari terakhir
  • celeborn@apache

    Apache Celeborn adalah layanan elastis dan berkinerja tinggi untuk data shuffle dan spilled.

    1.063+1Perubahan bintang dalam 7 hari terakhir
  • adam@bigdatagenomics

    ADAM adalah platform analisis genom dengan format file khusus yang dibangun menggunakan Apache Avro, Apache Spark, dan Apache Parquet. Berlisensi Apache 2.

    1.059+2Perubahan bintang dalam 7 hari terakhir
  • listenbrainz-server@metabrainz

    Server untuk proyek ListenBrainz, termasuk kode front-end (javascript/react) yang disajikannya dan semua komponen pemrosesan data yang digunakan oleh LB.

    1.006+4Perubahan bintang dalam 7 hari terakhir
  • cudf-spark@NVIDIA

    Plugin NVIDIA cuDF untuk Apache Spark - mempercepat Apache Spark dengan GPU.

    998+1Perubahan bintang dalam 7 hari terakhir
  • spark-scala-tutorial@deanwampler

    Tutorial gratis untuk Apache Spark.

    988+0Perubahan bintang dalam 7 hari terakhir
  • Sparkling Water menyediakan fungsionalitas H2O di dalam klaster Spark.

    980+1Perubahan bintang dalam 7 hari terakhir
  • sparklyr@sparklyr

    Antarmuka R untuk Apache Spark

    971+0Perubahan bintang dalam 7 hari terakhir
  • livy@apache

    Apache Livy adalah antarmuka REST sumber terbuka untuk berinteraksi dengan Apache Spark dari mana saja.

    962+1Perubahan bintang dalam 7 hari terakhir
  • data-prep-kit@data-prep-kit

    Proyek open source untuk penyiapan data aplikasi GenAI

    958+2Perubahan bintang dalam 7 hari terakhir
  • delta-sharing@delta-io

    Protokol terbuka untuk berbagi data yang aman

    957-1Perubahan bintang dalam 7 hari terakhir
  • Mobius@microsoft

    Pengikatan bahasa dan ekstensi C# serta F# untuk Apache Spark

    948+0Perubahan bintang dalam 7 hari terakhir
  • spark-redis@RedisLabs

    Konektor untuk Spark yang memungkinkan pembacaan dan penulisan dari/ke kluster Redis

    945+0Perubahan bintang dalam 7 hari terakhir
  • frameless@typelevel

    Tipe ekspresif untuk Spark.

    895-2Perubahan bintang dalam 7 hari terakhir
  • tispark@pingcap

    TiSpark dibuat untuk menjalankan Apache Spark di atas TiDB/TiKV

    889+0Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi sumber daya luar biasa terkait bahasa pemrograman Ada dan SPARK

    864+2Perubahan bintang dalam 7 hari terakhir
  • data-on-eks@awslabs

    DoEKS adalah alat untuk membangun, menyebarkan, dan menskalakan Platform Data di Amazon EKS

    856-1Perubahan bintang dalam 7 hari terakhir
  • sparkMeasure@LucaCanali

    Repositori ini berisi kode pengembangan untuk sparkMeasure, pustaka analisis dan pemecahan masalah kinerja Apache Spark. Pustaka ini menyederhanakan pengumpulan, agregasi, dan ekspor metrik tugas/tahap Spark, serta dirancang untuk penggunaan praktis oleh pengembang dan data engineer dalam alur kerja analisis interaktif, pengujian, dan pemantauan produksi.

    827+0Perubahan bintang dalam 7 hari terakhir
  • DevOps-Python-tools@HariSekhon

    80+ Alat CLI DevOps & Data - AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, Pengonversi & Validator Data Spark (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr, dll.

    824+0Perubahan bintang dalam 7 hari terakhir
  • Scriptis@WeBankFinTech

    Scriptis ditujukan untuk analisis data interaktif dengan pengembangan skrip (SQL, Pyspark, HiveQL), pengiriman tugas (Spark, Hive), UDF, fungsi, manajemen sumber daya, dan diagnosis cerdas.

    814+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik