spark
Repositori open source terpantau bertanda spark, diurutkan berdasarkan bintang.
- #61
Solusi penyimpanan data performa tinggi
★ 1.452+0Perubahan bintang dalam 7 hari terakhir - #62
Repositori GitHub untuk Learning Spark: Lightning-Fast Data Analytics [Edisi ke-2]
★ 1.402+2Perubahan bintang dalam 7 hari terakhir - #63
50+ citra publik DockerHub untuk Docker & Kubernetes - DevOps, CI/CD, GitHub Actions, CircleCI, Jenkins, TeamCity, Alpine, CentOS, Debian, Fedora, Ubuntu, Hadoop, Kafka, ZooKeeper, HBase, Cassandra, Solr, SolrCloud, Presto, Apache Drill, Nifi, Spark, Consul, Riak
★ 1.379+0Perubahan bintang dalam 7 hari terakhir - #64
Jupyter magic dan kernel untuk bekerja dengan kluster Spark jarak jauh
★ 1.365-1Perubahan bintang dalam 7 hari terakhir - #65
Taier adalah platform pengembangan big data untuk pengiriman, penjadwalan, operasional dan pemeliharaan, serta tampilan informasi indikator
★ 1.284+0Perubahan bintang dalam 7 hari terakhir - #66
PySpark-Tutorial menyediakan algoritma dasar menggunakan PySpark
★ 1.280+0Perubahan bintang dalam 7 hari terakhir - #67
Akselerator Apache DataFusion Comet Spark
★ 1.262+2Perubahan bintang dalam 7 hari terakhir - #68
Manajemen data master, resolusi identitas, resolusi entitas, dan deduplikasi yang dapat menskalakan menggunakan ML
★ 1.243+5Perubahan bintang dalam 7 hari terakhir - #69
GraphFrames adalah paket untuk Apache Spark yang menyediakan Graf berbasis DataFrame.
★ 1.202+0Perubahan bintang dalam 7 hari terakhir - #70
Apache Amoro (incubating) adalah sistem manajemen Lakehouse yang dibangun di atas format open data lake.
★ 1.171+0Perubahan bintang dalam 7 hari terakhir - #71
Pusat Pengetahuan Data Engineering & Machine Learning
★ 1.146+0Perubahan bintang dalam 7 hari terakhir - #72
Apache Celeborn adalah layanan elastis dan berkinerja tinggi untuk data shuffle dan spilled.
★ 1.063+1Perubahan bintang dalam 7 hari terakhir - #73
ADAM adalah platform analisis genom dengan format file khusus yang dibangun menggunakan Apache Avro, Apache Spark, dan Apache Parquet. Berlisensi Apache 2.
★ 1.059+2Perubahan bintang dalam 7 hari terakhir - #74
Server untuk proyek ListenBrainz, termasuk kode front-end (javascript/react) yang disajikannya dan semua komponen pemrosesan data yang digunakan oleh LB.
★ 1.006+4Perubahan bintang dalam 7 hari terakhir - #75
Plugin NVIDIA cuDF untuk Apache Spark - mempercepat Apache Spark dengan GPU.
★ 998+1Perubahan bintang dalam 7 hari terakhir - #76
Tutorial gratis untuk Apache Spark.
★ 988+0Perubahan bintang dalam 7 hari terakhir - #77
Sparkling Water menyediakan fungsionalitas H2O di dalam klaster Spark.
★ 980+1Perubahan bintang dalam 7 hari terakhir - #78★ 971+0Perubahan bintang dalam 7 hari terakhir
- #79
Apache Livy adalah antarmuka REST sumber terbuka untuk berinteraksi dengan Apache Spark dari mana saja.
★ 962+1Perubahan bintang dalam 7 hari terakhir - #80
Proyek open source untuk penyiapan data aplikasi GenAI
★ 958+2Perubahan bintang dalam 7 hari terakhir - #81
Protokol terbuka untuk berbagi data yang aman
★ 957-1Perubahan bintang dalam 7 hari terakhir - #82★ 948+0Perubahan bintang dalam 7 hari terakhir
- #83
Konektor untuk Spark yang memungkinkan pembacaan dan penulisan dari/ke kluster Redis
★ 945+0Perubahan bintang dalam 7 hari terakhir - #84★ 895-2Perubahan bintang dalam 7 hari terakhir
- #85★ 889+0Perubahan bintang dalam 7 hari terakhir
- #86
Daftar kurasi sumber daya luar biasa terkait bahasa pemrograman Ada dan SPARK
★ 864+2Perubahan bintang dalam 7 hari terakhir - #87
DoEKS adalah alat untuk membangun, menyebarkan, dan menskalakan Platform Data di Amazon EKS
★ 856-1Perubahan bintang dalam 7 hari terakhir - #88
Repositori ini berisi kode pengembangan untuk sparkMeasure, pustaka analisis dan pemecahan masalah kinerja Apache Spark. Pustaka ini menyederhanakan pengumpulan, agregasi, dan ekspor metrik tugas/tahap Spark, serta dirancang untuk penggunaan praktis oleh pengembang dan data engineer dalam alur kerja analisis interaktif, pengujian, dan pemantauan produksi.
★ 827+0Perubahan bintang dalam 7 hari terakhir - #89
80+ Alat CLI DevOps & Data - AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, Pengonversi & Validator Data Spark (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr, dll.
★ 824+0Perubahan bintang dalam 7 hari terakhir - #90
Scriptis ditujukan untuk analisis data interaktif dengan pengembangan skrip (SQL, Pyspark, HiveQL), pengiriman tugas (Spark, Hive), UDF, fungsi, manajemen sumber daya, dan diagnosis cerdas.
★ 814+0Perubahan bintang dalam 7 hari terakhir