spark
Repositori open source terpantau bertanda spark, diurutkan berdasarkan bintang.
- #31
LakeSoul adalah kerangka kerja Lakehouse cloud-native real-time end-to-end untuk penyerapan data cepat, pembaruan konkuren, analitik inkremental, pemrosesan data multimodal, dan pencarian vektor — mendukung beban kerja BI dan AI generasi berikutnya.
★ 3.249+2Perubahan bintang dalam 7 hari terakhir - #32
Pembelajaran Big Data dari nol, mencakup video pembelajaran dari berbagai tahap dan materi wawancara.
★ 3.224+10Perubahan bintang dalam 7 hari terakhir - #33
Operator Kubernetes untuk mengelola siklus hidup aplikasi Apache Spark di Kubernetes.
★ 3.150+1Perubahan bintang dalam 7 hari terakhir - #34
Server pekerjaan REST untuk Apache Spark.
★ 2.836+0Perubahan bintang dalam 7 hari terakhir - #35★ 2.829+38Perubahan bintang dalam 7 hari terakhir
- #36
:herb: Contoh pembelajaran cepat berbasis Spring Boot, mengintegrasikan kerangka kerja sumber terbuka yang ditemui sendiri, seperti: rabbitmq (antrean tertunda), Kafka, jpa, redis, oauth2, swagger, jsp, docker, k3s, k3d, k8s, plugin enkripsi/dekripsi mybatis, penanganan pengecualian, keluaran log, pengembangan multi-modul, pengemasan multi-lingkungan, cache, web crawler, jwt, GraphQL, dubbo, zookeeper, dan Async, dll. :pushpin:
★ 2.787-1Perubahan bintang dalam 7 hari terakhir - #37
Sistem analisis data besar arus penumpang kereta bawah tanah Shenzhen🚇🚄🌟
★ 2.475+1Perubahan bintang dalam 7 hari terakhir - #38
Spark adalah Remote Administration Tool (RAT) berbasis web, lintas platform, dan berfitur lengkap yang ditulis dalam Go untuk mengontrol perangkat Anda dari mana saja.
★ 2.386+5Perubahan bintang dalam 7 hari terakhir - #39
Penautan data probabilistik yang cepat, akurat, dan dapat diskalakan dengan dukungan untuk berbagai backend SQL.
★ 2.375+11Perubahan bintang dalam 7 hari terakhir - #40
Apache Kyuubi adalah gateway terdistribusi dan multi-tenant untuk menyediakan SQL nirserver pada data warehouse dan lakehouse.
★ 2.364+2Perubahan bintang dalam 7 hari terakhir - #41
TransmogrifAI adalah pustaka AutoML untuk membangun alur kerja pembelajaran mesin yang modular, dapat digunakan kembali, dan memiliki tipe data kuat di Apache Spark dengan penyesuaian manual minimal.
★ 2.277+0Perubahan bintang dalam 7 hari terakhir - #42
YTsaurus adalah platform big data sumber terbuka yang dapat diskalakan dan toleran terhadap kesalahan.
★ 2.203+3Perubahan bintang dalam 7 hari terakhir - #43
Alat untuk menangani firmware produk DJI, dengan fokus pada quadcopter.
★ 2.193+7Perubahan bintang dalam 7 hari terakhir - #44
Antarmuka terpadu untuk komputasi terdistribusi. Fugue menjalankan kode SQL, Python, Pandas, dan Polars di Spark, Dask, dan Ray tanpa perlu penulisan ulang.
★ 2.170+1Perubahan bintang dalam 7 hari terakhir - #45★ 2.166+0Perubahan bintang dalam 7 hari terakhir
- #46★ 2.096-2Perubahan bintang dalam 7 hari terakhir
- #47★ 1.994+2Perubahan bintang dalam 7 hari terakhir
- #48
Konektor Apache Spark ke Apache Cassandra
★ 1.955+1Perubahan bintang dalam 7 hari terakhir - #49
Repositori pengetahuan big data yang mencakup pemodelan data warehouse, komputasi real-time, big data, data middle office, desain sistem, Java, algoritma, dll.
★ 1.811+5Perubahan bintang dalam 7 hari terakhir - #50
Akselerator Auron untuk kerangka kerja komputasi terdistribusi (misalnya, Spark) memanfaatkan eksekusi tervektorisasi bawaan untuk mempercepat pemrosesan kueri
★ 1.798+3Perubahan bintang dalam 7 hari terakhir - #51★ 1.768+3Perubahan bintang dalam 7 hari terakhir
- #52
Organisasi open source ApacheCN: Pengumuman, perkenalan, anggota, aktivitas, dan saluran komunikasi
★ 1.754+0Perubahan bintang dalam 7 hari terakhir - #53
Lebih dari 2000+ pertanyaan wawancara Data Engineer.
★ 1.721+7Perubahan bintang dalam 7 hari terakhir - #54
Elassandra = Elasticsearch + Apache Cassandra
★ 1.714+0Perubahan bintang dalam 7 hari terakhir - #55
Tutorial Apache Spark & Python (pySpark) untuk Analisis Big Data dan Machine Learning sebagai notebook IPython / Jupyter
★ 1.660+1Perubahan bintang dalam 7 hari terakhir - #56★ 1.625+0Perubahan bintang dalam 7 hari terakhir
- #57
Jeroan Internal Apache Spark
★ 1.549+0Perubahan bintang dalam 7 hari terakhir - #58★ 1.544+1Perubahan bintang dalam 7 hari terakhir
- #59
:truck: Alur kerja Persiapan Data Agile menjadi lebih mudah dengan Pandas, Dask, cuDF, Dask-cuDF, Vaex, dan PySpark
★ 1.536+0Perubahan bintang dalam 7 hari terakhir - #60★ 1.498+1Perubahan bintang dalam 7 hari terakhir