Lompat ke konten utama
buildradar
Sign in
Topik · spark

spark

Repositori open source terpantau bertanda spark, diurutkan berdasarkan bintang.

115 repositori
  • LakeSoul@lakesoul-io

    LakeSoul adalah kerangka kerja Lakehouse cloud-native real-time end-to-end untuk penyerapan data cepat, pembaruan konkuren, analitik inkremental, pemrosesan data multimodal, dan pencarian vektor — mendukung beban kerja BI dan AI generasi berikutnya.

    3.249+2Perubahan bintang dalam 7 hari terakhir
  • BigDataGuide@MoRan1607

    Pembelajaran Big Data dari nol, mencakup video pembelajaran dari berbagai tahap dan materi wawancara.

    3.224+10Perubahan bintang dalam 7 hari terakhir
  • spark-operator@kubeflow

    Operator Kubernetes untuk mengelola siklus hidup aplikasi Apache Spark di Kubernetes.

    3.150+1Perubahan bintang dalam 7 hari terakhir
  • spark-jobserver@spark-jobserver

    Server pekerjaan REST untuk Apache Spark.

    2.836+0Perubahan bintang dalam 7 hari terakhir
  • lucebox@Luce-Org

    Server inferensi spekulatif LLM untuk perangkat konsumen dan heterogen

    2.829+38Perubahan bintang dalam 7 hari terakhir
  • spring-boot-quick@vector4wang

    :herb: Contoh pembelajaran cepat berbasis Spring Boot, mengintegrasikan kerangka kerja sumber terbuka yang ditemui sendiri, seperti: rabbitmq (antrean tertunda), Kafka, jpa, redis, oauth2, swagger, jsp, docker, k3s, k3d, k8s, plugin enkripsi/dekripsi mybatis, penanganan pengecualian, keluaran log, pengembangan multi-modul, pengemasan multi-lingkungan, cache, web crawler, jwt, GraphQL, dubbo, zookeeper, dan Async, dll. :pushpin:

    2.787-1Perubahan bintang dalam 7 hari terakhir
  • SZT-bigdata@geekyouth

    Sistem analisis data besar arus penumpang kereta bawah tanah Shenzhen🚇🚄🌟

    2.475+1Perubahan bintang dalam 7 hari terakhir
  • Spark@XZB-1248

    Spark adalah Remote Administration Tool (RAT) berbasis web, lintas platform, dan berfitur lengkap yang ditulis dalam Go untuk mengontrol perangkat Anda dari mana saja.

    2.386+5Perubahan bintang dalam 7 hari terakhir
  • splink@moj-analytical-services

    Penautan data probabilistik yang cepat, akurat, dan dapat diskalakan dengan dukungan untuk berbagai backend SQL.

    2.375+11Perubahan bintang dalam 7 hari terakhir
  • kyuubi@apache

    Apache Kyuubi adalah gateway terdistribusi dan multi-tenant untuk menyediakan SQL nirserver pada data warehouse dan lakehouse.

    2.364+2Perubahan bintang dalam 7 hari terakhir
  • TransmogrifAI@salesforce

    TransmogrifAI adalah pustaka AutoML untuk membangun alur kerja pembelajaran mesin yang modular, dapat digunakan kembali, dan memiliki tipe data kuat di Apache Spark dengan penyesuaian manual minimal.

    2.277+0Perubahan bintang dalam 7 hari terakhir
  • ytsaurus@ytsaurus

    YTsaurus adalah platform big data sumber terbuka yang dapat diskalakan dan toleran terhadap kesalahan.

    2.203+3Perubahan bintang dalam 7 hari terakhir
  • Alat untuk menangani firmware produk DJI, dengan fokus pada quadcopter.

    2.193+7Perubahan bintang dalam 7 hari terakhir
  • fugue@fugue-project

    Antarmuka terpadu untuk komputasi terdistribusi. Fugue menjalankan kode SQL, Python, Pandas, dan Polars di Spark, Dask, dan Ray tanpa perlu penulisan ulang.

    2.170+1Perubahan bintang dalam 7 hari terakhir
  • zio-quill@zio

    Language Integrated Queries waktu kompilasi untuk Scala

    2.166+0Perubahan bintang dalam 7 hari terakhir
  • spark@dotnet

    .NET for Apache® Spark™ membuat Apache Spark™ mudah diakses oleh pengembang .NET.

    2.096-2Perubahan bintang dalam 7 hari terakhir
  • gatk@broadinstitute

    Repositori kode resmi untuk GATK versi 4 ke atas

    1.994+2Perubahan bintang dalam 7 hari terakhir
  • Konektor Apache Spark ke Apache Cassandra

    1.955+1Perubahan bintang dalam 7 hari terakhir
  • bigdata-growth@collabH

    Repositori pengetahuan big data yang mencakup pemodelan data warehouse, komputasi real-time, big data, data middle office, desain sistem, Java, algoritma, dll.

    1.811+5Perubahan bintang dalam 7 hari terakhir
  • auron@apache

    Akselerator Auron untuk kerangka kerja komputasi terdistribusi (misalnya, Spark) memanfaatkan eksekusi tervektorisasi bawaan untuk mempercepat pemrosesan kueri

    1.798+3Perubahan bintang dalam 7 hari terakhir
  • Tutorial@zhonghuasheng

    Ringkasan arsitektur pengetahuan full-stack backend (Java Golang)

    1.768+3Perubahan bintang dalam 7 hari terakhir
  • .github@apachecn

    Organisasi open source ApacheCN: Pengumuman, perkenalan, anggota, aktivitas, dan saluran komunikasi

    1.754+0Perubahan bintang dalam 7 hari terakhir
  • Lebih dari 2000+ pertanyaan wawancara Data Engineer.

    1.721+7Perubahan bintang dalam 7 hari terakhir
  • elassandra@strapdata

    Elassandra = Elasticsearch + Apache Cassandra

    1.714+0Perubahan bintang dalam 7 hari terakhir
  • spark-py-notebooks@jadianes

    Tutorial Apache Spark & Python (pySpark) untuk Analisis Big Data dan Machine Learning sebagai notebook IPython / Jupyter

    1.660+1Perubahan bintang dalam 7 hari terakhir
  • almond@almond-sh

    Kernel Scala untuk Jupyter

    1.625+0Perubahan bintang dalam 7 hari terakhir
  • apache-spark-internals@japila-books

    Jeroan Internal Apache Spark

    1.549+0Perubahan bintang dalam 7 hari terakhir
  • mleap@combust

    MLeap: Terapkan Pipeline ML ke Produksi

    1.544+1Perubahan bintang dalam 7 hari terakhir
  • optimus@hi-primus

    :truck: Alur kerja Persiapan Data Agile menjadi lebih mudah dengan Pandas, Dask, cuDF, Dask-cuDF, Vaex, dan PySpark

    1.536+0Perubahan bintang dalam 7 hari terakhir
  • nessie@projectnessie

    Nessie: Katalog Transaksional untuk Data Lake dengan semantik seperti Git

    1.498+1Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik