Lompat ke konten utama
buildradar
Sign in
Topik · pyspark

pyspark

Repositori open source terpantau bertanda pyspark, diurutkan berdasarkan bintang.

Repositori
23
Total bintang
43.799
Rata-rata bintang
1.904
Porsi
0,00%

Topik yang sering muncul berdampingan dengan pyspark di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda pyspark.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • ibis@ibis-project

    Perpustakaan dataframe Python yang portabel

    6.650+1Perubahan bintang dalam 7 hari terakhir
  • SynapseML@microsoft

    Pustaka Python Machine Learning yang sederhana dan terdistribusi untuk memindahkan algoritma ML ke Spark.

    5.245+3Perubahan bintang dalam 7 hari terakhir
  • spark-nlp@JohnSnowLabs

    State of the Art Natural Language Processing.

    4.160+1Perubahan bintang dalam 7 hari terakhir
  • linkis@apache

    Apache Linkis membangun lapisan middleware komputasi untuk memfasilitasi koneksi, tata kelola, dan orkestrasi antara aplikasi tingkat atas dan mesin data dasar.

    3.409+2Perubahan bintang dalam 7 hari terakhir
  • sail@lakehq

    Pengganti Apache Spark drop-in yang ditulis dalam Rust, menyatukan pemrosesan batch, pemrosesan stream, dan beban kerja AI yang intensif komputasi.

    3.341+4Perubahan bintang dalam 7 hari terakhir
  • awesome-spark@awesome-spark

    Daftar kurasi paket dan sumber daya Apache Spark yang luar biasa.

    1.893+0Perubahan bintang dalam 7 hari terakhir
  • petastorm@uber

    Pustaka Petastorm memungkinkan pelatihan dan evaluasi model deep learning secara mandiri atau terdistribusi dari dataset berformat Apache Parquet. Mendukung framework ML seperti TensorFlow, PyTorch, dan PySpark, serta dapat digunakan dengan kode Python murni.

    1.892+0Perubahan bintang dalam 7 hari terakhir
  • narwhals@narwhals-dev

    Lapisan kompatibilitas yang ringan dan dapat diperluas antar pustaka dataframe!

    1.714+4Perubahan bintang dalam 7 hari terakhir
  • spark-py-notebooks@jadianes

    Tutorial Apache Spark & Python (pySpark) untuk Analisis Big Data dan Machine Learning sebagai notebook IPython / Jupyter

    1.660+0Perubahan bintang dalam 7 hari terakhir
  • optimus@hi-primus

    :truck: Alur kerja Persiapan Data Agile menjadi lebih mudah dengan Pandas, Dask, cuDF, Dask-cuDF, Vaex, dan PySpark

    1.536+0Perubahan bintang dalam 7 hari terakhir
  • sparkmagic@jupyter-incubator

    Jupyter magic dan kernel untuk bekerja dengan kluster Spark jarak jauh

    1.365-1Perubahan bintang dalam 7 hari terakhir
  • hopsworks@logicalclocks

    Hopsworks - Platform AI yang intensif data dengan Feature Store

    1.304+1Perubahan bintang dalam 7 hari terakhir
  • pyspark-tutorial@mahmoudparsian

    PySpark-Tutorial menyediakan algoritma dasar menggunakan PySpark

    1.280+0Perubahan bintang dalam 7 hari terakhir
  • graphframes@graphframes

    GraphFrames adalah paket untuk Apache Spark yang menyediakan Graf berbasis DataFrame.

    1.202+0Perubahan bintang dalam 7 hari terakhir
  • data-algorithms-book@mahmoudparsian

    MapReduce, Spark, Java, dan Scala untuk Buku Algoritma Data

    1.080-2Perubahan bintang dalam 7 hari terakhir
  • Sparkling Water menyediakan fungsionalitas H2O di dalam klaster Spark.

    980+1Perubahan bintang dalam 7 hari terakhir
  • DevOps-Python-tools@HariSekhon

    80+ Alat CLI DevOps & Data - AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, Pengonversi & Validator Data Spark (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr, dll.

    824+0Perubahan bintang dalam 7 hari terakhir
  • koheesio@Nike-Inc

    Framework Python untuk membangun pipeline data yang efisien. Mendukung modularitas dan kolaborasi, memungkinkan pembuatan pipeline kompleks dari komponen yang sederhana dan dapat digunakan kembali.

    818+0Perubahan bintang dalam 7 hari terakhir
  • Scriptis@WeBankFinTech

    Scriptis ditujukan untuk analisis data interaktif dengan pengembangan skrip (SQL, Pyspark, HiveQL), pengiriman tugas (Spark, Hive), UDF, fungsi, manajemen sumber daya, dan diagnosis cerdas.

    814+0Perubahan bintang dalam 7 hari terakhir
  • chispa@MrPowers

    Metode pembantu pengujian PySpark dengan pesan kesalahan yang bagus

    772-1Perubahan bintang dalam 7 hari terakhir
  • quinn@mrpowers-io

    Metode PySpark untuk meningkatkan produktivitas pengembang.

    689+0Perubahan bintang dalam 7 hari terakhir
  • datacompy@capitalone

    Perbandingan DataFrame Pandas, Polars, Spark, dan Snowpark yang ramah pengguna dan lainnya!

    658+0Perubahan bintang dalam 7 hari terakhir
  • spark-standalone-cluster-on-docker@cluster-apps-on-docker

    Pelajari Apache Spark dalam Scala, Python (PySpark), dan R (SparkR) dengan membangun cluster Anda sendiri dengan antarmuka JupyterLab di Docker. :zap:

    512+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik