pyspark
Các kho mã nguồn mở đang theo dõi được gắn thẻ pyspark, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng pyspark trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ pyspark.
Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.
- #1★ 6.650+1Thay đổi số sao trong 7 ngày qua
- #2
Thư viện Python Machine Learning đơn giản và phân tán, chuyển đổi các thuật toán ML cho Spark
★ 5.245+3Thay đổi số sao trong 7 ngày qua - #3★ 4.160+1Thay đổi số sao trong 7 ngày qua
- #4
Apache Linkis xây dựng một lớp trung gian tính toán để hỗ trợ kết nối, quản trị và điều phối giữa các ứng dụng cấp cao và các công cụ dữ liệu bên dưới.
★ 3.409+2Thay đổi số sao trong 7 ngày qua - #5
Giải pháp thay thế Apache Spark thả nổi được viết bằng Rust, hợp nhất xử lý hàng loạt, xử lý luồng và khối lượng công việc AI đòi hỏi tính toán cao.
★ 3.341+4Thay đổi số sao trong 7 ngày qua - #6
Danh sách tổng hợp các gói và tài nguyên tuyệt vời cho Apache Spark.
★ 1.893+0Thay đổi số sao trong 7 ngày qua - #7
Thư viện Petastorm hỗ trợ huấn luyện và đánh giá trên một máy đơn hoặc phân tán các mô hình học sâu từ tập dữ liệu định dạng Apache Parquet. Thư viện hỗ trợ các framework ML như Tensorflow, Pytorch và PySpark, có thể sử dụng từ mã nguồn Python thuần túy.
★ 1.892+0Thay đổi số sao trong 7 ngày qua - #8★ 1.714+4Thay đổi số sao trong 7 ngày qua
- #9
Hướng dẫn Apache Spark & Python (pySpark) cho Phân tích Dữ liệu lớn và Máy học dưới dạng Jupyter / IPython notebook
★ 1.660+0Thay đổi số sao trong 7 ngày qua - #10
:truck: Quy trình chuẩn bị dữ liệu linh hoạt được thực hiện dễ dàng với Pandas, Dask, cuDF, Dask-cuDF, Vaex và PySpark
★ 1.536+0Thay đổi số sao trong 7 ngày qua - #11
Jupyter magics và kernels để làm việc với các cụm Spark từ xa
★ 1.365-1Thay đổi số sao trong 7 ngày qua - #12★ 1.304+1Thay đổi số sao trong 7 ngày qua
- #13
PySpark-Tutorial cung cấp các thuật toán cơ bản sử dụng PySpark
★ 1.280+0Thay đổi số sao trong 7 ngày qua - #14
GraphFrames là một gói dành cho Apache Spark cung cấp các đồ thị dựa trên DataFrame
★ 1.202+0Thay đổi số sao trong 7 ngày qua - #15
Sách MapReduce, Spark, Java và Scala cho Thuật toán dữ liệu
★ 1.080-2Thay đổi số sao trong 7 ngày qua - #16
Sparkling Water cung cấp tính năng của H2O bên trong cụm Spark
★ 980+1Thay đổi số sao trong 7 ngày qua - #17
Hơn 80 công cụ CLI cho DevOps & Dữ liệu - AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, các bộ chuyển đổi & kiểm định dữ liệu Spark (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr, v.v.
★ 824+0Thay đổi số sao trong 7 ngày qua - #18
Framework Python để xây dựng các đường ống dữ liệu hiệu quả. Nó thúc đẩy tính mô-đun và cộng tác, cho phép tạo ra các đường ống phức tạp từ các thành phần đơn giản, có thể tái sử dụng.
★ 818+0Thay đổi số sao trong 7 ngày qua - #19
Scriptis là công cụ phân tích dữ liệu tương tác hỗ trợ phát triển script (SQL, Pyspark, HiveQL), gửi tác vụ (Spark, Hive), UDF, hàm, quản lý tài nguyên và chẩn đoán thông minh.
★ 814+0Thay đổi số sao trong 7 ngày qua - #20★ 772-1Thay đổi số sao trong 7 ngày qua
- #21★ 689+0Thay đổi số sao trong 7 ngày qua
- #22
So sánh DataFrame giữa Pandas, Polars, Spark và Snowpark cho con người và hơn thế nữa!
★ 658+0Thay đổi số sao trong 7 ngày qua - #23
Học Apache Spark bằng Scala, Python (PySpark) và R (SparkR) bằng cách xây dựng cụm của riêng bạn với giao diện JupyterLab trên Docker. :zap:
★ 512+0Thay đổi số sao trong 7 ngày qua