Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · spark

spark

Các kho mã nguồn mở đang theo dõi được gắn thẻ spark, sắp xếp theo số sao.

115 kho mã
  • carbondata@apache

    Giải pháp lưu trữ dữ liệu hiệu năng cao

    1.452+0Thay đổi số sao trong 7 ngày qua
  • LearningSparkV2@databricks

    Đây là kho lưu trữ GitHub cho sách Learning Spark: Phân tích dữ liệu tốc độ cao [Phiên bản thứ 2]

    1.402+3Thay đổi số sao trong 7 ngày qua
  • Dockerfiles@HariSekhon

    Hơn 50 DockerHub image công khai cho Docker & Kubernetes - DevOps, CI/CD, GitHub Actions, CircleCI, Jenkins, TeamCity, Alpine, CentOS, Debian, Fedora, Ubuntu, Hadoop, Kafka, ZooKeeper, HBase, Cassandra, Solr, SolrCloud, Presto, Apache Drill, Nifi, Spark, Consul, Riak

    1.379+0Thay đổi số sao trong 7 ngày qua
  • sparkmagic@jupyter-incubator

    Jupyter magics và kernels để làm việc với các cụm Spark từ xa

    1.365-1Thay đổi số sao trong 7 ngày qua
  • Taier@DTStack

    Taier là một nền tảng phát triển dữ liệu lớn dùng để gửi, lập lịch, vận hành, bảo trì và hiển thị thông tin chỉ số

    1.284+0Thay đổi số sao trong 7 ngày qua
  • pyspark-tutorial@mahmoudparsian

    PySpark-Tutorial cung cấp các thuật toán cơ bản sử dụng PySpark

    1.280+1Thay đổi số sao trong 7 ngày qua
  • Trình tăng tốc Apache DataFusion Comet Spark

    1.262+4Thay đổi số sao trong 7 ngày qua
  • zingg@zinggAI

    Quản lý dữ liệu tổng thể có thể mở rộng, phân giải danh tính, phân giải thực thể và khử trùng lặp sử dụng ML

    1.243+5Thay đổi số sao trong 7 ngày qua
  • graphframes@graphframes

    GraphFrames là một gói dành cho Apache Spark cung cấp các đồ thị dựa trên DataFrame

    1.202+1Thay đổi số sao trong 7 ngày qua
  • amoro@apache

    Apache Amoro (đang ủ) là một hệ thống quản lý Lakehouse được xây dựng trên các định dạng hồ dữ liệu mở.

    1.171+2Thay đổi số sao trong 7 ngày qua
  • around-dataengineering@abhishek-ch

    Trung tâm kiến thức về Kỹ thuật dữ liệu & Học máy

    1.146+1Thay đổi số sao trong 7 ngày qua
  • celeborn@apache

    Apache Celeborn là một dịch vụ linh hoạt và hiệu suất cao dành cho dữ liệu xáo trộn (shuffle) và dữ liệu tràn (spilled data).

    1.062+0Thay đổi số sao trong 7 ngày qua
  • adam@bigdatagenomics

    ADAM là nền tảng phân tích bộ gen với các định dạng file chuyên biệt được xây dựng bằng Apache Avro, Apache Spark và Apache Parquet. Cấp phép theo Apache 2.

    1.059+2Thay đổi số sao trong 7 ngày qua
  • listenbrainz-server@metabrainz

    Máy chủ cho dự án ListenBrainz, bao gồm mã giao diện người dùng (javascript/react) và tất cả các thành phần xử lý dữ liệu mà LB sử dụng.

    1.006+5Thay đổi số sao trong 7 ngày qua
  • cudf-spark@NVIDIA

    Plugin NVIDIA cuDF cho Apache Spark - tăng tốc Apache Spark bằng GPU

    998+1Thay đổi số sao trong 7 ngày qua
  • spark-scala-tutorial@deanwampler

    Hướng dẫn miễn phí về Apache Spark.

    988+0Thay đổi số sao trong 7 ngày qua
  • Sparkling Water cung cấp tính năng của H2O bên trong cụm Spark

    980+0Thay đổi số sao trong 7 ngày qua
  • sparklyr@sparklyr

    Giao diện R cho Apache Spark

    972+0Thay đổi số sao trong 7 ngày qua
  • livy@apache

    Apache Livy là một giao diện REST mã nguồn mở để tương tác với Apache Spark từ bất kỳ đâu.

    961+0Thay đổi số sao trong 7 ngày qua
  • data-prep-kit@data-prep-kit

    Dự án mã nguồn mở chuẩn bị dữ liệu cho các ứng dụng GenAI

    958+2Thay đổi số sao trong 7 ngày qua
  • delta-sharing@delta-io

    Một giao thức mở để chia sẻ dữ liệu bảo mật

    957+0Thay đổi số sao trong 7 ngày qua
  • Mobius@microsoft

    Liên kết ngôn ngữ C# và F# cùng các tiện ích mở rộng cho Apache Spark

    948+0Thay đổi số sao trong 7 ngày qua
  • spark-redis@RedisLabs

    Một trình kết nối cho Spark cho phép đọc và ghi dữ liệu từ/đến Redis cluster

    945+0Thay đổi số sao trong 7 ngày qua
  • frameless@typelevel

    Các kiểu dữ liệu biểu cảm cho Spark.

    895-1Thay đổi số sao trong 7 ngày qua
  • tispark@pingcap

    TiSpark được xây dựng để chạy Apache Spark trên nền tảng TiDB/TiKV

    889+0Thay đổi số sao trong 7 ngày qua
  • Danh sách tổng hợp các tài nguyên hữu ích liên quan đến ngôn ngữ lập trình Ada và SPARK.

    864+0Thay đổi số sao trong 7 ngày qua
  • data-on-eks@awslabs

    DoEKS là công cụ để xây dựng, triển khai và mở rộng quy mô các Nền tảng Dữ liệu trên Amazon EKS

    856-1Thay đổi số sao trong 7 ngày qua
  • sparkMeasure@LucaCanali

    Kho lưu trữ này chứa mã phát triển cho sparkMeasure, một thư viện phân tích và khắc phục sự cố hiệu năng Apache Spark. Nó đơn giản hóa việc thu thập, tổng hợp và xuất các chỉ số tác vụ/giai đoạn của Spark, được thiết kế cho việc sử dụng thực tế bởi các nhà phát triển và kỹ sư dữ liệu trong các quy trình phân tích tương tác, kiểm thử và giám sát sản xuất.

    829+1Thay đổi số sao trong 7 ngày qua
  • DevOps-Python-tools@HariSekhon

    Hơn 80 công cụ CLI cho DevOps & Dữ liệu - AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, các bộ chuyển đổi & kiểm định dữ liệu Spark (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr, v.v.

    824+1Thay đổi số sao trong 7 ngày qua
  • Scriptis@WeBankFinTech

    Scriptis là công cụ phân tích dữ liệu tương tác hỗ trợ phát triển script (SQL, Pyspark, HiveQL), gửi tác vụ (Spark, Hive), UDF, hàm, quản lý tài nguyên và chẩn đoán thông minh.

    814+0Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề