spark
Các kho mã nguồn mở đang theo dõi được gắn thẻ spark, sắp xếp theo số sao.
- #61
Giải pháp lưu trữ dữ liệu hiệu năng cao
★ 1.452+0Thay đổi số sao trong 7 ngày qua - #62
Đây là kho lưu trữ GitHub cho sách Learning Spark: Phân tích dữ liệu tốc độ cao [Phiên bản thứ 2]
★ 1.402+3Thay đổi số sao trong 7 ngày qua - #63
Hơn 50 DockerHub image công khai cho Docker & Kubernetes - DevOps, CI/CD, GitHub Actions, CircleCI, Jenkins, TeamCity, Alpine, CentOS, Debian, Fedora, Ubuntu, Hadoop, Kafka, ZooKeeper, HBase, Cassandra, Solr, SolrCloud, Presto, Apache Drill, Nifi, Spark, Consul, Riak
★ 1.379+0Thay đổi số sao trong 7 ngày qua - #64
Jupyter magics và kernels để làm việc với các cụm Spark từ xa
★ 1.365-1Thay đổi số sao trong 7 ngày qua - #65
Taier là một nền tảng phát triển dữ liệu lớn dùng để gửi, lập lịch, vận hành, bảo trì và hiển thị thông tin chỉ số
★ 1.284+0Thay đổi số sao trong 7 ngày qua - #66
PySpark-Tutorial cung cấp các thuật toán cơ bản sử dụng PySpark
★ 1.280+1Thay đổi số sao trong 7 ngày qua - #67
Trình tăng tốc Apache DataFusion Comet Spark
★ 1.262+4Thay đổi số sao trong 7 ngày qua - #68
Quản lý dữ liệu tổng thể có thể mở rộng, phân giải danh tính, phân giải thực thể và khử trùng lặp sử dụng ML
★ 1.243+5Thay đổi số sao trong 7 ngày qua - #69
GraphFrames là một gói dành cho Apache Spark cung cấp các đồ thị dựa trên DataFrame
★ 1.202+1Thay đổi số sao trong 7 ngày qua - #70
Apache Amoro (đang ủ) là một hệ thống quản lý Lakehouse được xây dựng trên các định dạng hồ dữ liệu mở.
★ 1.171+2Thay đổi số sao trong 7 ngày qua - #71
Trung tâm kiến thức về Kỹ thuật dữ liệu & Học máy
★ 1.146+1Thay đổi số sao trong 7 ngày qua - #72
Apache Celeborn là một dịch vụ linh hoạt và hiệu suất cao dành cho dữ liệu xáo trộn (shuffle) và dữ liệu tràn (spilled data).
★ 1.062+0Thay đổi số sao trong 7 ngày qua - #73
ADAM là nền tảng phân tích bộ gen với các định dạng file chuyên biệt được xây dựng bằng Apache Avro, Apache Spark và Apache Parquet. Cấp phép theo Apache 2.
★ 1.059+2Thay đổi số sao trong 7 ngày qua - #74
Máy chủ cho dự án ListenBrainz, bao gồm mã giao diện người dùng (javascript/react) và tất cả các thành phần xử lý dữ liệu mà LB sử dụng.
★ 1.006+5Thay đổi số sao trong 7 ngày qua - #75
Plugin NVIDIA cuDF cho Apache Spark - tăng tốc Apache Spark bằng GPU
★ 998+1Thay đổi số sao trong 7 ngày qua - #76
Hướng dẫn miễn phí về Apache Spark.
★ 988+0Thay đổi số sao trong 7 ngày qua - #77
Sparkling Water cung cấp tính năng của H2O bên trong cụm Spark
★ 980+0Thay đổi số sao trong 7 ngày qua - #78★ 972+0Thay đổi số sao trong 7 ngày qua
- #79
Apache Livy là một giao diện REST mã nguồn mở để tương tác với Apache Spark từ bất kỳ đâu.
★ 961+0Thay đổi số sao trong 7 ngày qua - #80
Dự án mã nguồn mở chuẩn bị dữ liệu cho các ứng dụng GenAI
★ 958+2Thay đổi số sao trong 7 ngày qua - #81
Một giao thức mở để chia sẻ dữ liệu bảo mật
★ 957+0Thay đổi số sao trong 7 ngày qua - #82★ 948+0Thay đổi số sao trong 7 ngày qua
- #83
Một trình kết nối cho Spark cho phép đọc và ghi dữ liệu từ/đến Redis cluster
★ 945+0Thay đổi số sao trong 7 ngày qua - #84★ 895-1Thay đổi số sao trong 7 ngày qua
- #85★ 889+0Thay đổi số sao trong 7 ngày qua
- #86
Danh sách tổng hợp các tài nguyên hữu ích liên quan đến ngôn ngữ lập trình Ada và SPARK.
★ 864+0Thay đổi số sao trong 7 ngày qua - #87
DoEKS là công cụ để xây dựng, triển khai và mở rộng quy mô các Nền tảng Dữ liệu trên Amazon EKS
★ 856-1Thay đổi số sao trong 7 ngày qua - #88
Kho lưu trữ này chứa mã phát triển cho sparkMeasure, một thư viện phân tích và khắc phục sự cố hiệu năng Apache Spark. Nó đơn giản hóa việc thu thập, tổng hợp và xuất các chỉ số tác vụ/giai đoạn của Spark, được thiết kế cho việc sử dụng thực tế bởi các nhà phát triển và kỹ sư dữ liệu trong các quy trình phân tích tương tác, kiểm thử và giám sát sản xuất.
★ 829+1Thay đổi số sao trong 7 ngày qua - #89
Hơn 80 công cụ CLI cho DevOps & Dữ liệu - AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, các bộ chuyển đổi & kiểm định dữ liệu Spark (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr, v.v.
★ 824+1Thay đổi số sao trong 7 ngày qua - #90
Scriptis là công cụ phân tích dữ liệu tương tác hỗ trợ phát triển script (SQL, Pyspark, HiveQL), gửi tác vụ (Spark, Hive), UDF, hàm, quản lý tài nguyên và chẩn đoán thông minh.
★ 814+0Thay đổi số sao trong 7 ngày qua