hadoop
Các kho mã nguồn mở đang theo dõi được gắn thẻ hadoop, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng hadoop trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ hadoop.
Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.
- #1
Các notebook Python về khoa học dữ liệu: Deep learning (TensorFlow, Theano, Caffe, Keras), scikit-learn, Kaggle, big data (Spark, Hadoop MapReduce, HDFS), matplotlib, pandas, NumPy, SciPy, kiến thức Python cơ bản, AWS và các dòng lệnh khác nhau.
★ 29.339+5Thay đổi số sao trong 7 ngày qua - #2
Luigi là một module Python giúp bạn xây dựng các chuỗi công việc hàng loạt phức tạp. Nó xử lý việc phân giải phần phụ thuộc, quản lý quy trình làm việc, trực quan hóa,... Nó cũng tích hợp sẵn hỗ trợ Hadoop.
★ 18.767-1Thay đổi số sao trong 7 ngày qua - #3
🏆 Thư viện ORM thời gian thực không cần mã, mạnh mẽ và bảo mật 🚀 cung cấp API và tài liệu mà không cần viết mã ở backend, frontend (client) có thể tùy chỉnh JSON phản hồi 🏆
★ 18.406+4Thay đổi số sao trong 7 ngày qua - #4
Hướng dẫn nhập môn Big Data :star:
★ 16.962+4Thay đổi số sao trong 7 ngày qua - #5★ 16.730+5Thay đổi số sao trong 7 ngày qua
- #6★ 15.647+8Thay đổi số sao trong 7 ngày qua
- #7
Bộ công cụ triển khai và huấn luyện mô hình học sâu sử dụng JVM. Các điểm nổi bật bao gồm nhập mô hình cho keras, tensorflow và onnx/pytorch, một thư viện C++ mô-đun nhỏ gọn để chạy mã toán học, và một thư viện toán học dựa trên Java chạy trên cốt lõi C++. Cũng bao gồm samediff: một thư viện chạy học sâu giống pytorch/tensorflow...
★ 14.248+0Thay đổi số sao trong 7 ngày qua - #8
Kho lưu trữ chính thức của Trino, công cụ truy vấn SQL phân tán dành cho dữ liệu lớn, trước đây gọi là PrestoSQL (https://trino.io)
★ 13.200+6Thay đổi số sao trong 7 ngày qua - #9
Hơn 1200 DevOps Bash Script - AWS, GCP, Kubernetes, Docker, CI/CD, APIs, SQL, PostgreSQL, MySQL, Hive, Impala, Kafka, Hadoop, Jenkins, GitHub, GitLab, BitBucket, Azure DevOps, TeamCity, Spotify, MP3, LDAP, Code/Build Linting, quản lý gói cho Linux, Mac, Python, Perl, Ruby, NodeJS, Golang, dotfiles nâng cao: .bashrc, .vimrc, .gitconfig, .screenrc, tmux..
★ 8.393+1Thay đổi số sao trong 7 ngày qua - #10
Tại LinkedIn, chúng tôi đang sử dụng chương trình giảng dạy này để định hướng cho nhân sự mới vào vai trò SRE.
★ 8.141+4Thay đổi số sao trong 7 ngày qua - #11
H2O là Nền tảng Học máy Mã nguồn mở, Phân tán, Nhanh & Có thể mở rộng: Deep Learning, Gradient Boosting (GBM) & XGBoost, Random Forest, Generalized Linear Modeling (GLM với Elastic Net), K-Means, PCA, Generalized Additive Models (GAM), RuleFit, Support Vector Machine (SVM), Stacked Ensembles, Automatic Machine Learning (AutoML), v.v.
★ 7.499+3Thay đổi số sao trong 7 ngày qua - #12★ 7.234+3Thay đổi số sao trong 7 ngày qua
- #13★ 6.016+1Thay đổi số sao trong 7 ngày qua
- #14★ 5.180+2Thay đổi số sao trong 7 ngày qua
- #15★ 5.082+2Thay đổi số sao trong 7 ngày qua
- #16
Apache Nutch là một trình thu thập thông tin web (web crawler) có thể mở rộng và nâng cấp quy mô
★ 3.283+4Thay đổi số sao trong 7 ngày qua - #17
DataSphereStudio là một cổng thông tin quản lý và phát triển ứng dụng dữ liệu một điểm dừng (one-stop), bao gồm các kịch bản như trao đổi dữ liệu, khử nhạy/làm sạch, phân tích/khai phá, đo lường chất lượng, trực quan hóa và lập lịch tác vụ.
★ 3.262-1Thay đổi số sao trong 7 ngày qua - #18
Học Big Data, học Big Data từ con số không, bao gồm video học tập và tài liệu phỏng vấn cho từng giai đoạn học Big Data
★ 3.224+5Thay đổi số sao trong 7 ngày qua - #19
Hệ thống phân tích lưu lượng hành khách lớn tàu điện ngầm Thâm Quyến 🚇🚄🌟
★ 2.475+1Thay đổi số sao trong 7 ngày qua - #20
Apache Kyuubi là cổng kết nối phân tán và đa người thuê cung cấp SQL không máy chủ trên data warehouse và lakehouse.
★ 2.364+1Thay đổi số sao trong 7 ngày qua - #21
Docker image cho Apache Hadoop
★ 2.325-1Thay đổi số sao trong 7 ngày qua - #22★ 2.291+4Thay đổi số sao trong 7 ngày qua
- #23★ 2.022+0Thay đổi số sao trong 7 ngày qua
- #24
Kho tri thức dữ liệu lớn liên quan đến mô hình hóa kho dữ liệu, tính toán thời gian thực, dữ liệu lớn, trung tâm dữ liệu, thiết kế hệ thống, Java, thuật toán, v.v.
★ 1.811+3Thay đổi số sao trong 7 ngày qua - #25★ 1.728+0Thay đổi số sao trong 7 ngày qua
- #26
Hơn 2000+ câu hỏi phỏng vấn Data engineer.
★ 1.721+5Thay đổi số sao trong 7 ngày qua - #27
Giải pháp lưu trữ dữ liệu hiệu năng cao
★ 1.452+0Thay đổi số sao trong 7 ngày qua - #28
Một công cụ ETL nhanh chóng và linh hoạt có thể truyền dữ liệu liền mạch giữa RDBMS và NoSQL
★ 1.430+3Thay đổi số sao trong 7 ngày qua - #29
Hơn 50 DockerHub image công khai cho Docker & Kubernetes - DevOps, CI/CD, GitHub Actions, CircleCI, Jenkins, TeamCity, Alpine, CentOS, Debian, Fedora, Ubuntu, Hadoop, Kafka, ZooKeeper, HBase, Cassandra, Solr, SolrCloud, Presto, Apache Drill, Nifi, Spark, Consul, Riak
★ 1.379+0Thay đổi số sao trong 7 ngày qua - #30
Taier là một nền tảng phát triển dữ liệu lớn dùng để gửi, lập lịch, vận hành, bảo trì và hiển thị thông tin chỉ số
★ 1.284+0Thay đổi số sao trong 7 ngày qua