跳到主要內容
buildradar
Sign in
主題 · big-data

big-data

標記 big-data 主題、收錄中的開源專案,依星數排序。

專案數
110
總星數
639,180
平均星數
5,811
佔比
0.03%

常跟 big-data 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 big-data 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • 可擴展、可靠且高效的大規模系統模式

    73,681+79近 7 天星數變化
  • ClickHouse@ClickHouse

    ClickHouse® 為即時分析資料庫管理系統

    49,619+96近 7 天星數變化
  • spark@apache

    Apache Spark - 用於大規模資料處理的統一分析引擎

    43,943+42近 7 天星數變化
  • 資料科學 Python Notebook:深度學習(TensorFlow、Theano、Caffe、Keras)、scikit-learn、Kaggle、大數據(Spark、Hadoop MapReduce、HDFS)、matplotlib、pandas、NumPy、SciPy、Python 基礎、AWS 及各種指令列工具。

    29,339+5近 7 天星數變化
  • flink@apache

    Apache Flink

    26,324+22近 7 天星數變化
  • thingsboard@thingsboard

    開源 IoT 平台——設備管理、資料收集、處理與可視化

    22,355+28近 7 天星數變化
  • gun@amark

    用於同步去中心化圖形資料的開源網路安全協議

    19,129+1近 7 天星數變化
  • BigData-Notes@heibaiying

    大資料入門指南 ★

    16,962+4近 7 天星數變化
  • presto@prestodb

    Presto 分散式大數據 SQL 查詢引擎的官方首頁

    16,730+5近 7 天星數變化
  • Cookbook@andkret

    資料工程烹飪書

    15,397+14近 7 天星數變化
  • trino@trinodb

    Trino 官方倉庫,這是一個分散式 SQL 查詢引擎,用於大數據,前身為 PrestoSQL (https://trino.io)

    13,200+6近 7 天星數變化
  • nebula@vesoft-inc

    一個分散式、快速的開源圖形資料庫,具備水平擴展性與高可用性

    12,372+5近 7 天星數變化
  • kafka-ui@provectus

    Apache Kafka 管理的開源 Web UI

    12,278+6近 7 天星數變化
  • starrocks@StarRocks

    全球最快的開放查詢引擎,支援資料湖倉的秒級分析,提供多維分析、即時分析與即席查詢的最佳效能,屬 Linux Foundation 專案

    12,071+14近 7 天星數變化
  • quickwit@quickwit-oss

    雲原生開源搜尋引擎,用於可觀測性

    11,563+7近 7 天星數變化
  • cython@cython

    最廣泛使用的 Python 到 C 編譯器

    10,842+6近 7 天星數變化
  • datafusion@apache

    Apache DataFusion SQL 查詢引擎

    9,267+19近 7 天星數變化
  • catboost@catboost

    一個快速、可擴展、高效能的梯度提升決策樹函式庫,支援排名、分類、回歸及其他機器學習任務,適用於 Python、R、Java、C++,支援 CPU 與 GPU 計算。

    9,086+1近 7 天星數變化
  • delta@delta-io

    開源儲存框架,支援 Spark、PrestoDB、Flink、Trino、Hive 等計算引擎,構建 Lakehouse 架構與 API

    8,984+22近 7 天星數變化
  • beam@apache

    Apache Beam 是一個統一的程式模型,用於批次與串流資料處理

    8,658+5近 7 天星數變化
  • h2o-3@h2oai

    H2O 是開源、分散式、快速且可擴展的機器學習平台:深度學習、梯度提升(GBM)與 XGBoost、隨機森林、廣義線性模型(GLM with Elastic Net)、K-Means、PCA、廣義加法模型(GAM)、RuleFit、支援向量機(SVM)、堆疊集成、AutoML 等

    7,499+3近 7 天星數變化
  • arkime@arkime

    Arkime 是一套開源、大規模、完整封包捕獲、索引與資料庫系統。

    7,461+1近 7 天星數變化
  • feast@feast-dev

    AI/ML 的開源特徵庫(Feature Store)

    7,244+5近 7 天星數變化
  • vespa@vespa-engine

    AI 搜尋平台

    7,075+3近 7 天星數變化
  • couchdb@apache

    具直覺 HTTP/JSON API 的無縫多主鍵同步資料庫,設計以可靠性為核心

    6,944+0近 7 天星數變化
  • zeppelin@apache

    基於網頁的筆記本,支援資料驅動、互動式資料分析與協作文件,包含 SQL、Scala 等

    6,655+0近 7 天星數變化
  • hazelcast@hazelcast

    Hazelcast 是一個統一的即時資料平台,結合串流處理與高速資料存儲,讓客戶能即時對移動中的資料採取行動,獲得即時洞見。

    6,606+2近 7 天星數變化
  • iotdb@apache

    Apache IoTDB

    6,389+4近 7 天星數變化
  • pachyderm@pachyderm

    以資料為中心的管線與資料版本管理

    6,309+1近 7 天星數變化
  • hive@apache

    Apache Hive

    6,016+1近 7 天星數變化
← 返回主題列表