跳到主要內容
buildradar
Sign in
主題 · big-data

big-data

標記 big-data 主題、收錄中的開源專案,依星數排序。

共 110 個專案
  • Daft@Eventual-Inc

    高性能数据引擎,适用于 AI 与多模态工作负载。可在任何规模下处理图像、音频、视频和结构化数据

    5,736+4近 7 天星數變化
  • SynapseML@microsoft

    簡單且分散式的機器學習 Python 函式庫,將 ML 演算法移植至 Spark。

    5,245+3近 7 天星數變化
  • calcite@apache

    Apache Calcite

    5,180+2近 7 天星數變化
  • ignite@apache

    Apache Ignite

    5,082+2近 7 天星數變化
  • Stream-Framework@tschellenbach

    Stream Framework 是一個 Python 函式庫,允許你使用 Cassandra 和/或 Redis 構建新聞推送、活動流和通知系統。Stream-Framework 的作者還提供了一項雲端服務,用於推送技術

    4,742-2近 7 天星數變化
  • ⚡️一個支援大量資料列表的 Vue 元件,具有高渲染效能與高效能

    4,505-1近 7 天星數變化
  • img2dataset@rom1504

    輕鬆將大量圖片網址轉為圖片資料集。可下載、調整尺寸並打包 100M 網址,單機 20 小時完成

    4,445+2近 7 天星數變化
  • crate@crate

    CrateDB 是一個分散式且可擴展的 SQL 資料庫,能在近實時環境下儲存與分析大量資料,即使是複雜查詢也能處理。它與 PostgreSQL 兼容,並基於 Lucene。

    4,432+3近 7 天星數變化
  • fastjson2@alibaba

    🚄 FASTJSON2 是一個具有卓越效能的 Java JSON 函式庫

    4,399+2近 7 天星數變化
  • Data-Science-Roadmap@Moataz-Elmesmary

    從 A 到 Z 的資料科學路線圖。

    4,354+3近 7 天星數變化
  • GraphScope@alibaba

    GraphScope:阿里巴巴的一站式大規模圖計算系統

    3,557+1近 7 天星數變化
  • 可擴充的 Rust SQL 词法分析器與解析器

    3,446+9近 7 天星數變化
  • paimon@apache

    Apache Paimon 是一種湖泊格式,能與 Flink 與 Spark 一同構建即時湖屋架構,支援流式與批處理

    3,388+3近 7 天星數變化
  • koalas@databricks

    Koalas:Apache Spark 上的 pandas API

    3,374+1近 7 天星數變化
  • sail@lakehq

    以 Rust 編寫的 Apache Spark 無縫替代方案,統一了批次處理、串流處理和運算密集型 AI 工作負載。

    3,341+4近 7 天星數變化
  • hugegraph@apache

    支援超過 100 億筆資料、具備高效能與可擴充性的圖形資料庫(含 OLTP 引擎、REST-API 與後端)

    3,167+6近 7 天星數變化
  • CBoard@TuiQiao

    一個易於使用的自助式開源 BI 報表與 BI 儀表板平台。

    3,098+1近 7 天星數變化
  • kafka-ui@kafbat

    用於管理 Apache Kafka 叢集的開源 Web UI

    2,656+14近 7 天星數變化
  • ArcticDB@man-group

    ArcticDB 是一個專為 Python 資料科學生態系打造的高效能、無伺服器 DataFrame 資料庫。

    2,505+8近 7 天星數變化
  • quary@quarylabs

    專為工程師打造的開源商業智慧(BI)

    2,379+2近 7 天星數變化
  • ambari@apache

    Apache Ambari 簡化了 Apache Hadoop 叢集的設定、管理與監控。

    2,311+0近 7 天星數變化
  • ytsaurus@ytsaurus

    YTsaurus 是一個具備可擴展性與容錯能力的開源大數據平台。

    2,203+0近 7 天星數變化
  • fluss@apache

    Apache Fluss 是一個為即時分析而建構的串流儲存系統。

    2,131+11近 7 天星數變化
  • Apache DataFusion Ballista 分散式查詢引擎

    2,127+7近 7 天星數變化
  • drill@apache

    Apache Drill 是一個用於自我描述資料的分散式 MPP 查詢層

    2,022+0近 7 天星數變化
  • bookkeeper@apache

    Apache BookKeeper - 針對僅附加(append-only)工作負載最佳化的可擴展、容錯且低延遲的儲存服務

    2,011+1近 7 天星數變化
  • fluid@fluid-cloudnative

    用於雲端巨量資料/AI 應用程式的流暢、彈性資料抽象化與加速。(CNCF 旗下專案)

    1,967+0近 7 天星數變化
  • kudu@apache

    Apache Kudu 的鏡像

    1,913+0近 7 天星數變化
  • awesome-data-analysis@PavelGrigoryevDS

    🚀 超過 500 個精選的資料分析與資料科學資源:Python、SQL、統計學、ML、AI、視覺化、速查表、學習藍圖與面試準備,適合初學者與專家。

    1,890+8近 7 天星數變化
  • auron@apache

    用於分散式運算框架(如 Spark)的 Auron 加速器,利用原生向量化執行來加速查詢處理

    1,798+2近 7 天星數變化
← 返回主題列表