跳到主要內容
buildradar
Sign in
主題 · data-pipeline

data-pipeline

標記 data-pipeline 主題、收錄中的開源專案,依星數排序。

專案數
33
總星數
135,349
平均星數
4,101
佔比
0.01%

常跟 data-pipeline 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 data-pipeline 主題的專案。

  • hflow@Hebbian-Robotics

    Open source SDK for building multimodal data-quality, processing, enrichment, and curation pipelines for robotics and Physical AI.

    143
  • airbyte@airbytehq

    開源資料搬移工具,用於 ELT 流程與 AI 代理——支援 API、資料庫與檔案至資料倉儲、資料湖與 AI 應用,提供自行部署與雲端方案

    21,981+9近 7 天星數變化
  • 以分散式 SQL 為基礎,提供跨所有資料庫的分片、可擴充性與安全性,賦能資料智慧化

    20,788-3近 7 天星數變化
  • debezium@debezium

    支援多種資料庫的變更資料捕獲。請於 https://github.com/debezium/dbz/issues 回報問題。

    13,072+16近 7 天星數變化
  • rocketride-server@rocketride-org

    高效能 AI 流程引擎,核心使用 C++,提供 50+ 可用 Python 擴充節點。可在 IDE 中構建、除錯與擴展 LLM 工作流,支援 13+ 模型供應商、8+ 向量資料庫與代理協調。包含 VS Code 擴充、TypeScript/Python SDK 與 Docker 部署。

    7,641+270近 7 天星數變化
  • snowplow@snowplow

    客戶資料基礎設施領導者。

    7,032+2近 7 天星數變化
  • data-juicer@datajuicer

    為基礎模型提供資料處理!🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

    6,975+26近 7 天星數變化
  • flink-cdc@apache

    Flink CDC 是一個串流資料整合工具

    6,469+0近 7 天星數變化
  • whodb@clidey

    資料存取與運營智慧的交匯點

    5,019+2近 7 天星數變化
  • rudder-server@rudderlabs

    以隱私與安全為核心的 Segment 替代方案,使用 Golang 與 React 開發。

    4,483+4近 7 天星數變化
  • 從零開始學習資料工程的實用資源清單

    4,009-2近 7 天星數變化
  • ingestr@bruin-data

    ingestr 是一個 CLI 工具,能用單一命令無縫複製任何資料庫之間的資料

    3,935+18近 7 天星數變化
  • dagu@dagucloud

    可自託管的工作流協調器,適用於主要工作非協調的團隊。使用YAML描述腳本、SSH命令、容器等;將工作流與業務邏輯分離。單個二進位檔,無資料庫,適合有限硬體資源。Airflow/Cron/Job Scheduler的替代方案

    3,832+17近 7 天星數變化
  • memphis@superstreamlabs

    Memphis.dev 是一個高度可擴展且輕鬆使用的資料流平台

    3,440+0近 7 天星數變化
  • sie@superlinked

    為你的 Agent 所需的所有模型提供開源推論伺服器與生產叢集。

    3,030+173近 7 天星數變化
  • whylogs@whylabs

    用於機器學習模型與資料管道的開源資料記錄函式庫。📚 提供對資料品質與模型長期效能的可視性。🛡️ 支援保護隱私的資料收集,確保安全與穩健性。📈

    2,831+0近 7 天星數變化
  • elementary@elementary-data

    專為資料與分析工程師打造的 dbt 原生資料可觀測性解決方案。幾分鐘內即可監控您的資料管線。提供具備進階功能的自我主機部署或雲端服務。

    2,405+4近 7 天星數變化
  • 一個用於 Go 的輕量級串流處理函式庫

    2,172+1近 7 天星數變化
  • doit@pydoit

    CLI 任務管理與自動化工具

    2,083-1近 7 天星數變化
  • multiwoven@Multiwoven

    🔥🔥🔥 開源 Reverse ETL —— hightouch 與 census 的替代方案。

    1,673+0近 7 天星數變化
  • olake@datazip-inc

    OLake - 最快的資料庫、Kafka 與 S3 複製工具,支援 Apache Iceberg 與表格最佳化(稱為 OLake Fusion)。⚡ 針對即時分析提供高效、快速且具擴充性的資料匯入。支援的來源:Postgres, MongoDB, MySQL, Oracle, MSSql, DB2, Kafka, S3。

    1,435+2近 7 天星數變化
  • data-science-on-gcp@GoogleCloudPlatform

    書籍伴隨原始碼:《Google Cloud Platform 上的資料科學》,Valliappa Lakshmanan 著,O'Reilly 出版,2017 年

    1,429+1近 7 天星數變化
  • duckle@slothflowlabs

    可在您自己的伺服器或雲端部署的開源 ETL/ELT。基於 DuckDB 打造:無程式碼/低程式碼視覺化管線或 SQL、385 個元件、dbt、CDC、資料品質、反向 ETL、血緣追蹤、供 AI 代理使用的 MCP。沒有廠商雲端,也沒有按列計費。

    1,262+15近 7 天星數變化
  • zerocode@authorjapps

    zerocode-tdd 是一個社群開發、免費、開源、以結果為導向的自動化測試工具,適用於資料管線、ETL、REST API、Kafka(資料流)、資料庫和負載情境。全部透過簡單的 JSON 或 YAML 定義——完全無需寫程式。

    1,013+1近 7 天星數變化
  • flow@estuary

    🌊 使用 Estuary 管理資料流,持續將資料所在的系統同步至你_希望_資料存在的系統。 🌊

    972+7近 7 天星數變化
  • seatunnel-web@apache

    SeaTunnel 是一個分散式、高效能的資料整合平台,用於海量資料(離線與即時)的同步與轉換。

    878+5近 7 天星數變化
  • klio@spotify

    更聰明的音訊資料管線。

    876+2近 7 天星數變化
  • covalent@AgnostiqHQ

    用於異質運算環境中協調機器學習、高效能運算、量子運算工作流程的 Pythonic 工具。

    869+0近 7 天星數變化
  • practical-data-engineering@ssp-data

    實用資料工程:實戰房地產專案指南

    823+2近 7 天星數變化
  • conduit@ConduitIO

    Conduit 在資料儲存庫之間串流資料。Kafka Connect 的替代品。不需要 JVM。

    608+0近 7 天星數變化
  • 精選的開源工具清單,用於分析平台與資料工程生態系統

    604+4近 7 天星數變化
← 返回主題列表