data-pipeline
标记 data-pipeline 主题、收录中的开源项目,按星标数排序。
相关主题
常跟 data-pipeline 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 data-pipeline 主题的项目。
- #1★ 21,981+9近 7 天星标变化
- #2
以分布式 SQL 为基础,提供跨所有数据库的分片、可扩展性与安全性,赋能数据智能
★ 20,788-3近 7 天星标变化 - #3★ 13,072+16近 7 天星标变化
- #4
高性能 AI 流水线引擎,核心使用 C++,提供 50+ 可用 Python 可扩展节点。可在 IDE 中构建、调试与扩展 LLM 工作流,支持 13+ 模型提供商、8+ 向量数据库与代理编排。包含 VS Code 扩展、TypeScript/Python SDK 与 Docker 部署。
★ 7,641+270近 7 天星标变化 - #5★ 7,032+2近 7 天星标变化
- #6
为基础模型提供数据处理!🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷
★ 6,975+26近 7 天星标变化 - #7★ 6,469+0近 7 天星标变化
- #8★ 5,019+2近 7 天星标变化
- #9
以隐私与安全为核心的 Segment 替代方案,使用 Golang 与 React 开发。
★ 4,483+4近 7 天星标变化 - #10
从零开始学习数据工程的实用资源清单
★ 4,009-2近 7 天星标变化 - #11★ 3,935+18近 7 天星标变化
- #12
可自托管的工作流协调器,适用于主要工作非协调的团队。使用YAML描述脚本、SSH命令、容器等;将工作流与业务逻辑分离。单个二进制文件,无数据库,适合有限硬件资源。Airflow/Cron/Job Scheduler的替代方案
★ 3,832+17近 7 天星标变化 - #13★ 3,440+0近 7 天星标变化
- #14★ 3,030+173近 7 天星标变化
- #15★ 2,831+0近 7 天星标变化
- #16
专为数据与分析工程师打造的 dbt 原生数据可观测性解决方案。几分钟内即可监控您的数据管道。提供具备高级功能的自托管部署或云服务。
★ 2,405+4近 7 天星标变化 - #17
一个用于 Go 的轻量级流处理库
★ 2,172+1近 7 天星标变化 - #18★ 2,083-1近 7 天星标变化
- #19
🔥🔥🔥 开源 Reverse ETL —— hightouch 与 census 的替代方案。
★ 1,673+0近 7 天星标变化 - #20
OLake - 最快的数据库、Kafka 与 S3 复制工具,支持 Apache Iceberg 与表格优化(称为 OLake Fusion)。⚡ 针对实时分析提供高效、快速且具可扩展性的数据导入。支持的来源:Postgres, MongoDB, MySQL, Oracle, MSSql, DB2, Kafka, S3。
★ 1,435+2近 7 天星标变化 - #21
书籍伴随源码:《Google Cloud Platform 上的数据科学》,Valliappa Lakshmanan 著,O'Reilly 出版,2017 年
★ 1,429+1近 7 天星标变化 - #22
可在您自己的服务器或云端部署的开源 ETL/ELT。基于 DuckDB 打造:无代码/低代码可视化管道或 SQL、385 个组件、dbt、CDC、数据质量、反向 ETL、血缘追踪、供 AI 代理使用的 MCP。没有厂商云端,也没有按行计费。
★ 1,262+15近 7 天星标变化 - #23
zerocode-tdd 是一个社区开发、免费、开源、以结果为导向的自动化测试,适用于数据管道、ETL、REST API、Kafka(数据流)、数据库和负载场景。全部定义在简单的 JSON 或YAML 中——零编码。
★ 1,013+1近 7 天星标变化 - #24★ 972+7近 7 天星标变化
- #25
SeaTunnel 是一个分布式、高性能的数据集成平台,用于海量数据(离线与实时)的同步与转换。
★ 877+5近 7 天星标变化 - #26★ 876+2近 7 天星标变化
- #27★ 869+0近 7 天星标变化
- #28
实用数据工程:实战房地产项目指南
★ 823+2近 7 天星标变化 - #29★ 608+0近 7 天星标变化
- #30
精选的开源工具清单,用于分析平台与数据工程生态系统
★ 604+4近 7 天星标变化