Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · datalake

datalake

Các kho mã nguồn mở đang theo dõi được gắn thẻ datalake, sắp xếp theo số sao.

Kho mã
17
Tổng số sao
86.158
Số sao trung bình
5.068
Tỷ trọng
0,00%

Những chủ đề thường xuất hiện cùng datalake trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ datalake.

Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.

  • pandas-ai@sinaptik-ai

    Trò chuyện với cơ sở dữ liệu hoặc data lake của bạn (SQL, CSV, parquet). PandasAI giúp việc phân tích dữ liệu trở nên dễ dàng qua trò chuyện sử dụng LLMs và RAG.

    23.788+10Thay đổi số sao trong 7 ngày qua
  • trino@trinodb

    Kho lưu trữ chính thức của Trino, công cụ truy vấn SQL phân tán dành cho dữ liệu lớn, trước đây gọi là PrestoSQL (https://trino.io)

    13.200+6Thay đổi số sao trong 7 ngày qua
  • starrocks@StarRocks

    Công cụ truy vấn mở nhanh nhất thế giới dành cho phân tích dưới một giây trên và ngoài data lakehouse. Với tính linh hoạt hỗ trợ gần như mọi kịch bản, StarRocks mang lại hiệu suất tốt nhất cho phân tích đa chiều, phân tích thời gian thực và truy vấn ad-hoc. Một dự án của Linux Foundation.

    12.071+14Thay đổi số sao trong 7 ngày qua
  • deeplake@activeloopai

    Deeplake là AI Data Runtime dành cho Agents. Nó cung cấp postgres không máy chủ với datalake đa phương thức, hỗ trợ truy xuất và huấn luyện có thể mở rộng.

    9.229-1Thay đổi số sao trong 7 ngày qua
  • hudi@apache

    Thao tác Upsert, Xóa và Xử lý Tăng dần trên Big Data.

    6.232+5Thay đổi số sao trong 7 ngày qua
  • lakeFS@treeverse

    lakeFS - Quản lý phiên bản dữ liệu cho data lake của bạn | Git cho dữ liệu

    5.510+11Thay đổi số sao trong 7 ngày qua
  • dinky@DataLinkDC

    Dinky là nền tảng phát triển dữ liệu thời gian thực dựa trên Apache Flink, hỗ trợ phát triển, triển khai và vận hành dữ liệu linh hoạt.

    3.754+0Thay đổi số sao trong 7 ngày qua
  • gravitino@apache

    Danh mục dữ liệu mở mạnh mẽ nhất thế giới để xây dựng hồ siêu dữ liệu hiệu suất cao, phân tán địa lý và liên kết.

    3.192+3Thay đổi số sao trong 7 ngày qua
  • nisshi@nisshi-io

    Broker tương thích với Apache Kafka® với S3, PostgreSQL, SQLite, Apache Iceberg và Delta Lake

    1.853+1Thay đổi số sao trong 7 ngày qua
  • leofs@leo-project

    Hệ thống lưu trữ LeoFS

    1.594+0Thay đổi số sao trong 7 ngày qua
  • zingg@zinggAI

    Quản lý dữ liệu tổng thể có thể mở rộng, phân giải danh tính, phân giải thực thể và khử trùng lặp sử dụng ML

    1.243+5Thay đổi số sao trong 7 ngày qua
  • ClickBench@ClickHouse

    ClickBench: Điểm chuẩn dành cho các cơ sở dữ liệu phân tích

    1.100+2Thay đổi số sao trong 7 ngày qua
  • Hướng dẫn toàn diện về cách xây dựng kho dữ liệu hiện đại với SQL Server, bao gồm các quy trình ETL, mô hình hóa dữ liệu và phân tích.

    934+14Thay đổi số sao trong 7 ngày qua
  • awesome-data-agents@HKUSTDial

    Danh sách bài báo được cập nhật liên tục về những tiến bộ trong Data Agents. Repo đi kèm với bài báo "A Survey of Data Agents: Emerging Paradigm or Overstated Hype?" của chúng tôi.

    733+10Thay đổi số sao trong 7 ngày qua
  • Danh sách chọn lọc các công cụ mã nguồn mở được sử dụng trong các nền tảng phân tích và hệ sinh thái kỹ thuật dữ liệu (data engineering)

    604+3Thay đổi số sao trong 7 ngày qua
  • automate-dv@Datavault-UK

    Một gói dbt miễn phí để tạo và tải các Kho dữ liệu tuân thủ Data Vault 2.0 (được hỗ trợ bởi dbt, một công cụ kỹ thuật dữ liệu mã nguồn mở, thương hiệu đã đăng ký của dbt Labs)

    595+0Thay đổi số sao trong 7 ngày qua
  • Tổng hợp tài liệu liên quan đến Apache Hudi

    556+0Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề