Pular para o conteúdo principal
buildradar
Sign in
Tópico · datalake

datalake

Repositórios de código aberto acompanhados marcados com datalake, ordenados por estrelas.

Repositórios
17
Total de estrelas
86.158
Média de estrelas
5.068
Participação
0,00%

Tópicos que aparecem com frequência ao lado de datalake no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com datalake.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • pandas-ai@sinaptik-ai

    Converse com seu banco de dados ou datalake (SQL, CSV, parquet). O PandasAI torna a análise de dados conversacional usando LLMs e RAG.

    23.788+10Variação de estrelas nos últimos 7 dias
  • trino@trinodb

    Repositório oficial do Trino, o motor de consulta SQL distribuído para big data, anteriormente conhecido como PrestoSQL (https://trino.io)

    13.200+6Variação de estrelas nos últimos 7 dias
  • starrocks@StarRocks

    O mecanismo de consulta aberta mais rápido do mundo para análises de sub-segundo, tanto dentro quanto fora do data lakehouse. Com a flexibilidade para suportar quase qualquer cenário, o StarRocks oferece desempenho de primeira classe para análises multidimensionais, análises em tempo real e consultas ad-hoc. Um projeto da Linux Foundation.

    12.071+14Variação de estrelas nos últimos 7 dias
  • deeplake@activeloopai

    Deeplake é um runtime de dados de IA para agentes. Oferece postgres serverless com um datalake multimodal, permitindo recuperação e treinamento escaláveis

    9.229-1Variação de estrelas nos últimos 7 dias
  • hudi@apache

    Upserts, exclusões e processamento incremental em Big Data.

    6.232+5Variação de estrelas nos últimos 7 dias
  • lakeFS@treeverse

    lakeFS - Controle de versão de dados para seu data lake | Git para dados

    5.510+11Variação de estrelas nos últimos 7 dias
  • dinky@DataLinkDC

    Dinky é uma plataforma de desenvolvimento de dados em tempo real baseada no Apache Flink, que permite o desenvolvimento, implantação e operação ágil de dados.

    3.754+0Variação de estrelas nos últimos 7 dias
  • gravitino@apache

    O catálogo de dados abertos mais potente do mundo para construir um data lake de metadados de alta performance, geodistribuído e federado.

    3.192+3Variação de estrelas nos últimos 7 dias
  • nisshi@nisshi-io

    Broker compatível com Apache Kafka® com suporte para S3, PostgreSQL, SQLite, Apache Iceberg e Delta Lake.

    1.853+1Variação de estrelas nos últimos 7 dias
  • leofs@leo-project

    O sistema de armazenamento LeoFS.

    1.594+0Variação de estrelas nos últimos 7 dias
  • zingg@zinggAI

    Gerenciamento de dados mestres escalável, resolução de identidade, resolução de entidades e deduplicação usando ML.

    1.243+5Variação de estrelas nos últimos 7 dias
  • ClickBench@ClickHouse

    ClickBench: um benchmark para bancos de dados analíticos.

    1.100+2Variação de estrelas nos últimos 7 dias
  • Um guia abrangente para construir um data warehouse moderno com SQL Server, incluindo processos de ETL, modelagem de dados e análises.

    934+14Variação de estrelas nos últimos 7 dias
  • awesome-data-agents@HKUSTDial

    Lista de artigos atualizada continuamente sobre avanços em Data Agents. Repositório complementar ao nosso artigo "A Survey of Data Agents: Emerging Paradigm or Overstated Hype?"

    733+10Variação de estrelas nos últimos 7 dias
  • Uma lista curada de ferramentas de código aberto usadas em plataformas de análise e no ecossistema de engenharia de dados

    604+3Variação de estrelas nos últimos 7 dias
  • automate-dv@Datavault-UK

    Um pacote dbt gratuito para criar e carregar Data Warehouses compatíveis com Data Vault 2.0 (impulsionado pelo dbt, uma ferramenta de engenharia de dados de código aberto, marca registrada da dbt Labs).

    595+0Variação de estrelas nos últimos 7 dias
  • Compilação de materiais relacionados ao Apache Hudi

    556+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos