lakehouse
Repositórios de código aberto acompanhados marcados com lakehouse, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de lakehouse no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com lakehouse.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
ClickHouse® é um sistema de gerenciamento de banco de dados analítico em tempo real
★ 49.619+96Variação de estrelas nos últimos 7 dias - #2★ 16.730+5Variação de estrelas nos últimos 7 dias
- #3
Apache Doris é um banco de dados de análise em tempo real e busca híbrida para agentes de IA.
★ 15.850+19Variação de estrelas nos últimos 7 dias - #4
O mecanismo de consulta aberta mais rápido do mundo para análises de sub-segundo, tanto dentro quanto fora do data lakehouse. Com a flexibilidade para suportar quase qualquer cenário, o StarRocks oferece desempenho de primeira classe para análises multidimensionais, análises em tempo real e consultas ad-hoc. Um projeto da Linux Foundation.
★ 12.071+14Variação de estrelas nos últimos 7 dias - #5
Data Agent Ready Warehouse: Uma solução para Analytics, Busca, IA e Sandbox Python, reconstruída do zero. Arquitetura unificada sobre seu S3.
★ 9.433+7Variação de estrelas nos últimos 7 dias - #6
Substituto direto para o Apache Spark escrito em Rust, unificando processamento em lote, processamento de fluxo e cargas de trabalho de IA intensivas em computação.
★ 3.341+4Variação de estrelas nos últimos 7 dias - #7
LakeSoul é um framework Lakehouse nativo em nuvem, de ponta a ponta e em tempo real, para ingestão rápida de dados, atualizações concorrentes, análises incrementais, processamento de dados multimodais e busca vetorial — impulsionando cargas de trabalho de BI e IA de próxima geração.
★ 3.249+2Variação de estrelas nos últimos 7 dias - #8
O catálogo de dados abertos mais potente do mundo para construir um data lake de metadados de alta performance, geodistribuído e federado.
★ 3.192+3Variação de estrelas nos últimos 7 dias - #9
YTsaurus é uma plataforma de big data de código aberto escalável e tolerante a falhas.
★ 2.203+0Variação de estrelas nos últimos 7 dias - #10★ 2.131+11Variação de estrelas nos últimos 7 dias
- #11★ 2.045+1Variação de estrelas nos últimos 7 dias
- #12
Análise em tempo real em tabelas Postgres
★ 2.003+0Variação de estrelas nos últimos 7 dias - #13
OLake - Replicação mais rápida de bancos de dados, Kafka e S3 para Apache Iceberg com otimização de tabelas (chamada OLake Fusion). Ingestão de dados eficiente, rápida e escalável para análise em tempo real. Fontes suportadas: Postgres, MongoDB, MySQL, Oracle, MSSql, DB2, Kafka, S3.
★ 1.435+2Variação de estrelas nos últimos 7 dias - #14
Catálogo REST do Apache Iceberg em Rust — controle de acesso, fornecimento de credenciais e auditoria para todos os motores e agentes de IA. Apache 2.0.
★ 1.435+3Variação de estrelas nos últimos 7 dias - #15
ETL/ELT open-source para implantar nos seus próprios servidores ou nuvem. Construído sobre DuckDB: pipelines visuais no-code/low-code ou SQL, 385 componentes, dbt, CDC, qualidade de dados, reverse ETL, linhagem e MCP para agentes de IA. Sem nuvem de fornecedor, sem cobrança por linha.
★ 1.262+15Variação de estrelas nos últimos 7 dias - #16★ 1.095+10Variação de estrelas nos últimos 7 dias
- #17
ClickBench: um benchmark para bancos de dados analíticos.
★ 1.094+2Variação de estrelas nos últimos 7 dias - #18
Uma lista curada de ferramentas de código aberto usadas em plataformas de análise e no ecossistema de engenharia de dados
★ 604+3Variação de estrelas nos últimos 7 dias