lakehouse
Repositorios de código abierto monitorizados etiquetados con lakehouse, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a lakehouse en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con lakehouse.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
ClickHouse® es un sistema de gestión de bases de datos analíticas en tiempo real
★ 49.619+96Variación de estrellas de los últimos 7 días - #2★ 16.730+5Variación de estrellas de los últimos 7 días
- #3
Apache Doris es una base de datos de análisis en tiempo real y búsqueda híbrida para agentes de IA.
★ 15.850+19Variación de estrellas de los últimos 7 días - #4
El motor de consultas abierto más rápido del mundo para análisis sub-segundo dentro y fuera del data lakehouse. Con la flexibilidad de soportar casi cualquier escenario, StarRocks ofrece el mejor rendimiento de su clase para análisis multidimensionales, análisis en tiempo real y consultas ad-hoc. Un proyecto de la Linux Foundation.
★ 12.071+14Variación de estrellas de los últimos 7 días - #5
Data Agent Ready Warehouse: Uno para análisis, búsqueda, IA y entorno aislado de Python. Reconstruido desde cero. Arquitectura unificada en tu S3.
★ 9433+7Variación de estrellas de los últimos 7 días - #6
Reemplazo directo de Apache Spark escrito en Rust, que unifica el procesamiento por lotes, el procesamiento de flujos y las cargas de trabajo de IA intensivas en computación.
★ 3341+4Variación de estrellas de los últimos 7 días - #7
LakeSoul es un framework de Lakehouse nativo de la nube, de extremo a extremo y en tiempo real, diseñado para la ingesta rápida de datos, actualizaciones concurrentes, análisis incrementales, procesamiento de datos multimodales y búsqueda vectorial, impulsando cargas de trabajo de BI y AI de próxima generación.
★ 3249+2Variación de estrellas de los últimos 7 días - #8
El catálogo de datos abiertos más potente del mundo para construir un lago de metadatos federado, geo-distribuido y de alto rendimiento.
★ 3192+3Variación de estrellas de los últimos 7 días - #9
YTsaurus es una plataforma de big data de código abierto, escalable y tolerante a fallos.
★ 2203+0Variación de estrellas de los últimos 7 días - #10★ 2131+11Variación de estrellas de los últimos 7 días
- #11★ 2045+1Variación de estrellas de los últimos 7 días
- #12
Analítica en tiempo real en tablas de Postgres
★ 2003+0Variación de estrellas de los últimos 7 días - #13
OLake: replicación rápida de bases de datos, Kafka y S3 a Apache Iceberg con optimización de tablas (OLake Fusion). Ingesta de datos eficiente, rápida y escalable para análisis en tiempo real. Fuentes compatibles: Postgres, MongoDB, MySQL, Oracle, MSSql, DB2, Kafka, S3.
★ 1435+2Variación de estrellas de los últimos 7 días - #14
Catálogo REST de Apache Iceberg en Rust: control de acceso, gestión de credenciales y auditoría para cada motor y agente de IA. Apache 2.0.
★ 1435+3Variación de estrellas de los últimos 7 días - #15
ETL/ELT de código abierto para desplegar en servidores propios o en la nube. Construido sobre DuckDB: pipelines visuales sin código/bajo código o SQL, 385 componentes, dbt, CDC, calidad de datos, ETL inverso, linaje y MCP para agentes de IA. Sin nube de proveedores ni facturación por fila.
★ 1262+15Variación de estrellas de los últimos 7 días - #16
ClickBench: una prueba de rendimiento para bases de datos analíticas
★ 1100+8Variación de estrellas de los últimos 7 días - #17★ 1095+10Variación de estrellas de los últimos 7 días
- #18
Una lista curada de herramientas de código abierto utilizadas en plataformas de análisis y en el ecosistema de ingeniería de datos
★ 604+4Variación de estrellas de los últimos 7 días