data-integration
Repositorios de código abierto monitorizados etiquetados con data-integration, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a data-integration en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con data-integration.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
Apache Airflow: una plataforma para crear, programar y supervisar flujos de trabajo mediante código
★ 46.638+64Variación de estrellas de los últimos 7 días - #2
Movimiento de datos de código abierto para pipelines ELT y agentes de IA — desde APIs, bases de datos y archivos hasta almacenes, lagos y aplicaciones de IA. Tanto autohospedado como en la nube.
★ 21.972+34Variación de estrellas de los últimos 7 días - #3
Convierte datos y algoritmos de IA en aplicaciones web listas para producción en poco tiempo.
★ 19.436+6Variación de estrellas de los últimos 7 días - #4
Una plataforma de orquestación para el desarrollo, producción y observación de activos de datos.
★ 16.073+26Variación de estrellas de los últimos 7 días - #5
SeaTunnel es una herramienta de integración de datos masivos multimodal, de alto rendimiento y distribuida.
★ 9600+30Variación de estrellas de los últimos 7 días - #6★ 8814+5Variación de estrellas de los últimos 7 días
- #7
Pipelines de datos para configuración en la nube y datos de seguridad. Crea soluciones de inventario de activos en la nube, CSPM, FinOps y gestión de vulnerabilidades. Extrae datos de AWS, Azure, GCP y más de 70 fuentes de la nube y SaaS.
★ 6503+14Variación de estrellas de los últimos 7 días - #8★ 6469+6Variación de estrellas de los últimos 7 días
- #9
Inserciones actualizadas (upserts), eliminaciones y procesamiento incremental en Big Data.
★ 6227+12Variación de estrellas de los últimos 7 días - #10
🦀 Procesamiento de secuencias de eventos para que los desarrolladores recopilen y transformen datos en movimiento para impulsar aplicaciones reactivas e intensivas en datos.
★ 5249+4Variación de estrellas de los últimos 7 días - #11
Jitsu es una alternativa de código abierto a Segment. Motor de ingesta de datos totalmente programable para equipos de datos modernos. Configura una canalización de datos en tiempo real en minutos, no en días
★ 5056+18Variación de estrellas de los últimos 7 días - #12★ 5017+6Variación de estrellas de los últimos 7 días
- #13
Alternativa a Segment enfocada en la privacidad y seguridad, desarrollada en Golang y React
★ 4479+4Variación de estrellas de los últimos 7 días - #14★ 4100+1Variación de estrellas de los últimos 7 días
- #15
ingestr es una herramienta de CLI para copiar datos entre cualquier base de datos sin problemas con un solo comando.
★ 3917+61Variación de estrellas de los últimos 7 días - #16
Lista curada por la comunidad de paquetes de software y recursos de datos para single-cell, incluyendo RNA-seq, ATAC-seq, etc.
★ 3841+6Variación de estrellas de los últimos 7 días - #17
Apache DevLake es una plataforma de datos de desarrollo de código abierto para ingerir, analizar y visualizar datos fragmentados de herramientas de DevOps, extrayendo información para la excelencia en ingeniería, la experiencia del desarrollador y el crecimiento de la comunidad.
★ 3116+10Variación de estrellas de los últimos 7 días - #18
superglue (YC W25) crea integraciones y herramientas a partir de lenguaje natural. Obtén herramientas de nivel de producción para sistemas empresariales y de cola larga.
★ 2055+3Variación de estrellas de los últimos 7 días - #19★ 1450+3Variación de estrellas de los últimos 7 días
- #20
Una herramienta ETL rápida y versátil que puede transferir datos entre RDBMS y NoSQL sin problemas
★ 1427+2Variación de estrellas de los últimos 7 días - #21
ETL/ELT de código abierto para desplegar en servidores propios o en la nube. Construido sobre DuckDB: pipelines visuales sin código/bajo código o SQL, 385 componentes, dbt, CDC, calidad de datos, ETL inverso, linaje y MCP para agentes de IA. Sin nube de proveedores ni facturación por fila.
★ 1250+54Variación de estrellas de los últimos 7 días - #22
Tutoriales y artículos detallados sobre grafos de conocimiento
★ 1070+1Variación de estrellas de los últimos 7 días - #23
🌊 Sincroniza continuamente los sistemas donde residen tus datos con los sistemas donde _quieres_ que residan, gestionando tus flujos de datos con Estuary. 🌊
★ 965+2Variación de estrellas de los últimos 7 días - #24
SeaTunnel es una plataforma de integración de datos distribuida y de alto rendimiento para la sincronización y transformación de datos masivos (offline y en tiempo real)
★ 873+2Variación de estrellas de los últimos 7 días - #25
Lista de artículos actualizada continuamente sobre avances en Agentes de Datos. Repositorio complementario a nuestro artículo "Una encuesta sobre Agentes de Datos: ¿Paradigma emergente o exageración excesiva?"
★ 721+14Variación de estrellas de los últimos 7 días - #26
NicheNet: predice enlaces activos ligando-objetivo entre células que interactúan.
★ 674+0Variación de estrellas de los últimos 7 días - #27
Integración rápida, sensible y precisa de datos de células individuales con Harmony.
★ 670+3Variación de estrellas de los últimos 7 días - #28
Conduit transmite datos entre almacenes de datos. Reemplazo de Kafka Connect. No requiere JVM.
★ 608+2Variación de estrellas de los últimos 7 días - #29
Una lista curada de herramientas de código abierto utilizadas en plataformas de análisis y en el ecosistema de ingeniería de datos
★ 600+0Variación de estrellas de los últimos 7 días - #30
Recopilación de recursos relacionados con Apache Hudi.
★ 556+0Variación de estrellas de los últimos 7 días