data-integration
Repositórios de código aberto acompanhados marcados com data-integration, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de data-integration no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com data-integration.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Apache Airflow - Uma plataforma para criar, agendar e monitorar fluxos de trabalho programaticamente
★ 46.638+64Variação de estrelas nos últimos 7 dias - #2
Movimentação de dados de código aberto para pipelines ELT e agentes de IA — de APIs, bancos de dados e arquivos para warehouses, lakes e aplicações de IA. Tanto auto-hospedado quanto em nuvem.
★ 21.972+34Variação de estrelas nos últimos 7 dias - #3
Transforma dados e algoritmos de IA em aplicações web prontas para produção em pouco tempo.
★ 19.436+6Variação de estrelas nos últimos 7 dias - #4
Uma plataforma de orquestração para o desenvolvimento, produção e observação de ativos de dados.
★ 16.073+26Variação de estrelas nos últimos 7 dias - #5
SeaTunnel é uma ferramenta de integração de dados massivos, distribuída, de alto desempenho e multimodal.
★ 9.600+30Variação de estrelas nos últimos 7 dias - #6★ 8.814+5Variação de estrelas nos últimos 7 dias
- #7
Pipelines de dados para configurações de nuvem e dados de segurança. Construa soluções de inventário de ativos em nuvem, CSPM, FinOps e gerenciamento de vulnerabilidades. Extraia dados de AWS, Azure, GCP e mais de 70 fontes de nuvem e SaaS.
★ 6.503+14Variação de estrelas nos últimos 7 dias - #8★ 6.469+6Variação de estrelas nos últimos 7 dias
- #9★ 6.227+12Variação de estrelas nos últimos 7 dias
- #10
🦀 processamento de fluxo de eventos para desenvolvedores coletarem e transformarem dados em movimento para alimentar aplicações responsivas intensivas em dados.
★ 5.249+4Variação de estrelas nos últimos 7 dias - #11
Jitsu é uma alternativa de código aberto ao Segment. Mecanismo de ingestão de dados totalmente programável para equipes de dados modernas. Configure um pipeline de dados em tempo real em minutos, não em dias
★ 5.056+18Variação de estrelas nos últimos 7 dias - #12★ 5.017+6Variação de estrelas nos últimos 7 dias
- #13
Alternativa ao Segment focada em privacidade e segurança, escrita em Golang e React
★ 4.479+4Variação de estrelas nos últimos 7 dias - #14★ 4.100+1Variação de estrelas nos últimos 7 dias
- #15
ingestr é uma ferramenta CLI para copiar dados entre quaisquer bancos de dados com um único comando de forma integrada.
★ 3.917+61Variação de estrelas nos últimos 7 dias - #16
Lista com curadoria da comunidade de pacotes de software e recursos de dados para célula única, incluindo RNA-seq, ATAC-seq, etc.
★ 3.841+6Variação de estrelas nos últimos 7 dias - #17
Apache DevLake é uma plataforma de dados de desenvolvimento de código aberto para ingerir, analisar e visualizar dados fragmentados de ferramentas de DevOps, extraindo insights para excelência em engenharia, experiência do desenvolvedor e crescimento da comunidade.
★ 3.116+10Variação de estrelas nos últimos 7 dias - #18
A superglue (YC W25) cria integrações e ferramentas a partir de linguagem natural. Obtenha ferramentas de nível de produção para sistemas de cauda longa e corporativos.
★ 2.055+3Variação de estrelas nos últimos 7 dias - #19★ 1.450+3Variação de estrelas nos últimos 7 dias
- #20
Uma ferramenta de ETL rápida e versátil que pode transferir dados entre RDBMS e NoSQL de forma integrada
★ 1.427+2Variação de estrelas nos últimos 7 dias - #21
ETL/ELT open-source para implantar nos seus próprios servidores ou nuvem. Construído sobre DuckDB: pipelines visuais no-code/low-code ou SQL, 385 componentes, dbt, CDC, qualidade de dados, reverse ETL, linhagem e MCP para agentes de IA. Sem nuvem de fornecedor, sem cobrança por linha.
★ 1.250+54Variação de estrelas nos últimos 7 dias - #22
Tutoriais e artigos esclarecedores sobre Grafos de Conhecimento
★ 1.070+1Variação de estrelas nos últimos 7 dias - #23
🌊 Sincronize continuamente os sistemas onde seus dados residem com os sistemas onde você deseja que eles estejam, gerenciando seus fluxos de dados com o Estuary. 🌊
★ 965+2Variação de estrelas nos últimos 7 dias - #24
O SeaTunnel é uma plataforma de integração de dados distribuída de alto desempenho para sincronização e transformação de dados massivos (offline e tempo real).
★ 873+2Variação de estrelas nos últimos 7 dias - #25
Lista de artigos atualizada continuamente sobre avanços em Data Agents. Repositório complementar ao nosso artigo "A Survey of Data Agents: Emerging Paradigm or Overstated Hype?"
★ 721+14Variação de estrelas nos últimos 7 dias - #26
NicheNet: preveja ligações ativas entre ligante e alvo entre células que interagem
★ 674+0Variação de estrelas nos últimos 7 dias - #27★ 670+3Variação de estrelas nos últimos 7 dias
- #28
O Conduit transmite dados entre armazenamentos de dados. Um substituto para o Kafka Connect. Não requer JVM.
★ 608+2Variação de estrelas nos últimos 7 dias - #29
Uma lista curada de ferramentas de código aberto usadas em plataformas de análise e no ecossistema de engenharia de dados
★ 600+0Variação de estrelas nos últimos 7 dias - #30
Compilação de materiais relacionados ao Apache Hudi
★ 556+0Variação de estrelas nos últimos 7 dias