Pular para o conteúdo principal
buildradar
Sign in
Tópico · bigdata

bigdata

Repositórios de código aberto acompanhados marcados com bigdata, ordenados por estrelas.

Repositórios
48
Total de estrelas
252.531
Média de estrelas
5.261
Participação
0,01%

Tópicos que aparecem com frequência ao lado de bigdata no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com bigdata.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • data-engineer-handbook@DataExpert-io

    Este é um repositório com links para tudo o que você gostaria de aprender sobre engenharia de dados

    43.905+88Variação de estrelas nos últimos 7 dias
  • rustfs@rustfs

    🚀 2,3x mais rápido que o MinIO para payloads de objetos de 4KB. O RustFS é um sistema de armazenamento de objetos de alto desempenho compatível com S3, de código aberto, que suporta migração e coexistência com outras plataformas compatíveis com S3, como MinIO e Ceph.

    31.528+238Variação de estrelas nos últimos 7 dias
  • TDengine@taosdata

    Banco de dados de séries temporais de alto desempenho e escalável, projetado para cenários de IoT Industrial (IIoT).

    25.093+15Variação de estrelas nos últimos 7 dias
  • Capacitando a inteligência de dados com SQL distribuído para fragmentação, escalabilidade e segurança em todos os bancos de dados.

    20.791+10Variação de estrelas nos últimos 7 dias
  • BigData-Notes@heibaiying

    Guia introdutório de Big Data :star:

    16.958+6Variação de estrelas nos últimos 7 dias
  • Uma lista curada de frameworks de big data, recursos e outras coisas incríveis.

    14.601+63Variação de estrelas nos últimos 7 dias
  • juicefs@juicedata

    JuiceFS é um sistema de arquivos POSIX distribuído construído sobre Redis e S3.

    14.371+19Variação de estrelas nos últimos 7 dias
  • databend@databendlabs

    Data Agent Ready Warehouse: Uma solução para Analytics, Busca, IA e Sandbox Python, reconstruída do zero. Arquitetura unificada sobre seu S3.

    9.426+3Variação de estrelas nos últimos 7 dias
  • vaex@vaexio

    DataFrame híbrido Out-of-Core Apache Arrow/NumPy para Python, ML, visualização e exploração de grandes dados tabulares a um bilhão de linhas por segundo 🚀

    8.509+1Variação de estrelas nos últimos 7 dias
  • hudi@apache

    Upserts, exclusões e processamento incremental em Big Data.

    6.227+12Variação de estrelas nos últimos 7 dias
  • volcano@volcano-sh

    Um sistema de processamento em lote nativo da nuvem (Projeto sob a CNCF)

    5.907+30Variação de estrelas nos últimos 7 dias
  • BigDataView@iGaoWei

    Mais de 100 modelos HTML5 de visualização de big data; inclui setores como comunidade, gestão predial, governo, transporte, bancos e finanças. Os modelos mais recentes, completos e modernos da web, com atualizações contínuas.

    5.298+21Variação de estrelas nos últimos 7 dias
  • chunjun@DTStack

    Um framework de integração de dados

    4.100+1Variação de estrelas nos últimos 7 dias
  • Use JSON para gerar instruções SQL estruturadas, implementado com Vue3 + TypeScript + Vite + Ant Design + MonacoEditor. Projeto simples (focado em lógica, leve em interface), ideal para prática.

    3.424-3Variação de estrelas nos últimos 7 dias
  • avro@apache

    Apache Avro é um sistema de serialização de dados.

    3.301+3Variação de estrelas nos últimos 7 dias
  • BigDataGuide@MoRan1607

    Aprendizado de Big Data do zero, incluindo vídeos de treinamento, materiais de entrevista e guias de estudo para cada etapa.

    3.219+9Variação de estrelas nos últimos 7 dias
  • griddb@griddb

    GridDB é um banco de dados open source de próxima geração que torna o IoT de séries temporais e big data rápidos e fáceis.

    2.475+0Variação de estrelas nos últimos 7 dias
  • Aix-DB@apconw

    Aix-DB utiliza a estrutura LangChain/LangGraph, combinada com a arquitetura de colaboração multiagente MCP Skills, para realizar a conversão de linguagem natural em insights de dados de ponta a ponta.

    2.237+10Variação de estrelas nos últimos 7 dias
  • spark@dotnet

    .NET for Apache® Spark™ torna o Apache Spark™ facilmente acessível para desenvolvedores .NET.

    2.097+0Variação de estrelas nos últimos 7 dias
  • flinkStreamSQL@DTStack

    Extensão para SQL em tempo real baseada no Flink open source; implementa principalmente join entre streams e tabelas de dimensão, suportando toda a sintaxe nativa do Flink SQL.

    2.051+0Variação de estrelas nos últimos 7 dias
  • byzer-lang@byzer-org

    Byzer (anteriormente MLSQL): Uma linguagem de programação open-source de baixo código para pipelines de dados, análise e IA.

    1.835-1Variação de estrelas nos últimos 7 dias
  • bigdata-growth@collabH

    Repositório de conhecimento de Big Data abrangendo modelagem de data warehouse, computação em tempo real, Big Data, data middle platform, design de sistemas, Java, algoritmos, etc.

    1.808+3Variação de estrelas nos últimos 7 dias
  • genie@Netflix

    Serviço distribuído de orquestração de Big Data

    1.767+0Variação de estrelas nos últimos 7 dias
  • AutoCrawler@YoongiKim

    Web crawler de imagens multiprocessado para Google e Naver (Selenium)

    1.691-1Variação de estrelas nos últimos 7 dias
  • spark-py-notebooks@jadianes

    Tutoriais de Apache Spark e Python (pySpark) para análise de Big Data e Machine Learning em notebooks IPython / Jupyter

    1.660+1Variação de estrelas nos últimos 7 dias
  • optimus@hi-primus

    Fluxos de trabalho de preparação de dados ágeis facilitados com Pandas, Dask, cuDF, Dask-cuDF, Vaex e PySpark

    1.536+0Variação de estrelas nos últimos 7 dias
  • odd-platform@opendatadiscovery

    Primeira plataforma de descoberta e observabilidade de dados de código aberto. Facilitamos a vida dos profissionais de dados para que possam focar no seu negócio.

    1.426+2Variação de estrelas nos últimos 7 dias
  • celeborn@apache

    Apache Celeborn é um serviço elástico e de alto desempenho para dados de shuffle e spilled.

    1.061-1Variação de estrelas nos últimos 7 dias
  • cds@zeromicro

    Sincronização de dados em golang para ClickHouse.

    979+0Variação de estrelas nos últimos 7 dias
  • livy@apache

    Apache Livy é uma interface REST de código aberto para interagir com o Apache Spark de qualquer lugar.

    960+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos