bigdata
Repositórios de código aberto acompanhados marcados com bigdata, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de bigdata no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com bigdata.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Este é um repositório com links para tudo o que você gostaria de aprender sobre engenharia de dados
★ 43.905+88Variação de estrelas nos últimos 7 dias - #2
🚀 2,3x mais rápido que o MinIO para payloads de objetos de 4KB. O RustFS é um sistema de armazenamento de objetos de alto desempenho compatível com S3, de código aberto, que suporta migração e coexistência com outras plataformas compatíveis com S3, como MinIO e Ceph.
★ 31.528+238Variação de estrelas nos últimos 7 dias - #3
Banco de dados de séries temporais de alto desempenho e escalável, projetado para cenários de IoT Industrial (IIoT).
★ 25.093+15Variação de estrelas nos últimos 7 dias - #4
Capacitando a inteligência de dados com SQL distribuído para fragmentação, escalabilidade e segurança em todos os bancos de dados.
★ 20.791+10Variação de estrelas nos últimos 7 dias - #5
Guia introdutório de Big Data :star:
★ 16.958+6Variação de estrelas nos últimos 7 dias - #6
Uma lista curada de frameworks de big data, recursos e outras coisas incríveis.
★ 14.601+63Variação de estrelas nos últimos 7 dias - #7★ 14.371+19Variação de estrelas nos últimos 7 dias
- #8
Data Agent Ready Warehouse: Uma solução para Analytics, Busca, IA e Sandbox Python, reconstruída do zero. Arquitetura unificada sobre seu S3.
★ 9.426+3Variação de estrelas nos últimos 7 dias - #9
DataFrame híbrido Out-of-Core Apache Arrow/NumPy para Python, ML, visualização e exploração de grandes dados tabulares a um bilhão de linhas por segundo 🚀
★ 8.509+1Variação de estrelas nos últimos 7 dias - #10★ 6.227+12Variação de estrelas nos últimos 7 dias
- #11★ 5.907+30Variação de estrelas nos últimos 7 dias
- #12
Mais de 100 modelos HTML5 de visualização de big data; inclui setores como comunidade, gestão predial, governo, transporte, bancos e finanças. Os modelos mais recentes, completos e modernos da web, com atualizações contínuas.
★ 5.298+21Variação de estrelas nos últimos 7 dias - #13★ 4.100+1Variação de estrelas nos últimos 7 dias
- #14
Use JSON para gerar instruções SQL estruturadas, implementado com Vue3 + TypeScript + Vite + Ant Design + MonacoEditor. Projeto simples (focado em lógica, leve em interface), ideal para prática.
★ 3.424-3Variação de estrelas nos últimos 7 dias - #15★ 3.301+3Variação de estrelas nos últimos 7 dias
- #16
Aprendizado de Big Data do zero, incluindo vídeos de treinamento, materiais de entrevista e guias de estudo para cada etapa.
★ 3.219+9Variação de estrelas nos últimos 7 dias - #17
GridDB é um banco de dados open source de próxima geração que torna o IoT de séries temporais e big data rápidos e fáceis.
★ 2.475+0Variação de estrelas nos últimos 7 dias - #18
Aix-DB utiliza a estrutura LangChain/LangGraph, combinada com a arquitetura de colaboração multiagente MCP Skills, para realizar a conversão de linguagem natural em insights de dados de ponta a ponta.
★ 2.237+10Variação de estrelas nos últimos 7 dias - #19
.NET for Apache® Spark™ torna o Apache Spark™ facilmente acessível para desenvolvedores .NET.
★ 2.097+0Variação de estrelas nos últimos 7 dias - #20
Extensão para SQL em tempo real baseada no Flink open source; implementa principalmente join entre streams e tabelas de dimensão, suportando toda a sintaxe nativa do Flink SQL.
★ 2.051+0Variação de estrelas nos últimos 7 dias - #21
Byzer (anteriormente MLSQL): Uma linguagem de programação open-source de baixo código para pipelines de dados, análise e IA.
★ 1.835-1Variação de estrelas nos últimos 7 dias - #22
Repositório de conhecimento de Big Data abrangendo modelagem de data warehouse, computação em tempo real, Big Data, data middle platform, design de sistemas, Java, algoritmos, etc.
★ 1.808+3Variação de estrelas nos últimos 7 dias - #23★ 1.767+0Variação de estrelas nos últimos 7 dias
- #24
Web crawler de imagens multiprocessado para Google e Naver (Selenium)
★ 1.691-1Variação de estrelas nos últimos 7 dias - #25
Tutoriais de Apache Spark e Python (pySpark) para análise de Big Data e Machine Learning em notebooks IPython / Jupyter
★ 1.660+1Variação de estrelas nos últimos 7 dias - #26
Fluxos de trabalho de preparação de dados ágeis facilitados com Pandas, Dask, cuDF, Dask-cuDF, Vaex e PySpark
★ 1.536+0Variação de estrelas nos últimos 7 dias - #27
Primeira plataforma de descoberta e observabilidade de dados de código aberto. Facilitamos a vida dos profissionais de dados para que possam focar no seu negócio.
★ 1.426+2Variação de estrelas nos últimos 7 dias - #28
Apache Celeborn é um serviço elástico e de alto desempenho para dados de shuffle e spilled.
★ 1.061-1Variação de estrelas nos últimos 7 dias - #29★ 979+0Variação de estrelas nos últimos 7 dias
- #30
Apache Livy é uma interface REST de código aberto para interagir com o Apache Spark de qualquer lugar.
★ 960+0Variação de estrelas nos últimos 7 dias