big-data
Repositórios de código aberto acompanhados marcados com big-data, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de big-data no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com big-data.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Os padrões de sistemas de grande escala escaláveis, confiáveis e de alto desempenho
★ 73.681+79Variação de estrelas nos últimos 7 dias - #2
ClickHouse® é um sistema de gerenciamento de banco de dados analítico em tempo real
★ 49.619+96Variação de estrelas nos últimos 7 dias - #3
Apache Spark - Um mecanismo de análise unificado para processamento de dados em larga escala
★ 43.943+42Variação de estrelas nos últimos 7 dias - #4
Notebooks Python de ciência de dados: Deep learning (TensorFlow, Theano, Caffe, Keras), scikit-learn, Kaggle, big data (Spark, Hadoop MapReduce, HDFS), matplotlib, pandas, NumPy, SciPy, essenciais de Python, AWS e várias linhas de comando.
★ 29.339+5Variação de estrelas nos últimos 7 dias - #5★ 26.324+22Variação de estrelas nos últimos 7 dias
- #6
Plataforma IoT de código aberto - Gerenciamento de dispositivos, coleta, processamento e visualização de dados.
★ 22.355+28Variação de estrelas nos últimos 7 dias - #7
Um protocolo de segurança cibernética de código aberto para sincronizar dados de grafos descentralizados.
★ 19.129+1Variação de estrelas nos últimos 7 dias - #8
Guia introdutório de Big Data :star:
★ 16.962+4Variação de estrelas nos últimos 7 dias - #9★ 16.730+5Variação de estrelas nos últimos 7 dias
- #10★ 15.397+14Variação de estrelas nos últimos 7 dias
- #11
Repositório oficial do Trino, o motor de consulta SQL distribuído para big data, anteriormente conhecido como PrestoSQL (https://trino.io)
★ 13.200+6Variação de estrelas nos últimos 7 dias - #12
Um banco de dados de grafos distribuído e rápido de código aberto, apresentando escalabilidade horizontal e alta disponibilidade
★ 12.372+5Variação de estrelas nos últimos 7 dias - #13★ 12.278+6Variação de estrelas nos últimos 7 dias
- #14
O mecanismo de consulta aberta mais rápido do mundo para análises de sub-segundo, tanto dentro quanto fora do data lakehouse. Com a flexibilidade para suportar quase qualquer cenário, o StarRocks oferece desempenho de primeira classe para análises multidimensionais, análises em tempo real e consultas ad-hoc. Um projeto da Linux Foundation.
★ 12.071+14Variação de estrelas nos últimos 7 dias - #15★ 11.563+7Variação de estrelas nos últimos 7 dias
- #16★ 10.842+6Variação de estrelas nos últimos 7 dias
- #17
Mecanismo de consulta SQL Apache DataFusion.
★ 9.267+19Variação de estrelas nos últimos 7 dias - #18
Uma biblioteca de Gradient Boosting on Decision Trees rápida, escalável e de alto desempenho, usada para classificação, regressão, ranking e outras tarefas de aprendizado de máquina para Python, R, Java e C++. Suporta computação em CPU e GPU.
★ 9.086+1Variação de estrelas nos últimos 7 dias - #19
Um framework de armazenamento de código aberto que permite construir uma arquitetura Lakehouse com motores de computação como Spark, PrestoDB, Flink, Trino, Hive e APIs
★ 8.984+22Variação de estrelas nos últimos 7 dias - #20
Apache Beam é um modelo de programação unificado para processamento de dados em lote e em tempo real (streaming).
★ 8.658+5Variação de estrelas nos últimos 7 dias - #21
H2O é uma plataforma de aprendizado de máquina de código aberto, distribuída, rápida e escalável: Deep Learning, Gradient Boosting (GBM) & XGBoost, Random Forest, Generalized Linear Modeling (GLM com Elastic Net), K-Means, PCA, Generalized Additive Models (GAM), RuleFit, Support Vector Machine (SVM), Stacked Ensembles, Automatic Machine Learning (AutoML), etc.
★ 7.499+3Variação de estrelas nos últimos 7 dias - #22
Arkime é um sistema de código aberto para captura, indexação e banco de dados de pacotes completos em larga escala.
★ 7.461+1Variação de estrelas nos últimos 7 dias - #23★ 7.244+5Variação de estrelas nos últimos 7 dias
- #24★ 7.075+3Variação de estrelas nos últimos 7 dias
- #25
Banco de dados de sincronização multi-primário contínua com uma API HTTP/JSON intuitiva, projetado para confiabilidade
★ 6.944+0Variação de estrelas nos últimos 7 dias - #26
Notebook baseado na web que permite análise de dados interativa e orientada a dados, além de documentos colaborativos com SQL, Scala e mais.
★ 6.655+0Variação de estrelas nos últimos 7 dias - #27
Hazelcast é uma plataforma de dados em tempo real unificada que combina processamento de fluxo com armazenamento de dados rápido, permitindo que clientes ajam instantaneamente sobre dados em movimento para obter insights em tempo real.
★ 6.606+2Variação de estrelas nos últimos 7 dias - #28★ 6.389+4Variação de estrelas nos últimos 7 dias
- #29★ 6.309+1Variação de estrelas nos últimos 7 dias
- #30★ 6.016+1Variação de estrelas nos últimos 7 dias