hadoop
Repositórios de código aberto acompanhados marcados com hadoop, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de hadoop no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com hadoop.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Notebooks Python de ciência de dados: Deep learning (TensorFlow, Theano, Caffe, Keras), scikit-learn, Kaggle, big data (Spark, Hadoop MapReduce, HDFS), matplotlib, pandas, NumPy, SciPy, essenciais de Python, AWS e várias linhas de comando.
★ 29.339+5Variação de estrelas nos últimos 7 dias - #2
Luigi é um módulo Python que ajuda a construir pipelines complexos de tarefas em lote. Ele lida com resolução de dependências, gerenciamento de fluxo de trabalho, visualização, etc. Também inclui suporte integrado para Hadoop.
★ 18.767-1Variação de estrelas nos últimos 7 dias - #3
🏆 ORM em tempo real, sem código, poderoso e seguro 🚀 fornecendo APIs e documentação sem codificação no backend, permitindo que o frontend (cliente) personalize os JSONs de resposta
★ 18.406+4Variação de estrelas nos últimos 7 dias - #4
Guia introdutório de Big Data :star:
★ 16.962+4Variação de estrelas nos últimos 7 dias - #5★ 16.730+5Variação de estrelas nos últimos 7 dias
- #6★ 15.647+8Variação de estrelas nos últimos 7 dias
- #7
Conjunto de ferramentas para implantar e treinar modelos de deep learning usando a JVM. Os destaques incluem importação de modelos para Keras, TensorFlow e ONNX/PyTorch, uma biblioteca C++ modular e compacta para executar código matemático e uma biblioteca matemática baseada em Java sobre o núcleo C++. Também inclui o SameDiff: uma biblioteca estilo PyTorch/TensorFlow para executar deep learning.
★ 14.248+0Variação de estrelas nos últimos 7 dias - #8
Repositório oficial do Trino, o motor de consulta SQL distribuído para big data, anteriormente conhecido como PrestoSQL (https://trino.io)
★ 13.200+6Variação de estrelas nos últimos 7 dias - #9
Mais de 1200 scripts Bash para DevOps: AWS, GCP, Kubernetes, Docker, CI/CD, APIs, SQL, PostgreSQL, MySQL, Hive, Impala, Kafka, Hadoop, Jenkins, GitHub, GitLab, BitBucket, Azure DevOps, TeamCity, Spotify, MP3, LDAP, linting de código/build, gerenciamento de pacotes para Linux, Mac, Python, Perl, Ruby, NodeJS, Golang e dotfiles avançados (.bashrc, .vimrc, .gitconfig, .screenrc, tmux).
★ 8.393+1Variação de estrelas nos últimos 7 dias - #10
No LinkedIn, usamos este currículo para integrar nossos talentos iniciantes na função de SRE.
★ 8.141+4Variação de estrelas nos últimos 7 dias - #11
H2O é uma plataforma de aprendizado de máquina de código aberto, distribuída, rápida e escalável: Deep Learning, Gradient Boosting (GBM) & XGBoost, Random Forest, Generalized Linear Modeling (GLM com Elastic Net), K-Means, PCA, Generalized Additive Models (GAM), RuleFit, Support Vector Machine (SVM), Stacked Ensembles, Automatic Machine Learning (AutoML), etc.
★ 7.499+3Variação de estrelas nos últimos 7 dias - #12★ 7.234+3Variação de estrelas nos últimos 7 dias
- #13★ 6.016+1Variação de estrelas nos últimos 7 dias
- #14★ 5.180+2Variação de estrelas nos últimos 7 dias
- #15★ 5.082+2Variação de estrelas nos últimos 7 dias
- #16★ 3.283+4Variação de estrelas nos últimos 7 dias
- #17
DataSphereStudio é um portal de desenvolvimento e gerenciamento de aplicações de dados completo, cobrindo cenários como troca de dados, dessensibilização/limpeza, análise/mineração, medição de qualidade, visualização e agendamento de tarefas.
★ 3.262-1Variação de estrelas nos últimos 7 dias - #18
Aprendizado de Big Data do zero, incluindo vídeos de treinamento, materiais de entrevista e guias de estudo para cada etapa.
★ 3.224+5Variação de estrelas nos últimos 7 dias - #19
Sistema de análise de big data de fluxo de passageiros do metrô de Shenzhen 🚇🚄🌟
★ 2.475+1Variação de estrelas nos últimos 7 dias - #20
O Apache Kyuubi é um gateway distribuído e multi-tenant que fornece SQL serverless em data warehouses e lakehouses.
★ 2.364+1Variação de estrelas nos últimos 7 dias - #21
Imagem Docker do Apache Hadoop
★ 2.325-1Variação de estrelas nos últimos 7 dias - #22★ 2.291+4Variação de estrelas nos últimos 7 dias
- #23★ 2.022+0Variação de estrelas nos últimos 7 dias
- #24
Repositório de conhecimento de Big Data abrangendo modelagem de data warehouse, computação em tempo real, Big Data, data middle platform, design de sistemas, Java, algoritmos, etc.
★ 1.811+3Variação de estrelas nos últimos 7 dias - #25★ 1.728+0Variação de estrelas nos últimos 7 dias
- #26
Mais de 2000 perguntas de entrevista para engenheiros de dados.
★ 1.721+5Variação de estrelas nos últimos 7 dias - #27
Solução de armazenamento de dados de alto desempenho.
★ 1.452+0Variação de estrelas nos últimos 7 dias - #28
Uma ferramenta de ETL rápida e versátil que pode transferir dados entre RDBMS e NoSQL de forma integrada
★ 1.430+3Variação de estrelas nos últimos 7 dias - #29
Mais de 50 imagens públicas do DockerHub para Docker e Kubernetes - DevOps, CI/CD, GitHub Actions, CircleCI, Jenkins, TeamCity, Alpine, CentOS, Debian, Fedora, Ubuntu, Hadoop, Kafka, ZooKeeper, HBase, Cassandra, Solr, SolrCloud, Presto, Apache Drill, Nifi, Spark, Consul, Riak
★ 1.379+0Variação de estrelas nos últimos 7 dias - #30
Taier é uma plataforma de desenvolvimento de big data para submissão, agendamento, operação, manutenção e exibição de informações de indicadores.
★ 1.284+0Variação de estrelas nos últimos 7 dias