Pular para o conteúdo principal
buildradar
Sign in
Tópico · hadoop

hadoop

Repositórios de código aberto acompanhados marcados com hadoop, ordenados por estrelas.

Repositórios
40
Total de estrelas
230.812
Média de estrelas
5.770
Participação
0,01%

Tópicos que aparecem com frequência ao lado de hadoop no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com hadoop.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • Notebooks Python de ciência de dados: Deep learning (TensorFlow, Theano, Caffe, Keras), scikit-learn, Kaggle, big data (Spark, Hadoop MapReduce, HDFS), matplotlib, pandas, NumPy, SciPy, essenciais de Python, AWS e várias linhas de comando.

    29.339+5Variação de estrelas nos últimos 7 dias
  • luigi@spotify

    Luigi é um módulo Python que ajuda a construir pipelines complexos de tarefas em lote. Ele lida com resolução de dependências, gerenciamento de fluxo de trabalho, visualização, etc. Também inclui suporte integrado para Hadoop.

    18.767-1Variação de estrelas nos últimos 7 dias
  • APIJSON@Tencent

    🏆 ORM em tempo real, sem código, poderoso e seguro 🚀 fornecendo APIs e documentação sem codificação no backend, permitindo que o frontend (cliente) personalize os JSONs de resposta

    18.406+4Variação de estrelas nos últimos 7 dias
  • BigData-Notes@heibaiying

    Guia introdutório de Big Data :star:

    16.962+4Variação de estrelas nos últimos 7 dias
  • presto@prestodb

    A página oficial da engine de consulta SQL distribuída Presto para big data

    16.730+5Variação de estrelas nos últimos 7 dias
  • hadoop@apache

    Apache Hadoop

    15.647+8Variação de estrelas nos últimos 7 dias
  • deeplearning4j@deeplearning4j

    Conjunto de ferramentas para implantar e treinar modelos de deep learning usando a JVM. Os destaques incluem importação de modelos para Keras, TensorFlow e ONNX/PyTorch, uma biblioteca C++ modular e compacta para executar código matemático e uma biblioteca matemática baseada em Java sobre o núcleo C++. Também inclui o SameDiff: uma biblioteca estilo PyTorch/TensorFlow para executar deep learning.

    14.248+0Variação de estrelas nos últimos 7 dias
  • trino@trinodb

    Repositório oficial do Trino, o motor de consulta SQL distribuído para big data, anteriormente conhecido como PrestoSQL (https://trino.io)

    13.200+6Variação de estrelas nos últimos 7 dias
  • DevOps-Bash-tools@HariSekhon

    Mais de 1200 scripts Bash para DevOps: AWS, GCP, Kubernetes, Docker, CI/CD, APIs, SQL, PostgreSQL, MySQL, Hive, Impala, Kafka, Hadoop, Jenkins, GitHub, GitLab, BitBucket, Azure DevOps, TeamCity, Spotify, MP3, LDAP, linting de código/build, gerenciamento de pacotes para Linux, Mac, Python, Perl, Ruby, NodeJS, Golang e dotfiles avançados (.bashrc, .vimrc, .gitconfig, .screenrc, tmux).

    8.393+1Variação de estrelas nos últimos 7 dias
  • school-of-sre@linkedin

    No LinkedIn, usamos este currículo para integrar nossos talentos iniciantes na função de SRE.

    8.141+4Variação de estrelas nos últimos 7 dias
  • h2o-3@h2oai

    H2O é uma plataforma de aprendizado de máquina de código aberto, distribuída, rápida e escalável: Deep Learning, Gradient Boosting (GBM) & XGBoost, Random Forest, Generalized Linear Modeling (GLM com Elastic Net), K-Means, PCA, Generalized Additive Models (GAM), RuleFit, Support Vector Machine (SVM), Stacked Ensembles, Automatic Machine Learning (AutoML), etc.

    7.499+3Variação de estrelas nos últimos 7 dias
  • alluxio@Alluxio

    Alluxio, orquestração de dados para análise e aprendizado de máquina na nuvem

    7.234+3Variação de estrelas nos últimos 7 dias
  • hive@apache

    Apache Hive

    6.016+1Variação de estrelas nos últimos 7 dias
  • calcite@apache

    Apache Calcite

    5.180+2Variação de estrelas nos últimos 7 dias
  • ignite@apache

    Apache Ignite

    5.082+2Variação de estrelas nos últimos 7 dias
  • nutch@apache

    Apache Nutch é um web crawler extensível e escalável

    3.283+4Variação de estrelas nos últimos 7 dias
  • DataSphereStudio@WeBankFinTech

    DataSphereStudio é um portal de desenvolvimento e gerenciamento de aplicações de dados completo, cobrindo cenários como troca de dados, dessensibilização/limpeza, análise/mineração, medição de qualidade, visualização e agendamento de tarefas.

    3.262-1Variação de estrelas nos últimos 7 dias
  • BigDataGuide@MoRan1607

    Aprendizado de Big Data do zero, incluindo vídeos de treinamento, materiais de entrevista e guias de estudo para cada etapa.

    3.224+5Variação de estrelas nos últimos 7 dias
  • SZT-bigdata@geekyouth

    Sistema de análise de big data de fluxo de passageiros do metrô de Shenzhen 🚇🚄🌟

    2.475+1Variação de estrelas nos últimos 7 dias
  • kyuubi@apache

    O Apache Kyuubi é um gateway distribuído e multi-tenant que fornece SQL serverless em data warehouses e lakehouses.

    2.364+1Variação de estrelas nos últimos 7 dias
  • docker-hadoop@big-data-europe

    Imagem Docker do Apache Hadoop

    2.325-1Variação de estrelas nos últimos 7 dias
  • winutils@cdarlint

    Binários winutils.exe, hadoop.dll e hdfs.dll para Hadoop no Windows

    2.291+4Variação de estrelas nos últimos 7 dias
  • drill@apache

    Apache Drill é uma camada de consulta MPP distribuída para dados autodescritivos.

    2.022+0Variação de estrelas nos últimos 7 dias
  • bigdata-growth@collabH

    Repositório de conhecimento de Big Data abrangendo modelagem de data warehouse, computação em tempo real, Big Data, data middle platform, design de sistemas, Java, algoritmos, etc.

    1.811+3Variação de estrelas nos últimos 7 dias
  • hbox@Qihoo360

    IA no Hadoop

    1.728+0Variação de estrelas nos últimos 7 dias
  • Mais de 2000 perguntas de entrevista para engenheiros de dados.

    1.721+5Variação de estrelas nos últimos 7 dias
  • carbondata@apache

    Solução de armazenamento de dados de alto desempenho.

    1.452+0Variação de estrelas nos últimos 7 dias
  • Addax@wgzhao

    Uma ferramenta de ETL rápida e versátil que pode transferir dados entre RDBMS e NoSQL de forma integrada

    1.430+3Variação de estrelas nos últimos 7 dias
  • Dockerfiles@HariSekhon

    Mais de 50 imagens públicas do DockerHub para Docker e Kubernetes - DevOps, CI/CD, GitHub Actions, CircleCI, Jenkins, TeamCity, Alpine, CentOS, Debian, Fedora, Ubuntu, Hadoop, Kafka, ZooKeeper, HBase, Cassandra, Solr, SolrCloud, Presto, Apache Drill, Nifi, Spark, Consul, Riak

    1.379+0Variação de estrelas nos últimos 7 dias
  • Taier@DTStack

    Taier é uma plataforma de desenvolvimento de big data para submissão, agendamento, operação, manutenção e exibição de informações de indicadores.

    1.284+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos