Aller au contenu principal
buildradar
Sign in
Sujet · hadoop

hadoop

Dépôts open source suivis étiquetés hadoop, triés par étoiles.

Dépôts
40
Total d'étoiles
230 812
Étoiles en moyenne
5 770
Part
0,01%

Sujets qui apparaissent souvent aux côtés de hadoop sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés hadoop.

Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.

  • Notebooks Python pour la science des données : Deep learning (TensorFlow, Theano, Caffe, Keras), scikit-learn, Kaggle, big data (Spark, Hadoop MapReduce, HDFS), matplotlib, pandas, NumPy, SciPy, fondamentaux de Python, AWS et diverses lignes de commande.

    29 339+5Évolution des étoiles sur les 7 derniers jours
  • luigi@spotify

    Luigi est un module Python qui aide à construire des pipelines complexes de tâches par lots. Il gère la résolution des dépendances, la gestion des flux de travail, la visualisation, etc. Il inclut également un support natif pour Hadoop.

    18 767-1Évolution des étoiles sur les 7 derniers jours
  • APIJSON@Tencent

    ORM temps réel no-code, puissant et sécurisé, fournissant des API et de la documentation sans codage côté backend, permettant au frontend de personnaliser les réponses JSON.

    18 406+4Évolution des étoiles sur les 7 derniers jours
  • BigData-Notes@heibaiying

    Guide d'introduction au Big Data :star:

    16 962+4Évolution des étoiles sur les 7 derniers jours
  • presto@prestodb

    Le site officiel du moteur de requête SQL distribué Presto pour le Big Data.

    16 730+5Évolution des étoiles sur les 7 derniers jours
  • hadoop@apache

    Apache Hadoop.

    15 647+8Évolution des étoiles sur les 7 derniers jours
  • deeplearning4j@deeplearning4j

    Suite d'outils pour le déploiement et l'entraînement de modèles de deep learning utilisant la JVM. Les points forts incluent l'importation de modèles pour Keras, TensorFlow et ONNX/PyTorch, une bibliothèque C++ modulaire et légère pour l'exécution de calculs mathématiques, ainsi qu'une bibliothèque Java basée sur ce cœur C++. Inclut également SameDiff : une bibliothèque de type PyTorch/TensorFlow pour l'exécution de deep learning.

    14 248+0Évolution des étoiles sur les 7 derniers jours
  • trino@trinodb

    Dépôt officiel de Trino, le moteur de requête SQL distribué pour le big data, anciennement connu sous le nom de PrestoSQL (https://trino.io).

    13 200+6Évolution des étoiles sur les 7 derniers jours
  • DevOps-Bash-tools@HariSekhon

    Plus de 1200 scripts Bash DevOps : AWS, GCP, Kubernetes, Docker, CI/CD, API, SQL, PostgreSQL, MySQL, Hive, Impala, Kafka, Hadoop, Jenkins, GitHub, GitLab, BitBucket, Azure DevOps, TeamCity, Spotify, MP3, LDAP, linting de code, gestion de paquets pour Linux, Mac, Python, Perl, Ruby, NodeJS, Golang, et fichiers de configuration avancés.

    8 393+1Évolution des étoiles sur les 7 derniers jours
  • school-of-sre@linkedin

    Programme utilisé par LinkedIn pour l'intégration des nouveaux talents au poste de SRE.

    8 141+4Évolution des étoiles sur les 7 derniers jours
  • h2o-3@h2oai

    H2O est une plateforme d'apprentissage automatique open source, distribuée, rapide et évolutive : Deep Learning, Gradient Boosting (GBM) & XGBoost, Random Forest, modélisation linéaire généralisée (GLM avec Elastic Net), K-Means, PCA, modèles additifs généralisés (GAM), RuleFit, machines à vecteurs de support (SVM), Stacked Ensembles, apprentissage automatique automatique (AutoML), etc.

    7 499+3Évolution des étoiles sur les 7 derniers jours
  • alluxio@Alluxio

    Alluxio, orchestration de données pour l'analytique et l'apprentissage automatique dans le cloud.

    7 234+3Évolution des étoiles sur les 7 derniers jours
  • hive@apache

    Apache Hive

    6 016+1Évolution des étoiles sur les 7 derniers jours
  • calcite@apache

    Apache Calcite

    5 180+2Évolution des étoiles sur les 7 derniers jours
  • ignite@apache

    Apache Ignite

    5 082+2Évolution des étoiles sur les 7 derniers jours
  • nutch@apache

    Apache Nutch est un robot d'indexation web extensible et évolutif

    3 283+4Évolution des étoiles sur les 7 derniers jours
  • DataSphereStudio@WeBankFinTech

    DataSphereStudio est un portail complet de développement et de gestion d'applications de données, couvrant l'échange de données, le nettoyage, l'analyse, l'exploration, la mesure de qualité, la visualisation et la planification des tâches.

    3 262-1Évolution des étoiles sur les 7 derniers jours
  • BigDataGuide@MoRan1607

    Apprentissage du Big Data, de zéro, incluant des vidéos de formation et des ressources pour les entretiens à chaque étape.

    3 224+5Évolution des étoiles sur les 7 derniers jours
  • SZT-bigdata@geekyouth

    Système d'analyse des flux de passagers par mégadonnées du métro de Shenzhen 🚇🚄🌟

    2 475+1Évolution des étoiles sur les 7 derniers jours
  • kyuubi@apache

    Apache Kyuubi est une passerelle distribuée et multi-tenant fournissant du SQL serverless sur des data warehouses et des lakehouses.

    2 364+1Évolution des étoiles sur les 7 derniers jours
  • docker-hadoop@big-data-europe

    Image Docker pour Apache Hadoop

    2 325-1Évolution des étoiles sur les 7 derniers jours
  • winutils@cdarlint

    Binaires winutils.exe, hadoop.dll et hdfs.dll pour Hadoop sur Windows.

    2 291+4Évolution des étoiles sur les 7 derniers jours
  • drill@apache

    Apache Drill est une couche de requête MPP distribuée pour les données auto-descriptives

    2 022+0Évolution des étoiles sur les 7 derniers jours
  • bigdata-growth@collabH

    Dépôt de connaissances sur le Big Data couvrant la modélisation d'entrepôts de données, le calcul en temps réel, le Big Data, les plateformes de données, la conception de systèmes, Java et les algorithmes.

    1 811+3Évolution des étoiles sur les 7 derniers jours
  • hbox@Qihoo360

    IA sur Hadoop.

    1 728+0Évolution des étoiles sur les 7 derniers jours
  • Plus de 2000 questions d'entretien pour ingénieurs de données

    1 721+5Évolution des étoiles sur les 7 derniers jours
  • carbondata@apache

    Solution de stockage de données haute performance

    1 452+0Évolution des étoiles sur les 7 derniers jours
  • Addax@wgzhao

    Un outil ETL rapide et polyvalent capable de transférer des données de manière transparente entre RDBMS et NoSQL

    1 430+3Évolution des étoiles sur les 7 derniers jours
  • Dockerfiles@HariSekhon

    Plus de 50 images DockerHub publiques pour Docker et Kubernetes - DevOps, CI/CD, GitHub Actions, CircleCI, Jenkins, TeamCity, Alpine, CentOS, Debian, Fedora, Ubuntu, Hadoop, Kafka, ZooKeeper, HBase, Cassandra, Solr, SolrCloud, Presto, Apache Drill, Nifi, Spark, Consul, Riak.

    1 379+0Évolution des étoiles sur les 7 derniers jours
  • Taier@DTStack

    Taier est une plateforme de développement Big Data dédiée à la soumission, la planification, l'exploitation, la maintenance et l'affichage d'indicateurs.

    1 284+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets