hadoop
Dépôts open source suivis étiquetés hadoop, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de hadoop sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés hadoop.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
Notebooks Python pour la science des données : Deep learning (TensorFlow, Theano, Caffe, Keras), scikit-learn, Kaggle, big data (Spark, Hadoop MapReduce, HDFS), matplotlib, pandas, NumPy, SciPy, fondamentaux de Python, AWS et diverses lignes de commande.
★ 29 339+5Évolution des étoiles sur les 7 derniers jours - #2
Luigi est un module Python qui aide à construire des pipelines complexes de tâches par lots. Il gère la résolution des dépendances, la gestion des flux de travail, la visualisation, etc. Il inclut également un support natif pour Hadoop.
★ 18 767-1Évolution des étoiles sur les 7 derniers jours - #3
ORM temps réel no-code, puissant et sécurisé, fournissant des API et de la documentation sans codage côté backend, permettant au frontend de personnaliser les réponses JSON.
★ 18 406+4Évolution des étoiles sur les 7 derniers jours - #4
Guide d'introduction au Big Data :star:
★ 16 962+4Évolution des étoiles sur les 7 derniers jours - #5★ 16 730+5Évolution des étoiles sur les 7 derniers jours
- #6★ 15 647+8Évolution des étoiles sur les 7 derniers jours
- #7
Suite d'outils pour le déploiement et l'entraînement de modèles de deep learning utilisant la JVM. Les points forts incluent l'importation de modèles pour Keras, TensorFlow et ONNX/PyTorch, une bibliothèque C++ modulaire et légère pour l'exécution de calculs mathématiques, ainsi qu'une bibliothèque Java basée sur ce cœur C++. Inclut également SameDiff : une bibliothèque de type PyTorch/TensorFlow pour l'exécution de deep learning.
★ 14 248+0Évolution des étoiles sur les 7 derniers jours - #8
Dépôt officiel de Trino, le moteur de requête SQL distribué pour le big data, anciennement connu sous le nom de PrestoSQL (https://trino.io).
★ 13 200+6Évolution des étoiles sur les 7 derniers jours - #9
Plus de 1200 scripts Bash DevOps : AWS, GCP, Kubernetes, Docker, CI/CD, API, SQL, PostgreSQL, MySQL, Hive, Impala, Kafka, Hadoop, Jenkins, GitHub, GitLab, BitBucket, Azure DevOps, TeamCity, Spotify, MP3, LDAP, linting de code, gestion de paquets pour Linux, Mac, Python, Perl, Ruby, NodeJS, Golang, et fichiers de configuration avancés.
★ 8 393+1Évolution des étoiles sur les 7 derniers jours - #10
Programme utilisé par LinkedIn pour l'intégration des nouveaux talents au poste de SRE.
★ 8 141+4Évolution des étoiles sur les 7 derniers jours - #11
H2O est une plateforme d'apprentissage automatique open source, distribuée, rapide et évolutive : Deep Learning, Gradient Boosting (GBM) & XGBoost, Random Forest, modélisation linéaire généralisée (GLM avec Elastic Net), K-Means, PCA, modèles additifs généralisés (GAM), RuleFit, machines à vecteurs de support (SVM), Stacked Ensembles, apprentissage automatique automatique (AutoML), etc.
★ 7 499+3Évolution des étoiles sur les 7 derniers jours - #12
Alluxio, orchestration de données pour l'analytique et l'apprentissage automatique dans le cloud.
★ 7 234+3Évolution des étoiles sur les 7 derniers jours - #13★ 6 016+1Évolution des étoiles sur les 7 derniers jours
- #14★ 5 180+2Évolution des étoiles sur les 7 derniers jours
- #15★ 5 082+2Évolution des étoiles sur les 7 derniers jours
- #16★ 3 283+4Évolution des étoiles sur les 7 derniers jours
- #17
DataSphereStudio est un portail complet de développement et de gestion d'applications de données, couvrant l'échange de données, le nettoyage, l'analyse, l'exploration, la mesure de qualité, la visualisation et la planification des tâches.
★ 3 262-1Évolution des étoiles sur les 7 derniers jours - #18
Apprentissage du Big Data, de zéro, incluant des vidéos de formation et des ressources pour les entretiens à chaque étape.
★ 3 224+5Évolution des étoiles sur les 7 derniers jours - #19
Système d'analyse des flux de passagers par mégadonnées du métro de Shenzhen 🚇🚄🌟
★ 2 475+1Évolution des étoiles sur les 7 derniers jours - #20
Apache Kyuubi est une passerelle distribuée et multi-tenant fournissant du SQL serverless sur des data warehouses et des lakehouses.
★ 2 364+1Évolution des étoiles sur les 7 derniers jours - #21
Image Docker pour Apache Hadoop
★ 2 325-1Évolution des étoiles sur les 7 derniers jours - #22★ 2 291+4Évolution des étoiles sur les 7 derniers jours
- #23
Apache Drill est une couche de requête MPP distribuée pour les données auto-descriptives
★ 2 022+0Évolution des étoiles sur les 7 derniers jours - #24
Dépôt de connaissances sur le Big Data couvrant la modélisation d'entrepôts de données, le calcul en temps réel, le Big Data, les plateformes de données, la conception de systèmes, Java et les algorithmes.
★ 1 811+3Évolution des étoiles sur les 7 derniers jours - #25★ 1 728+0Évolution des étoiles sur les 7 derniers jours
- #26
Plus de 2000 questions d'entretien pour ingénieurs de données
★ 1 721+5Évolution des étoiles sur les 7 derniers jours - #27
Solution de stockage de données haute performance
★ 1 452+0Évolution des étoiles sur les 7 derniers jours - #28
Un outil ETL rapide et polyvalent capable de transférer des données de manière transparente entre RDBMS et NoSQL
★ 1 430+3Évolution des étoiles sur les 7 derniers jours - #29
Plus de 50 images DockerHub publiques pour Docker et Kubernetes - DevOps, CI/CD, GitHub Actions, CircleCI, Jenkins, TeamCity, Alpine, CentOS, Debian, Fedora, Ubuntu, Hadoop, Kafka, ZooKeeper, HBase, Cassandra, Solr, SolrCloud, Presto, Apache Drill, Nifi, Spark, Consul, Riak.
★ 1 379+0Évolution des étoiles sur les 7 derniers jours - #30
Taier est une plateforme de développement Big Data dédiée à la soumission, la planification, l'exploitation, la maintenance et l'affichage d'indicateurs.
★ 1 284+0Évolution des étoiles sur les 7 derniers jours