spark
Dépôts open source suivis étiquetés spark, triés par étoiles.
- #31
LakeSoul est un framework Lakehouse cloud-native de bout en bout et en temps réel pour l'ingestion rapide de données, les mises à jour simultanées, l'analyse incrémentale, le traitement de données multimodales et la recherche vectorielle, alimentant les charges de travail BI et IA de nouvelle génération.
★ 3 249+2Évolution des étoiles sur les 7 derniers jours - #32
Apprentissage du Big Data, de zéro, incluant des vidéos de formation et des ressources pour les entretiens à chaque étape.
★ 3 224+10Évolution des étoiles sur les 7 derniers jours - #33
Opérateur Kubernetes pour gérer le cycle de vie des applications Apache Spark sur Kubernetes.
★ 3 150+1Évolution des étoiles sur les 7 derniers jours - #34
Serveur de tâches REST pour Apache Spark
★ 2 836+0Évolution des étoiles sur les 7 derniers jours - #35★ 2 829+38Évolution des étoiles sur les 7 derniers jours
- #36
Exemples d'apprentissage rapide basés sur Spring Boot, intégrant divers frameworks open source tels que : rabbitmq (files d'attente différées), Kafka, jpa, redis, oauth2, swagger, jsp, docker, k3s, k3d, k8s, plugins de chiffrement mybatis, gestion des exceptions, logs, développement multi-modules, packaging multi-environnements, cache, web scraping, jwt, GraphQL, dubbo, zookeeper, Async, etc.
★ 2 787-1Évolution des étoiles sur les 7 derniers jours - #37
Système d'analyse des flux de passagers par mégadonnées du métro de Shenzhen 🚇🚄🌟
★ 2 475+1Évolution des étoiles sur les 7 derniers jours - #38
✨ Spark est un outil d'administration à distance (RAT) complet, multiplateforme et basé sur le web, écrit en Go, qui vous permet de contrôler tous vos appareils où que vous soyez.
★ 2 386+5Évolution des étoiles sur les 7 derniers jours - #39
Liaison de données probabiliste rapide, précise et évolutive avec prise en charge de multiples backends SQL.
★ 2 375+11Évolution des étoiles sur les 7 derniers jours - #40
Apache Kyuubi est une passerelle distribuée et multi-tenant fournissant du SQL serverless sur des data warehouses et des lakehouses.
★ 2 364+2Évolution des étoiles sur les 7 derniers jours - #41
TransmogrifAI est une bibliothèque AutoML pour créer des flux de travail d'apprentissage automatique modulaires, réutilisables et fortement typés sur Apache Spark avec un minimum de réglages manuels.
★ 2 277+0Évolution des étoiles sur les 7 derniers jours - #42
YTsaurus est une plateforme de Big Data open source, évolutive et tolérante aux pannes.
★ 2 203+3Évolution des étoiles sur les 7 derniers jours - #43
Outils pour manipuler les firmwares des produits DJI, avec un accent sur les quadricoptères
★ 2 193+7Évolution des étoiles sur les 7 derniers jours - #44
Interface unifiée pour le calcul distribué. Fugue exécute du code SQL, Python, Pandas et Polars sur Spark, Dask et Ray sans aucune réécriture.
★ 2 170+1Évolution des étoiles sur les 7 derniers jours - #45★ 2 166+0Évolution des étoiles sur les 7 derniers jours
- #46
.NET for Apache® Spark™ rend Apache Spark™ facilement accessible aux développeurs .NET.
★ 2 096-2Évolution des étoiles sur les 7 derniers jours - #47★ 1 994+2Évolution des étoiles sur les 7 derniers jours
- #48
Connecteur entre Apache Spark et Apache Cassandra.
★ 1 955+1Évolution des étoiles sur les 7 derniers jours - #49
Dépôt de connaissances sur le Big Data couvrant la modélisation d'entrepôts de données, le calcul en temps réel, le Big Data, les plateformes de données, la conception de systèmes, Java et les algorithmes.
★ 1 811+5Évolution des étoiles sur les 7 derniers jours - #50
L'accélérateur Auron pour les frameworks de calcul distribué (ex: Spark) exploite l'exécution vectorisée native pour accélérer le traitement des requêtes
★ 1 798+3Évolution des étoiles sur les 7 derniers jours - #51
Synthèse de l'architecture des connaissances full-stack pour le backend (Java, Golang).
★ 1 768+3Évolution des étoiles sur les 7 derniers jours - #52
Organisation open source ApacheCN : annonces, présentation, membres, activités et canaux de communication
★ 1 754+0Évolution des étoiles sur les 7 derniers jours - #53
Plus de 2000 questions d'entretien pour ingénieurs de données
★ 1 721+7Évolution des étoiles sur les 7 derniers jours - #54
Elassandra = Elasticsearch + Apache Cassandra.
★ 1 714+0Évolution des étoiles sur les 7 derniers jours - #55
Tutoriels Apache Spark et Python (pySpark) pour l'analyse de Big Data et le Machine Learning sous forme de notebooks IPython / Jupyter
★ 1 660+1Évolution des étoiles sur les 7 derniers jours - #56★ 1 625+0Évolution des étoiles sur les 7 derniers jours
- #57
Les rouages internes d'Apache Spark.
★ 1 549+0Évolution des étoiles sur les 7 derniers jours - #58★ 1 544+1Évolution des étoiles sur les 7 derniers jours
- #59
Flux de travail de préparation de données agiles simplifiés avec Pandas, Dask, cuDF, Dask-cuDF, Vaex et PySpark
★ 1 536+0Évolution des étoiles sur les 7 derniers jours - #60
Nessie : Catalogue transactionnel pour Data Lakes avec une sémantique de type Git
★ 1 498+1Évolution des étoiles sur les 7 derniers jours