spark
Erfasste Open-Source-Repos mit dem Tag spark, sortiert nach Sternen.
- #61
Leistungsstarke Datenspeicherlösung
★ 1.452+0Sterne-Änderung der letzten 7 Tage - #62
Das ist das GitHub-Repository für Learning Spark: Lightning-Fast Data Analytics [2nd Edition]
★ 1.402+2Sterne-Änderung der letzten 7 Tage - #63
Über 50 öffentliche DockerHub-Images für Docker & Kubernetes – DevOps, CI/CD, GitHub Actions, CircleCI, Jenkins, TeamCity, Alpine, CentOS, Debian, Fedora, Ubuntu, Hadoop, Kafka, ZooKeeper, HBase, Cassandra, Solr, SolrCloud, Presto, Apache Drill, Nifi, Spark, Consul, Riak
★ 1.379+0Sterne-Änderung der letzten 7 Tage - #64
Jupyter Magics und Kernel für die Arbeit mit Remote-Spark-Clustern
★ 1.365-1Sterne-Änderung der letzten 7 Tage - #65
Taier ist eine Big-Data-Entwicklungsplattform für Übermittlung, Planung, Betrieb, Wartung und Anzeige von Indikatoreninformationen
★ 1.284+0Sterne-Änderung der letzten 7 Tage - #66
PySpark-Tutorial bietet grundlegende Algorithmen unter Verwendung von PySpark
★ 1.280+0Sterne-Änderung der letzten 7 Tage - #67
Apache DataFusion Comet Spark Accelerator
★ 1.262+2Sterne-Änderung der letzten 7 Tage - #68
Skalierbare Stammdatenverwaltung, Identitätsauflösung, Entitätsauflösung und Deduplizierung mittels ML
★ 1.243+5Sterne-Änderung der letzten 7 Tage - #69
GraphFrames ist ein Paket für Apache Spark, das DataFrame-basierte Graphen bereitstellt.
★ 1.202+0Sterne-Änderung der letzten 7 Tage - #70
Apache Amoro (incubating) ist ein Lakehouse-Verwaltungssystem, das auf offenen Data-Lake-Formaten aufbaut.
★ 1.171+0Sterne-Änderung der letzten 7 Tage - #71
Ein Wissenszentrum für Data Engineering & Machine Learning
★ 1.146+0Sterne-Änderung der letzten 7 Tage - #72
Apache Celeborn ist ein elastischer und hochleistungsfähiger Dienst für Shuffle- und ausgelagerte Daten.
★ 1.062+1Sterne-Änderung der letzten 7 Tage - #73
ADAM ist eine Genomanalyse-Plattform mit spezialisierten Dateiformaten, entwickelt unter Verwendung von Apache Avro, Apache Spark und Apache Parquet. Lizenziert unter Apache 2.
★ 1.059+2Sterne-Änderung der letzten 7 Tage - #74
Server für das ListenBrainz-Projekt, einschließlich des bereitgestellten Front-End-Codes (JavaScript/React) und aller Datenverarbeitungskomponenten, die von LB verwendet werden.
★ 1.007+5Sterne-Änderung der letzten 7 Tage - #75
NVIDIA cuDF für Apache Spark Plugin – Beschleunigung von Apache Spark mit GPUs
★ 999+2Sterne-Änderung der letzten 7 Tage - #76
Ein kostenloses Tutorial für Apache Spark.
★ 988+0Sterne-Änderung der letzten 7 Tage - #77
Sparkling Water stellt H2O-Funktionalität innerhalb eines Spark-Clusters bereit
★ 980+1Sterne-Änderung der letzten 7 Tage - #78★ 971-1Sterne-Änderung der letzten 7 Tage
- #79
Apache Livy ist eine Open-Source-REST-Schnittstelle zur Interaktion mit Apache Spark von überall aus.
★ 962+2Sterne-Änderung der letzten 7 Tage - #80
Ein offenes Protokoll für den sicheren Datenaustausch
★ 958+0Sterne-Änderung der letzten 7 Tage - #81
Open-Source-Projekt zur Datenaufbereitung für GenAI-Anwendungen
★ 958+2Sterne-Änderung der letzten 7 Tage - #82★ 948+0Sterne-Änderung der letzten 7 Tage
- #83
Ein Spark-Connector zum Lesen von und Schreiben in ein/aus einem Redis-Cluster
★ 945+0Sterne-Änderung der letzten 7 Tage - #84★ 895-2Sterne-Änderung der letzten 7 Tage
- #85★ 889+0Sterne-Änderung der letzten 7 Tage
- #86
Eine kuratierte Liste fantastischer Ressourcen rund um die Programmiersprachen Ada und SPARK
★ 865+3Sterne-Änderung der letzten 7 Tage - #87
DoEKS ist ein Tool zum Erstellen, Bereitstellen und Skalieren von Datenplattformen auf Amazon EKS
★ 856-1Sterne-Änderung der letzten 7 Tage - #88
Dieses Repository enthält den Entwicklungscode für sparkMeasure, eine Apache Spark-Bibliothek zur Leistungsanalyse und Fehlerbehebung. Sie vereinfacht das Erfassen, Aggregieren und Exportieren von Spark-Task-/Stage-Metriken und ist für den praktischen Einsatz durch Entwickler und Data Engineers in interaktiven Analyse-, Test- und Produktionsüberwachungs-Workflows konzipiert.
★ 827-2Sterne-Änderung der letzten 7 Tage - #89
80+ DevOps- und Data-CLI-Tools – AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, Spark Data Converters & Validators (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr usw.
★ 824+0Sterne-Änderung der letzten 7 Tage - #90
Scriptis dient der interaktiven Datenanalyse mit Skriptentwicklung (SQL, Pyspark, HiveQL), Task-Übermittlung (Spark, Hive), UDF, Funktionen, Ressourcenverwaltung und intelligentem Diagnose.
★ 814+0Sterne-Änderung der letzten 7 Tage