Zum Hauptinhalt springen
buildradar
Sign in
Thema · spark

spark

Erfasste Open-Source-Repos mit dem Tag spark, sortiert nach Sternen.

115 Repos
  • carbondata@apache

    Leistungsstarke Datenspeicherlösung

    1.452+0Sterne-Änderung der letzten 7 Tage
  • LearningSparkV2@databricks

    Das ist das GitHub-Repository für Learning Spark: Lightning-Fast Data Analytics [2nd Edition]

    1.402+2Sterne-Änderung der letzten 7 Tage
  • Dockerfiles@HariSekhon

    Über 50 öffentliche DockerHub-Images für Docker & Kubernetes – DevOps, CI/CD, GitHub Actions, CircleCI, Jenkins, TeamCity, Alpine, CentOS, Debian, Fedora, Ubuntu, Hadoop, Kafka, ZooKeeper, HBase, Cassandra, Solr, SolrCloud, Presto, Apache Drill, Nifi, Spark, Consul, Riak

    1.379+0Sterne-Änderung der letzten 7 Tage
  • sparkmagic@jupyter-incubator

    Jupyter Magics und Kernel für die Arbeit mit Remote-Spark-Clustern

    1.365-1Sterne-Änderung der letzten 7 Tage
  • Taier@DTStack

    Taier ist eine Big-Data-Entwicklungsplattform für Übermittlung, Planung, Betrieb, Wartung und Anzeige von Indikatoreninformationen

    1.284+0Sterne-Änderung der letzten 7 Tage
  • pyspark-tutorial@mahmoudparsian

    PySpark-Tutorial bietet grundlegende Algorithmen unter Verwendung von PySpark

    1.280+0Sterne-Änderung der letzten 7 Tage
  • Apache DataFusion Comet Spark Accelerator

    1.262+2Sterne-Änderung der letzten 7 Tage
  • zingg@zinggAI

    Skalierbare Stammdatenverwaltung, Identitätsauflösung, Entitätsauflösung und Deduplizierung mittels ML

    1.243+5Sterne-Änderung der letzten 7 Tage
  • graphframes@graphframes

    GraphFrames ist ein Paket für Apache Spark, das DataFrame-basierte Graphen bereitstellt.

    1.202+0Sterne-Änderung der letzten 7 Tage
  • amoro@apache

    Apache Amoro (incubating) ist ein Lakehouse-Verwaltungssystem, das auf offenen Data-Lake-Formaten aufbaut.

    1.171+0Sterne-Änderung der letzten 7 Tage
  • around-dataengineering@abhishek-ch

    Ein Wissenszentrum für Data Engineering & Machine Learning

    1.146+0Sterne-Änderung der letzten 7 Tage
  • celeborn@apache

    Apache Celeborn ist ein elastischer und hochleistungsfähiger Dienst für Shuffle- und ausgelagerte Daten.

    1.062+1Sterne-Änderung der letzten 7 Tage
  • adam@bigdatagenomics

    ADAM ist eine Genomanalyse-Plattform mit spezialisierten Dateiformaten, entwickelt unter Verwendung von Apache Avro, Apache Spark und Apache Parquet. Lizenziert unter Apache 2.

    1.059+2Sterne-Änderung der letzten 7 Tage
  • listenbrainz-server@metabrainz

    Server für das ListenBrainz-Projekt, einschließlich des bereitgestellten Front-End-Codes (JavaScript/React) und aller Datenverarbeitungskomponenten, die von LB verwendet werden.

    1.007+5Sterne-Änderung der letzten 7 Tage
  • cudf-spark@NVIDIA

    NVIDIA cuDF für Apache Spark Plugin – Beschleunigung von Apache Spark mit GPUs

    999+2Sterne-Änderung der letzten 7 Tage
  • spark-scala-tutorial@deanwampler

    Ein kostenloses Tutorial für Apache Spark.

    988+0Sterne-Änderung der letzten 7 Tage
  • Sparkling Water stellt H2O-Funktionalität innerhalb eines Spark-Clusters bereit

    980+1Sterne-Änderung der letzten 7 Tage
  • sparklyr@sparklyr

    R-Schnittstelle für Apache Spark

    971-1Sterne-Änderung der letzten 7 Tage
  • livy@apache

    Apache Livy ist eine Open-Source-REST-Schnittstelle zur Interaktion mit Apache Spark von überall aus.

    962+2Sterne-Änderung der letzten 7 Tage
  • delta-sharing@delta-io

    Ein offenes Protokoll für den sicheren Datenaustausch

    958+0Sterne-Änderung der letzten 7 Tage
  • data-prep-kit@data-prep-kit

    Open-Source-Projekt zur Datenaufbereitung für GenAI-Anwendungen

    958+2Sterne-Änderung der letzten 7 Tage
  • Mobius@microsoft

    C#- und F#-Sprachbindungen und -erweiterungen für Apache Spark

    948+0Sterne-Änderung der letzten 7 Tage
  • spark-redis@RedisLabs

    Ein Spark-Connector zum Lesen von und Schreiben in ein/aus einem Redis-Cluster

    945+0Sterne-Änderung der letzten 7 Tage
  • frameless@typelevel

    Ausdrucksstarke Typen für Spark.

    895-2Sterne-Änderung der letzten 7 Tage
  • tispark@pingcap

    TiSpark wurde entwickelt, um Apache Spark auf TiDB/TiKV auszuführen.

    889+0Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste fantastischer Ressourcen rund um die Programmiersprachen Ada und SPARK

    865+3Sterne-Änderung der letzten 7 Tage
  • data-on-eks@awslabs

    DoEKS ist ein Tool zum Erstellen, Bereitstellen und Skalieren von Datenplattformen auf Amazon EKS

    856-1Sterne-Änderung der letzten 7 Tage
  • sparkMeasure@LucaCanali

    Dieses Repository enthält den Entwicklungscode für sparkMeasure, eine Apache Spark-Bibliothek zur Leistungsanalyse und Fehlerbehebung. Sie vereinfacht das Erfassen, Aggregieren und Exportieren von Spark-Task-/Stage-Metriken und ist für den praktischen Einsatz durch Entwickler und Data Engineers in interaktiven Analyse-, Test- und Produktionsüberwachungs-Workflows konzipiert.

    827-2Sterne-Änderung der letzten 7 Tage
  • DevOps-Python-tools@HariSekhon

    80+ DevOps- und Data-CLI-Tools – AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, Spark Data Converters & Validators (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr usw.

    824+0Sterne-Änderung der letzten 7 Tage
  • Scriptis@WeBankFinTech

    Scriptis dient der interaktiven Datenanalyse mit Skriptentwicklung (SQL, Pyspark, HiveQL), Task-Übermittlung (Spark, Hive), UDF, Funktionen, Ressourcenverwaltung und intelligentem Diagnose.

    814+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen