pyspark
Erfasste Open-Source-Repos mit dem Tag pyspark, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit pyspark am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit pyspark getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1★ 6.650+1Sterne-Änderung der letzten 7 Tage
- #2
Einfache und verteilte Machine-Learning-Python-Bibliothek zur Portierung von ML-Algorithmen für Spark
★ 5.245+3Sterne-Änderung der letzten 7 Tage - #3★ 4.160+1Sterne-Änderung der letzten 7 Tage
- #4
Apache Linkis baut eine Rechen-Middleware-Schicht auf, um die Verbindung, Governance und Orchestrierung zwischen den oberen Anwendungen und den zugrunde liegenden Daten-Engines zu erleichtern.
★ 3.409+2Sterne-Änderung der letzten 7 Tage - #5
Drop-in-Ersatz für Apache Spark, geschrieben in Rust, der Batch-Verarbeitung, Stream-Verarbeitung und rechenintensive KI-Workloads vereint.
★ 3.341+4Sterne-Änderung der letzten 7 Tage - #6
Eine kuratierte Liste großartiger Apache Spark-Pakete und Ressourcen.
★ 1.893+0Sterne-Änderung der letzten 7 Tage - #7
Die Petastorm-Bibliothek ermöglicht das Training und die Evaluierung von Deep-Learning-Modellen auf einzelnen Maschinen oder verteilt aus Datensätzen im Apache Parquet-Format. Sie unterstützt ML-Frameworks wie Tensorflow, Pytorch und PySpark und kann aus reinem Python-Code heraus verwendet werden.
★ 1.892+0Sterne-Änderung der letzten 7 Tage - #8
Leichte und erweiterbare Kompatibilitätsschicht zwischen Dataframe-Bibliotheken!
★ 1.714+4Sterne-Änderung der letzten 7 Tage - #9
Apache Spark & Python (pySpark) Tutorials für Big-Data-Analyse und Machine Learning als IPython / Jupyter Notebooks
★ 1.660+0Sterne-Änderung der letzten 7 Tage - #10
Agile Datenaufbereitungs-Workflows, einfach gemacht mit Pandas, Dask, cuDF, Dask-cuDF, Vaex und PySpark
★ 1.536+0Sterne-Änderung der letzten 7 Tage - #11
Jupyter Magics und Kernel für die Arbeit mit Remote-Spark-Clustern
★ 1.365-1Sterne-Änderung der letzten 7 Tage - #12★ 1.304+1Sterne-Änderung der letzten 7 Tage
- #13
PySpark-Tutorial bietet grundlegende Algorithmen unter Verwendung von PySpark
★ 1.280+0Sterne-Änderung der letzten 7 Tage - #14
GraphFrames ist ein Paket für Apache Spark, das DataFrame-basierte Graphen bereitstellt.
★ 1.202+0Sterne-Änderung der letzten 7 Tage - #15
MapReduce, Spark, Java und Scala für das Buch "Data Algorithms"
★ 1.080-2Sterne-Änderung der letzten 7 Tage - #16
Sparkling Water stellt H2O-Funktionalität innerhalb eines Spark-Clusters bereit
★ 980+1Sterne-Änderung der letzten 7 Tage - #17
80+ DevOps- und Data-CLI-Tools – AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, Spark Data Converters & Validators (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr usw.
★ 824+0Sterne-Änderung der letzten 7 Tage - #18
Python-Framework zum Erstellen effizienter Datenpipiilines. Es fördert Modularität und Zusammenarbeit und ermöglicht die Erstellung komplexer Pipelines aus einfachen, wiederverwendbaren Komponenten.
★ 818+0Sterne-Änderung der letzten 7 Tage - #19
Scriptis dient der interaktiven Datenanalyse mit Skriptentwicklung (SQL, Pyspark, HiveQL), Task-Übermittlung (Spark, Hive), UDF, Funktionen, Ressourcenverwaltung und intelligentem Diagnose.
★ 814+0Sterne-Änderung der letzten 7 Tage - #20★ 772-1Sterne-Änderung der letzten 7 Tage
- #21★ 689+0Sterne-Änderung der letzten 7 Tage
- #22
Pandas-, Polars-, Spark- und Snowpark-DataFrame-Vergleich für Menschen und mehr!
★ 658+0Sterne-Änderung der letzten 7 Tage - #23
Lernen Sie Apache Spark in Scala, Python (PySpark) und R (SparkR), indem Sie Ihren eigenen Cluster mit einer JupyterLab-Schnittstelle auf Docker erstellen.
★ 512+0Sterne-Änderung der letzten 7 Tage