big-data
Erfasste Open-Source-Repos mit dem Tag big-data, sortiert nach Sternen.
- #61★ 1.766-1Sterne-Änderung der letzten 7 Tage
- #62
Open-Source-Sicherheits-Data-Lake für Bedrohungssuche, Erkennung & Reaktion sowie Cybersicherheits-Analysen im Petabyte-Bereich auf AWS
★ 1.694+0Sterne-Änderung der letzten 7 Tage - #63
Apache Spark & Python (pySpark) Tutorials für Big-Data-Analyse und Machine Learning als IPython / Jupyter Notebooks
★ 1.660+0Sterne-Änderung der letzten 7 Tage - #64★ 1.618+3Sterne-Änderung der letzten 7 Tage
- #65
:bar_chart: :clipboard: Dashboards mit YAML- oder JSON-Dateien
★ 1.582+1Sterne-Änderung der letzten 7 Tage - #66
Dremio – das fehlende Glied in modernen Daten.
★ 1.492+1Sterne-Änderung der letzten 7 Tage - #67
Leistungsstarke Datenspeicherlösung
★ 1.452+0Sterne-Änderung der letzten 7 Tage - #68★ 1.384+0Sterne-Änderung der letzten 7 Tage
- #69
Eine fortschrittliche und ausgereifte Open-Source-MPP-Datenbank (Massively Parallel Processing). Open-Source-Alternative zur Greenplum Database.
★ 1.382+5Sterne-Änderung der letzten 7 Tage - #70
Extension für Scikit-learn als nahtlose Möglichkeit, deine Scikit-learn-Anwendung zu beschleunigen
★ 1.356+0Sterne-Änderung der letzten 7 Tage - #71
PySpark-Tutorial bietet grundlegende Algorithmen unter Verwendung von PySpark
★ 1.280+0Sterne-Änderung der letzten 7 Tage - #72
Skalierbares, zuverlässiges, verteiltes Speichersystem, optimiert für Datenanalyse- und Objektspeicher-Workloads.
★ 1.270+1Sterne-Änderung der letzten 7 Tage - #73
Einfache Windows-Desktopanwendung zum Anzeigen und Abfragen von Apache Parquet-Dateien
★ 1.231+2Sterne-Änderung der letzten 7 Tage - #74
GraphFrames ist ein Paket für Apache Spark, das DataFrame-basierte Graphen bereitstellt.
★ 1.202+0Sterne-Änderung der letzten 7 Tage - #75
Apache Amoro (incubating) ist ein Lakehouse-Verwaltungssystem, das auf offenen Data-Lake-Formaten aufbaut.
★ 1.171+0Sterne-Änderung der letzten 7 Tage - #76★ 1.165+2Sterne-Änderung der letzten 7 Tage
- #77
ClickBench: Ein Benchmark für analytische Datenbanken
★ 1.094+2Sterne-Änderung der letzten 7 Tage - #78
📙 Awesome Data Catalogs und Observability Platforms.
★ 1.068+5Sterne-Änderung der letzten 7 Tage - #79
ADAM ist eine Genomanalyse-Plattform mit spezialisierten Dateiformaten, entwickelt unter Verwendung von Apache Avro, Apache Spark und Apache Parquet. Lizenziert unter Apache 2.
★ 1.059+2Sterne-Änderung der letzten 7 Tage - #80
Ein @ClickHouse-Fork, der hochperformante Vektorsuche und Volltextsuche unterstützt.
★ 1.040+0Sterne-Änderung der letzten 7 Tage - #81
Apache Flink Kubernetes Operator
★ 1.031+3Sterne-Änderung der letzten 7 Tage - #82
Karriere-Ressourcen für Data Science, Machine Learning, Big Data und Business Analytics
★ 1.022+2Sterne-Änderung der letzten 7 Tage - #83
Server für das ListenBrainz-Projekt, einschließlich des bereitgestellten Front-End-Codes (JavaScript/React) und aller Datenverarbeitungskomponenten, die von LB verwendet werden.
★ 1.006+4Sterne-Änderung der letzten 7 Tage - #84
NVIDIA cuDF für Apache Spark Plugin – Beschleunigung von Apache Spark mit GPUs
★ 998+1Sterne-Änderung der letzten 7 Tage - #85
Sparkling Water stellt H2O-Funktionalität innerhalb eines Spark-Clusters bereit
★ 980+1Sterne-Änderung der letzten 7 Tage - #86
Ein offenes Protokoll für den sicheren Datenaustausch
★ 957-1Sterne-Änderung der letzten 7 Tage - #87
⚡ Einmal-Durchlauf-Algorithmen für Statistiken
★ 897+0Sterne-Änderung der letzten 7 Tage - #88
Ein weiteres Repository mit grundlegenden Konzepten, technischen Herausforderungen und Ressourcen zum Thema Data Engineering auf Spanisch 🧙✨
★ 896+1Sterne-Änderung der letzten 7 Tage - #89
Fortschrittliche gelernte Datenstruktur für schnelle Nachschlage-, Vorgänger-, Bereichssuche und Aktualisierungen in Arrays mit Milliarden von Elementen bei deutlich geringerem Speicherbedarf als traditionelle Indizes
★ 873+1Sterne-Änderung der letzten 7 Tage - #90
KI-Projekte
★ 868+1Sterne-Änderung der letzten 7 Tage