big-data
Erfasste Open-Source-Repos mit dem Tag big-data, sortiert nach Sternen.
- #31
Hochleistungs-Daten-Engine für KI- und multimodale Workloads. Verarbeitet Bilder, Audio, Video und strukturierte Daten in beliebigem Maßstab.
★ 5.736+4Sterne-Änderung der letzten 7 Tage - #32
Einfache und verteilte Machine-Learning-Python-Bibliothek zur Portierung von ML-Algorithmen für Spark
★ 5.245+3Sterne-Änderung der letzten 7 Tage - #33★ 5.180+2Sterne-Änderung der letzten 7 Tage
- #34★ 5.082+2Sterne-Änderung der letzten 7 Tage
- #35
Stream Framework ist eine Python-Bibliothek, mit der Sie Newsfeeds, Activity Streams und Benachrichtigungssysteme unter Verwendung von Cassandra und/oder Redis erstellen können. Die Autoren von Stream-Framework bieten zudem einen Cloud-Dienst für Feed-Technologie an:
★ 4.742-2Sterne-Änderung der letzten 7 Tage - #36
⚡️ Eine Vue-Komponente, die große Datenlisten mit hoher Renderleistung und Effizienz unterstützt.
★ 4.505-1Sterne-Änderung der letzten 7 Tage - #37
Große Mengen von Bild-URLs einfach in einen Bilddatensatz umwandeln. Kann 100 Millionen URLs auf einer Maschine in 20 Stunden herunterladen, skalieren und verpacken.
★ 4.445+2Sterne-Änderung der letzten 7 Tage - #38
CrateDB ist eine verteilte und skalierbare SQL-Datenbank zum Speichern und Analysieren riesiger Datenmengen in nahezu Echtzeit, selbst bei komplexen Abfragen. Sie ist PostgreSQL-kompatibel und basiert auf Lucene.
★ 4.432+3Sterne-Änderung der letzten 7 Tage - #39★ 4.399+2Sterne-Änderung der letzten 7 Tage
- #40
Data-Science-Roadmap von A bis Z
★ 4.354+3Sterne-Änderung der letzten 7 Tage - #41
🔨 🍇 💻 🚀 GraphScope: Ein All-in-One-System für groß angelegte Graphenberechnungen von Alibaba
★ 3.557+1Sterne-Änderung der letzten 7 Tage - #42
Erweiterbarer SQL-Lexer und -Parser für Rust
★ 3.446+9Sterne-Änderung der letzten 7 Tage - #43
Apache Paimon ist ein Lake-Format, das den Aufbau einer Realtime-Lakehouse-Architektur mit Flink und Spark sowohl für Streaming- als auch für Batch-Operationen ermöglicht.
★ 3.388+3Sterne-Änderung der letzten 7 Tage - #44★ 3.374+1Sterne-Änderung der letzten 7 Tage
- #45
Drop-in-Ersatz für Apache Spark, geschrieben in Rust, der Batch-Verarbeitung, Stream-Verarbeitung und rechenintensive KI-Workloads vereint.
★ 3.341+4Sterne-Änderung der letzten 7 Tage - #46
Eine Graphdatenbank, die über 100 Milliarden Daten unterstützt, mit hoher Leistung und Skalierbarkeit (inklusive OLTP-Engine, REST-API und Backends).
★ 3.167+6Sterne-Änderung der letzten 7 Tage - #47★ 3.098+1Sterne-Änderung der letzten 7 Tage
- #48★ 2.656+14Sterne-Änderung der letzten 7 Tage
- #49
ArcticDB ist eine hochleistungsfähige, serverlose DataFrame-Datenbank, die für das Python Data Science-Ökosystem entwickelt wurde.
★ 2.505+8Sterne-Änderung der letzten 7 Tage - #50★ 2.379+2Sterne-Änderung der letzten 7 Tage
- #51
Apache Ambari vereinfacht die Bereitstellung, Verwaltung und Überwachung von Apache Hadoop-Clustern.
★ 2.311+0Sterne-Änderung der letzten 7 Tage - #52★ 2.203+0Sterne-Änderung der letzten 7 Tage
- #53★ 2.131+11Sterne-Änderung der letzten 7 Tage
- #54
Apache DataFusion Ballista Distributed Query Engine
★ 2.127+7Sterne-Änderung der letzten 7 Tage - #55★ 2.022+0Sterne-Änderung der letzten 7 Tage
- #56
Apache BookKeeper – ein skalierbarer, fehlertoleranter und latenzarmer Speicherdienst, der für Workloads mit reinen Anhängeoperationen optimiert ist.
★ 2.011+1Sterne-Änderung der letzten 7 Tage - #57
Fluide, elastische Datenabstraktion und -beschleunigung für BigData/KI-Anwendungen in der Cloud. (Projekt unter CNCF)
★ 1.967+0Sterne-Änderung der letzten 7 Tage - #58★ 1.913+0Sterne-Änderung der letzten 7 Tage
- #59
🚀 Über 500 kuratierte Ressourcen für Datenanalyse & Data Science: Python, SQL, Statistik, ML, AI, Visualisierung, Cheatsheets, Roadmaps, Interviewvorbereitung. Für Anfänger und Experten.
★ 1.890+8Sterne-Änderung der letzten 7 Tage - #60
Der Auron-Beschleuniger für Frameworks für verteiltes Computing (z. B. Spark) nutzt native vektorisierte Ausführung zur Beschleunigung der Abfrageverarbeitung
★ 1.798+2Sterne-Änderung der letzten 7 Tage