Zum Hauptinhalt springen
buildradar
Sign in
Thema · big-data

big-data

Erfasste Open-Source-Repos mit dem Tag big-data, sortiert nach Sternen.

110 Repos
  • Daft@Eventual-Inc

    Hochleistungs-Daten-Engine für KI- und multimodale Workloads. Verarbeitet Bilder, Audio, Video und strukturierte Daten in beliebigem Maßstab.

    5.736+4Sterne-Änderung der letzten 7 Tage
  • SynapseML@microsoft

    Einfache und verteilte Machine-Learning-Python-Bibliothek zur Portierung von ML-Algorithmen für Spark

    5.245+3Sterne-Änderung der letzten 7 Tage
  • calcite@apache

    Apache Calcite

    5.180+2Sterne-Änderung der letzten 7 Tage
  • ignite@apache

    Apache Ignite

    5.082+2Sterne-Änderung der letzten 7 Tage
  • Stream-Framework@tschellenbach

    Stream Framework ist eine Python-Bibliothek, mit der Sie Newsfeeds, Activity Streams und Benachrichtigungssysteme unter Verwendung von Cassandra und/oder Redis erstellen können. Die Autoren von Stream-Framework bieten zudem einen Cloud-Dienst für Feed-Technologie an:

    4.742-2Sterne-Änderung der letzten 7 Tage
  • ⚡️ Eine Vue-Komponente, die große Datenlisten mit hoher Renderleistung und Effizienz unterstützt.

    4.505-1Sterne-Änderung der letzten 7 Tage
  • img2dataset@rom1504

    Große Mengen von Bild-URLs einfach in einen Bilddatensatz umwandeln. Kann 100 Millionen URLs auf einer Maschine in 20 Stunden herunterladen, skalieren und verpacken.

    4.445+2Sterne-Änderung der letzten 7 Tage
  • crate@crate

    CrateDB ist eine verteilte und skalierbare SQL-Datenbank zum Speichern und Analysieren riesiger Datenmengen in nahezu Echtzeit, selbst bei komplexen Abfragen. Sie ist PostgreSQL-kompatibel und basiert auf Lucene.

    4.432+3Sterne-Änderung der letzten 7 Tage
  • fastjson2@alibaba

    🚄 FASTJSON2 ist eine Java-JSON-Bibliothek mit hervorragender Leistung.

    4.399+2Sterne-Änderung der letzten 7 Tage
  • Data-Science-Roadmap@Moataz-Elmesmary

    Data-Science-Roadmap von A bis Z

    4.354+3Sterne-Änderung der letzten 7 Tage
  • GraphScope@alibaba

    🔨 🍇 💻 🚀 GraphScope: Ein All-in-One-System für groß angelegte Graphenberechnungen von Alibaba

    3.557+1Sterne-Änderung der letzten 7 Tage
  • Erweiterbarer SQL-Lexer und -Parser für Rust

    3.446+9Sterne-Änderung der letzten 7 Tage
  • paimon@apache

    Apache Paimon ist ein Lake-Format, das den Aufbau einer Realtime-Lakehouse-Architektur mit Flink und Spark sowohl für Streaming- als auch für Batch-Operationen ermöglicht.

    3.388+3Sterne-Änderung der letzten 7 Tage
  • koalas@databricks

    Koalas: pandas API auf Apache Spark

    3.374+1Sterne-Änderung der letzten 7 Tage
  • sail@lakehq

    Drop-in-Ersatz für Apache Spark, geschrieben in Rust, der Batch-Verarbeitung, Stream-Verarbeitung und rechenintensive KI-Workloads vereint.

    3.341+4Sterne-Änderung der letzten 7 Tage
  • hugegraph@apache

    Eine Graphdatenbank, die über 100 Milliarden Daten unterstützt, mit hoher Leistung und Skalierbarkeit (inklusive OLTP-Engine, REST-API und Backends).

    3.167+6Sterne-Änderung der letzten 7 Tage
  • CBoard@TuiQiao

    Eine benutzerfreundliche, Self-Service-Open-BI-Berichts- und BI-Dashboard-Plattform.

    3.098+1Sterne-Änderung der letzten 7 Tage
  • kafka-ui@kafbat

    Open-Source-Web-UI zur Verwaltung von Apache Kafka-Clustern

    2.656+14Sterne-Änderung der letzten 7 Tage
  • ArcticDB@man-group

    ArcticDB ist eine hochleistungsfähige, serverlose DataFrame-Datenbank, die für das Python Data Science-Ökosystem entwickelt wurde.

    2.505+8Sterne-Änderung der letzten 7 Tage
  • quary@quarylabs

    Open-Source-BI für Ingenieure

    2.379+2Sterne-Änderung der letzten 7 Tage
  • ambari@apache

    Apache Ambari vereinfacht die Bereitstellung, Verwaltung und Überwachung von Apache Hadoop-Clustern.

    2.311+0Sterne-Änderung der letzten 7 Tage
  • ytsaurus@ytsaurus

    YTsaurus ist eine skalierbare und fehlertolerante Open-Source-Big-Data-Plattform.

    2.203+0Sterne-Änderung der letzten 7 Tage
  • fluss@apache

    Apache Fluss ist ein für Echtzeitanalysen entwickelter Streaming-Speicher.

    2.131+11Sterne-Änderung der letzten 7 Tage
  • Apache DataFusion Ballista Distributed Query Engine

    2.127+7Sterne-Änderung der letzten 7 Tage
  • drill@apache

    Apache Drill ist eine verteilte MPP-Abfrageschicht für selbstdokumentierende Daten

    2.022+0Sterne-Änderung der letzten 7 Tage
  • bookkeeper@apache

    Apache BookKeeper – ein skalierbarer, fehlertoleranter und latenzarmer Speicherdienst, der für Workloads mit reinen Anhängeoperationen optimiert ist.

    2.011+1Sterne-Änderung der letzten 7 Tage
  • fluid@fluid-cloudnative

    Fluide, elastische Datenabstraktion und -beschleunigung für BigData/KI-Anwendungen in der Cloud. (Projekt unter CNCF)

    1.967+0Sterne-Änderung der letzten 7 Tage
  • kudu@apache

    Spiegelung von Apache Kudu

    1.913+0Sterne-Änderung der letzten 7 Tage
  • awesome-data-analysis@PavelGrigoryevDS

    🚀 Über 500 kuratierte Ressourcen für Datenanalyse & Data Science: Python, SQL, Statistik, ML, AI, Visualisierung, Cheatsheets, Roadmaps, Interviewvorbereitung. Für Anfänger und Experten.

    1.890+8Sterne-Änderung der letzten 7 Tage
  • auron@apache

    Der Auron-Beschleuniger für Frameworks für verteiltes Computing (z. B. Spark) nutzt native vektorisierte Ausführung zur Beschleunigung der Abfrageverarbeitung

    1.798+2Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen