Zum Hauptinhalt springen
buildradar
Sign in
Thema · big-data

big-data

Erfasste Open-Source-Repos mit dem Tag big-data, sortiert nach Sternen.

Repos
110
Sterne gesamt
638.634
Sterne im Schnitt
5.806
Anteil
0,03%

Themen, die häufig gemeinsam mit big-data am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit big-data getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • Die Muster skalierbarer, zuverlässiger und leistungsstarker Großsysteme

    73.602+155Sterne-Änderung der letzten 7 Tage
  • ClickHouse@ClickHouse

    ClickHouse® ist ein Echtzeit-Analyse-Datenbank-Management-System.

    49.523+136Sterne-Änderung der letzten 7 Tage
  • spark@apache

    Apache Spark - Eine einheitliche Analytik-Engine für groß angelegte Datenverarbeitung

    43.901+49Sterne-Änderung der letzten 7 Tage
  • Data Science Python-Notebooks: Deep Learning (TensorFlow, Theano, Caffe, Keras), scikit-learn, Kaggle, Big Data (Spark, Hadoop MapReduce, HDFS), matplotlib, pandas, NumPy, SciPy, Python-Grundlagen, AWS und diverse Befehlszeilen.

    29.334+27Sterne-Änderung der letzten 7 Tage
  • flink@apache

    Apache Flink

    26.302+27Sterne-Änderung der letzten 7 Tage
  • thingsboard@thingsboard

    Open-Source IoT-Plattform - Gerätemanagement, Datensammlung, Verarbeitung und Visualisierung.

    22.327+34Sterne-Änderung der letzten 7 Tage
  • gun@amark

    Ein Open-Source-Cybersicherheitsprotokoll zur Synchronisierung dezentraler Graphdaten.

    19.128+5Sterne-Änderung der letzten 7 Tage
  • BigData-Notes@heibaiying

    Einführungsleitfaden für Big Data :star:

    16.958+6Sterne-Änderung der letzten 7 Tage
  • presto@prestodb

    Das offizielle Zuhause der verteilten SQL-Abfrage-Engine Presto für Big Data

    16.725+3Sterne-Änderung der letzten 7 Tage
  • Cookbook@andkret

    Das Data Engineering Cookbook

    15.383+36Sterne-Änderung der letzten 7 Tage
  • trino@trinodb

    Offizielles Repository von Trino, der verteilten SQL-Abfrageengine für Big Data, ehemals bekannt als PrestoSQL (https://trino.io)

    13.194+24Sterne-Änderung der letzten 7 Tage
  • nebula@vesoft-inc

    Eine verteilte, schnelle Open-Source-Graphdatenbank mit horizontaler Skalierbarkeit und hoher Verfügbarkeit

    12.367+12Sterne-Änderung der letzten 7 Tage
  • kafka-ui@provectus

    Open-Source-Web-UI für die Verwaltung von Apache Kafka

    12.272+12Sterne-Änderung der letzten 7 Tage
  • starrocks@StarRocks

    Die weltch schnellste offene Query-Engine für Sub-Sekunden-Analysen auf und neben dem Data Lakehouse. Mit der Flexibilität, nahezu jedes Szenario zu unterstützen, bietet StarRocks erstklassige Leistung für mehrdimensionale Analysen, Echtzeitanalysen und Ad-hoc-Abfragen. Ein Projekt der Linux Foundation.

    12.057+28Sterne-Änderung der letzten 7 Tage
  • quickwit@quickwit-oss

    Cloud-native Open-Source-Suchmaschine für Observability

    11.556+21Sterne-Änderung der letzten 7 Tage
  • cython@cython

    Der am häufigsten verwendete Python-zu-C-Compiler

    10.836+6Sterne-Änderung der letzten 7 Tage
  • datafusion@apache

    Apache DataFusion SQL-Query-Engine

    9.248+71Sterne-Änderung der letzten 7 Tage
  • catboost@catboost

    Eine schnelle, skalierbare und hochleistungsfähige Gradient-Boosting-on-Decision-Trees-Bibliothek für Ranking, Klassifikation, Regression und andere Machine-Learning-Aufgaben in Python, R, Java und C++. Unterstützt Berechnungen auf CPU und GPU.

    9.085+13Sterne-Änderung der letzten 7 Tage
  • delta@delta-io

    Ein Open-Source-Speicherframework, das den Aufbau einer Lakehouse-Architektur mit Compute-Engines wie Spark, PrestoDB, Flink, Trino, Hive und APIs ermöglicht

    8.962+17Sterne-Änderung der letzten 7 Tage
  • beam@apache

    Apache Beam ist ein einheitliches Programmiermodell für die Batch- und Stream-Datenverarbeitung.

    8.653+5Sterne-Änderung der letzten 7 Tage
  • h2o-3@h2oai

    H2O ist eine Open-Source-, verteilte, schnelle und skalierbare Plattform für maschinelles Lernen: Deep Learning, Gradient Boosting (GBM) & XGBoost, Random Forest, Generalized Linear Modeling (GLM mit Elastic Net), K-Means, PCA, Generalized Additive Models (GAM), RuleFit, Support Vector Machine (SVM), Stacked Ensembles, Automatic Machine Learning (AutoML) usw.

    7.496+1Sterne-Änderung der letzten 7 Tage
  • arkime@arkime

    Arkime ist ein Open-Source-System im großen Maßstab zur vollständigen Paketaufzeichnung, Indizierung und Datenbankverwaltung.

    7.460+12Sterne-Änderung der letzten 7 Tage
  • feast@feast-dev

    Das Open-Source-Feature-Store für AI/ML

    7.239+15Sterne-Änderung der letzten 7 Tage
  • vespa@vespa-engine

    Die KI-Suchplattform

    7.072+14Sterne-Änderung der letzten 7 Tage
  • couchdb@apache

    Nahtlos zwischen mehreren primären Knoten synchronisierende Datenbank mit einer intuitiven HTTP/JSON-API, ausgelegt auf Zuverlässigkeit

    6.944+5Sterne-Änderung der letzten 7 Tage
  • zeppelin@apache

    Webbasiertes Notizbuch für datengesteuerte, interaktive Datenanalyse und kollaborative Dokumente mit SQL, Scala und mehr.

    6.655+3Sterne-Änderung der letzten 7 Tage
  • hazelcast@hazelcast

    Hazelcast ist eine einheitliche Echtzeit-Datenplattform, die Stream-Verarbeitung mit einem schnellen Datenspeicher kombiniert, sodass Kunden sofort auf sich bewegende Daten für Echtzeiterkenntnisse reagieren können.

    6.604+3Sterne-Änderung der letzten 7 Tage
  • iotdb@apache

    Apache IoTDB

    6.385+2Sterne-Änderung der letzten 7 Tage
  • pachyderm@pachyderm

    Datenzentrierte Pipelines und Datenversionierung

    6.308+1Sterne-Änderung der letzten 7 Tage
  • hive@apache

    Apache Hive

    6.015+1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen