Lompat ke konten utama
buildradar
Sign in
Topik · big-data

big-data

Repositori open source terpantau bertanda big-data, diurutkan berdasarkan bintang.

Repositori
110
Total bintang
638.634
Rata-rata bintang
5.806
Porsi
0,03%

Topik yang sering muncul berdampingan dengan big-data di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda big-data.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • Pola sistem skala besar yang skalabel, andal, dan berkinerja tinggi

    73.602+155Perubahan bintang dalam 7 hari terakhir
  • ClickHouse@ClickHouse

    ClickHouse® adalah sistem manajemen basis data analitik waktu nyata

    49.523+136Perubahan bintang dalam 7 hari terakhir
  • spark@apache

    Apache Spark - Mesin analitik terpadu untuk pemrosesan data skala besar

    43.901+49Perubahan bintang dalam 7 hari terakhir
  • Notebook Python untuk data science: Deep learning (TensorFlow, Theano, Caffe, Keras), scikit-learn, Kaggle, big data (Spark, Hadoop MapReduce, HDFS), matplotlib, pandas, NumPy, SciPy, dasar-dasar Python, AWS, dan berbagai baris perintah.

    29.334+27Perubahan bintang dalam 7 hari terakhir
  • flink@apache

    Apache Flink

    26.302+27Perubahan bintang dalam 7 hari terakhir
  • thingsboard@thingsboard

    Platform IoT sumber terbuka - Manajemen perangkat, pengumpulan data, pemrosesan, dan visualisasi.

    22.327+34Perubahan bintang dalam 7 hari terakhir
  • gun@amark

    Protokol keamanan siber sumber terbuka untuk menyinkronkan data grafik terdesentralisasi.

    19.128+5Perubahan bintang dalam 7 hari terakhir
  • BigData-Notes@heibaiying

    Panduan pengantar Big Data :star:

    16.958+6Perubahan bintang dalam 7 hari terakhir
  • presto@prestodb

    Rumah resmi untuk mesin kueri SQL terdistribusi Presto untuk data besar

    16.725+3Perubahan bintang dalam 7 hari terakhir
  • Cookbook@andkret

    Buku Panduan Data Engineering

    15.383+36Perubahan bintang dalam 7 hari terakhir
  • trino@trinodb

    Repositori resmi Trino, mesin kueri SQL terdistribusi untuk big data, yang sebelumnya dikenal sebagai PrestoSQL (https://trino.io)

    13.194+24Perubahan bintang dalam 7 hari terakhir
  • nebula@vesoft-inc

    Basis data grafik sumber terbuka yang terdistribusi dan cepat dengan skalabilitas horizontal dan ketersediaan tinggi

    12.367+12Perubahan bintang dalam 7 hari terakhir
  • kafka-ui@provectus

    UI Web sumber terbuka untuk manajemen Apache Kafka

    12.272+12Perubahan bintang dalam 7 hari terakhir
  • starrocks@StarRocks

    Mesin kueri terbuka tercepat di dunia untuk analitik sub-detik baik di dalam maupun di luar data lakehouse. Dengan fleksibilitas untuk mendukung hampir semua skenario, StarRocks memberikan performa terbaik di kelasnya untuk analitik multi-dimensi, analitik real-time, dan kueri ad-hoc. Sebuah proyek Linux Foundation.

    12.057+28Perubahan bintang dalam 7 hari terakhir
  • quickwit@quickwit-oss

    Mesin pencari OSS cloud-native untuk observabilitas

    11.556+21Perubahan bintang dalam 7 hari terakhir
  • cython@cython

    Compiler Python ke C yang paling banyak digunakan.

    10.836+6Perubahan bintang dalam 7 hari terakhir
  • datafusion@apache

    Mesin Kueri SQL Apache DataFusion

    9.248+71Perubahan bintang dalam 7 hari terakhir
  • catboost@catboost

    Pustaka Gradient Boosting on Decision Trees yang cepat, dapat disesuaikan, dan berkinerja tinggi, digunakan untuk pemeringkatan, klasifikasi, regresi, dan tugas pembelajaran mesin lainnya untuk Python, R, Java, C++. Mendukung komputasi pada CPU dan GPU.

    9.085+13Perubahan bintang dalam 7 hari terakhir
  • delta@delta-io

    Framework penyimpanan open-source yang memungkinkan pembangunan arsitektur Lakehouse dengan engine komputasi termasuk Spark, PrestoDB, Flink, Trino, dan Hive serta API

    8.962+17Perubahan bintang dalam 7 hari terakhir
  • beam@apache

    Apache Beam adalah model pemrograman terpadu untuk pemrosesan data Batch dan Streaming.

    8.653+5Perubahan bintang dalam 7 hari terakhir
  • h2o-3@h2oai

    H2O adalah platform Machine Learning sumber terbuka yang terdistribusi, cepat, dan dapat diskalakan: Deep Learning, Gradient Boosting (GBM) & XGBoost, Random Forest, Generalized Linear Modeling (GLM dengan Elastic Net), K-Means, PCA, Generalized Additive Models (GAM), RuleFit, Support Vector Machine (SVM), Stacked Ensembles, Automatic Machine Learning (AutoML), dll.

    7.496+1Perubahan bintang dalam 7 hari terakhir
  • arkime@arkime

    Arkime adalah sistem penangkapan paket lengkap, pengindeksan, dan database berskala besar yang open source.

    7.460+12Perubahan bintang dalam 7 hari terakhir
  • feast@feast-dev

    Feature Store Open Source untuk AI/ML

    7.239+15Perubahan bintang dalam 7 hari terakhir
  • vespa@vespa-engine

    Platform pencarian AI

    7.072+14Perubahan bintang dalam 7 hari terakhir
  • couchdb@apache

    Basis data sinkronisasi multi-primer yang mulus dengan API HTTP/JSON intuitif, dirancang untuk keandalan

    6.944+5Perubahan bintang dalam 7 hari terakhir
  • zeppelin@apache

    Notebook berbasis web yang memungkinkan analitik data interaktif berbasis data dan dokumen kolaboratif dengan SQL, Scala, dan lainnya.

    6.655+3Perubahan bintang dalam 7 hari terakhir
  • hazelcast@hazelcast

    Hazelcast adalah platform data real-time terpadu yang menggabungkan pemrosesan stream dengan penyimpanan data yang cepat, memungkinkan pelanggan untuk bertindak secara instan pada data-in-motion untuk wawasan real-time.

    6.604+3Perubahan bintang dalam 7 hari terakhir
  • iotdb@apache

    Apache IoTDB

    6.385+2Perubahan bintang dalam 7 hari terakhir
  • pachyderm@pachyderm

    Pipeline yang Berpusat pada Data dan Versi Data

    6.308+1Perubahan bintang dalam 7 hari terakhir
  • hive@apache

    Apache Hive.

    6.015+1Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik