Lompat ke konten utama
buildradar
Sign in
Topik · big-data

big-data

Repositori open source terpantau bertanda big-data, diurutkan berdasarkan bintang.

110 repositori
  • Daft@Eventual-Inc

    Mesin data berkinerja tinggi untuk beban kerja AI dan multimodal. Memproses gambar, audio, video, dan data terstruktur pada skala apa pun

    5.736+7Perubahan bintang dalam 7 hari terakhir
  • SynapseML@microsoft

    Pustaka Python Machine Learning yang sederhana dan terdistribusi untuk memindahkan algoritma ML ke Spark.

    5.245+5Perubahan bintang dalam 7 hari terakhir
  • calcite@apache

    Apache Calcite

    5.180+4Perubahan bintang dalam 7 hari terakhir
  • ignite@apache

    Apache Ignite

    5.082+3Perubahan bintang dalam 7 hari terakhir
  • Stream-Framework@tschellenbach

    Stream Framework adalah pustaka Python yang memungkinkan Anda membangun news feed, activity stream, dan sistem notifikasi menggunakan Cassandra dan/atau Redis. Penulis Stream-Framework juga menyediakan layanan cloud untuk teknologi feed:

    4.742-1Perubahan bintang dalam 7 hari terakhir
  • Komponen Vue yang mendukung daftar data berukuran besar dengan performa render tinggi dan efisien.

    4.505-1Perubahan bintang dalam 7 hari terakhir
  • img2dataset@rom1504

    Ubah kumpulan URL gambar yang besar menjadi dataset gambar dengan mudah. Mampu mengunduh, mengubah ukuran, dan mengemas 100 juta URL dalam 20 jam pada satu mesin.

    4.445+2Perubahan bintang dalam 7 hari terakhir
  • crate@crate

    CrateDB adalah database SQL terdistribusi dan skalabel untuk menyimpan serta menganalisis data dalam jumlah besar secara hampir real-time, bahkan dengan kueri yang kompleks. Kompatibel dengan PostgreSQL dan berbasis Lucene.

    4.432+5Perubahan bintang dalam 7 hari terakhir
  • fastjson2@alibaba

    🚄 FASTJSON2 adalah pustaka JSON Java dengan performa luar biasa.

    4.399+2Perubahan bintang dalam 7 hari terakhir
  • Data-Science-Roadmap@Moataz-Elmesmary

    Peta Jalan Data Science dari A hingga Z

    4.354+2Perubahan bintang dalam 7 hari terakhir
  • GraphScope@alibaba

    GraphScope: Sistem komputasi graf skala besar satu atap dari Alibaba

    3.557+1Perubahan bintang dalam 7 hari terakhir
  • SQL Lexer dan Parser yang dapat diperluas untuk Rust.

    3.446+14Perubahan bintang dalam 7 hari terakhir
  • paimon@apache

    Apache Paimon adalah format lake yang memungkinkan pembangunan Arsitektur Lakehouse Realtime dengan Flink dan Spark untuk operasi streaming maupun batch.

    3.388+3Perubahan bintang dalam 7 hari terakhir
  • koalas@databricks

    Koalas: API pandas di Apache Spark

    3.374+2Perubahan bintang dalam 7 hari terakhir
  • sail@lakehq

    Pengganti Apache Spark drop-in yang ditulis dalam Rust, menyatukan pemrosesan batch, pemrosesan stream, dan beban kerja AI yang intensif komputasi.

    3.341+9Perubahan bintang dalam 7 hari terakhir
  • hugegraph@apache

    Basis data graf yang mendukung lebih dari 100+ miliar data, berkinerja tinggi, dan skalabel (Termasuk OLTP Engine, REST-API, dan Backends)

    3.167+9Perubahan bintang dalam 7 hari terakhir
  • CBoard@TuiQiao

    Platform pelaporan BI dan dasbor BI swalayan yang mudah digunakan.

    3.098+1Perubahan bintang dalam 7 hari terakhir
  • kafka-ui@kafbat

    Web UI sumber terbuka untuk mengelola kluster Apache Kafka

    2.656+20Perubahan bintang dalam 7 hari terakhir
  • ArcticDB@man-group

    ArcticDB adalah database DataFrame serverless berkinerja tinggi yang dibangun untuk ekosistem Data Science Python.

    2.505+12Perubahan bintang dalam 7 hari terakhir
  • quary@quarylabs

    BI open-source untuk engineer

    2.379+3Perubahan bintang dalam 7 hari terakhir
  • ambari@apache

    Apache Ambari menyederhanakan penyediaan, pengelolaan, dan pemantauan kluster Apache Hadoop.

    2.311+0Perubahan bintang dalam 7 hari terakhir
  • ytsaurus@ytsaurus

    YTsaurus adalah platform big data sumber terbuka yang dapat diskalakan dan toleran terhadap kesalahan.

    2.203+3Perubahan bintang dalam 7 hari terakhir
  • fluss@apache

    Apache Fluss adalah penyimpanan streaming yang dibuat untuk analitik waktu nyata.

    2.131+18Perubahan bintang dalam 7 hari terakhir
  • Mesin Kueri Terdistribusi Apache DataFusion Ballista.

    2.127+12Perubahan bintang dalam 7 hari terakhir
  • drill@apache

    Apache Drill adalah lapisan kueri MPP terdistribusi untuk data yang mendeskripsikan diri sendiri

    2.022+0Perubahan bintang dalam 7 hari terakhir
  • bookkeeper@apache

    Apache BookKeeper - layanan penyimpanan yang skalabel, toleran terhadap kesalahan, dan berlatensi rendah yang dioptimalkan untuk beban kerja append-only.

    2.011+2Perubahan bintang dalam 7 hari terakhir
  • fluid@fluid-cloudnative

    Abstraksi dan akselerasi data yang fleksibel dan elastis untuk aplikasi BigData/AI di cloud. (Proyek di bawah CNCF)

    1.967+2Perubahan bintang dalam 7 hari terakhir
  • kudu@apache

    Mirror dari Apache Kudu.

    1.913+0Perubahan bintang dalam 7 hari terakhir
  • awesome-data-analysis@PavelGrigoryevDS

    🚀 500+ sumber pilihan untuk Analisis Data & Data Science: Python, SQL, Statistik, ML, AI, Visualisasi, Lembar Contek, Peta Jalan, Persiapan Wawancara. Untuk pemula dan ahli.

    1.890+16Perubahan bintang dalam 7 hari terakhir
  • auron@apache

    Akselerator Auron untuk kerangka kerja komputasi terdistribusi (misalnya, Spark) memanfaatkan eksekusi tervektorisasi bawaan untuk mempercepat pemrosesan kueri

    1.798+3Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik