big-data
Repositori open source terpantau bertanda big-data, diurutkan berdasarkan bintang.
- #31
Mesin data berkinerja tinggi untuk beban kerja AI dan multimodal. Memproses gambar, audio, video, dan data terstruktur pada skala apa pun
★ 5.736+7Perubahan bintang dalam 7 hari terakhir - #32
Pustaka Python Machine Learning yang sederhana dan terdistribusi untuk memindahkan algoritma ML ke Spark.
★ 5.245+5Perubahan bintang dalam 7 hari terakhir - #33★ 5.180+4Perubahan bintang dalam 7 hari terakhir
- #34★ 5.082+3Perubahan bintang dalam 7 hari terakhir
- #35
Stream Framework adalah pustaka Python yang memungkinkan Anda membangun news feed, activity stream, dan sistem notifikasi menggunakan Cassandra dan/atau Redis. Penulis Stream-Framework juga menyediakan layanan cloud untuk teknologi feed:
★ 4.742-1Perubahan bintang dalam 7 hari terakhir - #36
Komponen Vue yang mendukung daftar data berukuran besar dengan performa render tinggi dan efisien.
★ 4.505-1Perubahan bintang dalam 7 hari terakhir - #37
Ubah kumpulan URL gambar yang besar menjadi dataset gambar dengan mudah. Mampu mengunduh, mengubah ukuran, dan mengemas 100 juta URL dalam 20 jam pada satu mesin.
★ 4.445+2Perubahan bintang dalam 7 hari terakhir - #38
CrateDB adalah database SQL terdistribusi dan skalabel untuk menyimpan serta menganalisis data dalam jumlah besar secara hampir real-time, bahkan dengan kueri yang kompleks. Kompatibel dengan PostgreSQL dan berbasis Lucene.
★ 4.432+5Perubahan bintang dalam 7 hari terakhir - #39★ 4.399+2Perubahan bintang dalam 7 hari terakhir
- #40
Peta Jalan Data Science dari A hingga Z
★ 4.354+2Perubahan bintang dalam 7 hari terakhir - #41
GraphScope: Sistem komputasi graf skala besar satu atap dari Alibaba
★ 3.557+1Perubahan bintang dalam 7 hari terakhir - #42
SQL Lexer dan Parser yang dapat diperluas untuk Rust.
★ 3.446+14Perubahan bintang dalam 7 hari terakhir - #43
Apache Paimon adalah format lake yang memungkinkan pembangunan Arsitektur Lakehouse Realtime dengan Flink dan Spark untuk operasi streaming maupun batch.
★ 3.388+3Perubahan bintang dalam 7 hari terakhir - #44★ 3.374+2Perubahan bintang dalam 7 hari terakhir
- #45
Pengganti Apache Spark drop-in yang ditulis dalam Rust, menyatukan pemrosesan batch, pemrosesan stream, dan beban kerja AI yang intensif komputasi.
★ 3.341+9Perubahan bintang dalam 7 hari terakhir - #46
Basis data graf yang mendukung lebih dari 100+ miliar data, berkinerja tinggi, dan skalabel (Termasuk OLTP Engine, REST-API, dan Backends)
★ 3.167+9Perubahan bintang dalam 7 hari terakhir - #47★ 3.098+1Perubahan bintang dalam 7 hari terakhir
- #48★ 2.656+20Perubahan bintang dalam 7 hari terakhir
- #49
ArcticDB adalah database DataFrame serverless berkinerja tinggi yang dibangun untuk ekosistem Data Science Python.
★ 2.505+12Perubahan bintang dalam 7 hari terakhir - #50★ 2.379+3Perubahan bintang dalam 7 hari terakhir
- #51
Apache Ambari menyederhanakan penyediaan, pengelolaan, dan pemantauan kluster Apache Hadoop.
★ 2.311+0Perubahan bintang dalam 7 hari terakhir - #52
YTsaurus adalah platform big data sumber terbuka yang dapat diskalakan dan toleran terhadap kesalahan.
★ 2.203+3Perubahan bintang dalam 7 hari terakhir - #53★ 2.131+18Perubahan bintang dalam 7 hari terakhir
- #54
Mesin Kueri Terdistribusi Apache DataFusion Ballista.
★ 2.127+12Perubahan bintang dalam 7 hari terakhir - #55
Apache Drill adalah lapisan kueri MPP terdistribusi untuk data yang mendeskripsikan diri sendiri
★ 2.022+0Perubahan bintang dalam 7 hari terakhir - #56
Apache BookKeeper - layanan penyimpanan yang skalabel, toleran terhadap kesalahan, dan berlatensi rendah yang dioptimalkan untuk beban kerja append-only.
★ 2.011+2Perubahan bintang dalam 7 hari terakhir - #57
Abstraksi dan akselerasi data yang fleksibel dan elastis untuk aplikasi BigData/AI di cloud. (Proyek di bawah CNCF)
★ 1.967+2Perubahan bintang dalam 7 hari terakhir - #58★ 1.913+0Perubahan bintang dalam 7 hari terakhir
- #59
🚀 500+ sumber pilihan untuk Analisis Data & Data Science: Python, SQL, Statistik, ML, AI, Visualisasi, Lembar Contek, Peta Jalan, Persiapan Wawancara. Untuk pemula dan ahli.
★ 1.890+16Perubahan bintang dalam 7 hari terakhir - #60
Akselerator Auron untuk kerangka kerja komputasi terdistribusi (misalnya, Spark) memanfaatkan eksekusi tervektorisasi bawaan untuk mempercepat pemrosesan kueri
★ 1.798+3Perubahan bintang dalam 7 hari terakhir