parquet
parquet टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर parquet के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और parquet टैग वाली रिपॉजिटरी।
- #1★ 17,295+6पिछले 7 दिनों में स्टार का बदलाव
- #2
Apache Arrow तेज़ डेटा एक्सचेंज और इन-मेमोरी एनालिटिक्स के लिए एक सार्वभौमिक कॉलमुलर फॉर्मेट और बहु-भाषी टूलबॉक्स है
★ 17,078+6पिछले 7 दिनों में स्टार का बदलाव - #3
AI और मल्टीमॉडल वर्कलोड के लिए हाई-परफॉर्मेंस डेटा इंजन। किसी भी पैमाने पर इमेज, ऑडियो, वीडियो और स्ट्रक्चर्ड डेटा को प्रोसेस करें
★ 5,736+4पिछले 7 दिनों में स्टार का बदलाव - #4★ 3,600+4पिछले 7 दिनों में स्टार का बदलाव
- #5★ 3,429+1पिछले 7 दिनों में स्टार का बदलाव
- #6
Rust में लिखा गया ड्रॉप-इन Apache Spark रिप्लेसमेंट, जो बैच प्रोसेसिंग, स्ट्रीम प्रोसेसिंग और कंप्यूट-इंटेंसिव AI वर्कलोड को एकजुट करता है।
★ 3,341+4पिछले 7 दिनों में स्टार का बदलाव - #7
Apache Parquet Java
★ 3,078+0पिछले 7 दिनों में स्टार का बदलाव - #8★ 2,862+11पिछले 7 दिनों में स्टार का बदलाव
- #9
Apache Parquet Format
★ 2,563+7पिछले 7 दिनों में स्टार का बदलाव - #10
Parseable एक ओपन-सोर्स, एकीकृत बुनियादी ढांचा प्रेक्षणीयता प्लेटफ़ॉर्म है जिसे डेटा लेक आर्किटेक्चर पर Rust में बनाया गया है। यह ऐप्स, एजेंटों और सिस्टम में लॉग, मेट्रिक्स, ट्रेसेस और इवेंट्स को ट्रैक करता है, और स्तंभ टेलीमेट्री संपीड़न के माध्यम से स्टोरेज लागत को 90% तक कम करता है।
★ 2,450+2पिछले 7 दिनों में स्टार का बदलाव - #11★ 2,022+0पिछले 7 दिनों में स्टार का बदलाव
- #12
Postgres टेबल पर रीयल-टाइम एनालिटिक्स
★ 2,003+0पिछले 7 दिनों में स्टार का बदलाव - #13
Petastorm लाइब्रेरी Apache Parquet फॉर्मेट में डेटासेट से डीप लर्निंग मॉडल के सिंगल-मशीन या वितरित प्रशिक्षण और मूल्यांकन को सक्षम बनाती है। यह Tensorflow, Pytorch, और PySpark जैसे ML फ्रेमवर्क का समर्थन करती है और इसका उपयोग शुद्ध Python कोड से किया जा सकता है।
★ 1,892+0पिछले 7 दिनों में स्टार का बदलाव - #14
S3, PostgreSQL, SQLite, Apache Iceberg और Delta Lake के साथ Apache Kafka® संगत ब्रोकर
★ 1,853+1पिछले 7 दिनों में स्टार का बदलाव - #15
60+ टूल के लिए एक SQL इंटरफ़ेस (उदा. GitHub, Notion, Airtable)। MCP के माध्यम से किसी भी LLM में प्लग इन करें।
★ 1,772+2पिछले 7 दिनों में स्टार का बदलाव - #16★ 1,618+3पिछले 7 दिनों में स्टार का बदलाव
- #17
cryo ब्लॉकचेन डेटा को parquet, csv, json, या python डेटाफ्रेम में निकालने का सबसे आसान तरीका है
★ 1,582+1पिछले 7 दिनों में स्टार का बदलाव - #18★ 1,531+0पिछले 7 दिनों में स्टार का बदलाव
- #19
OLake - टेबल ऑप्टिमाइज़ेशन के साथ Apache Iceberg के लिए सबसे तेज डेटाबेस, Kafka और S3 प्रतिकृति (OLake Fusion कहा जाता है)। रियल-टाइम एनालिटिक्स के लिए कुशल, त्वरित और स्केलेबल डेटा इंजेशन। समर्थित स्रोत: Postgres, MongoDB, MySQL, Oracle, MSSql, DB2, Kafka, S3।
★ 1,435+2पिछले 7 दिनों में स्टार का बदलाव - #20
Quilt AWS पर एक वैज्ञानिक डेटा प्रबंधन प्लेटफ़ॉर्म है जो टीमों और AI को गहराई से वर्शन किए गए, संदर्भ-समृद्ध डेटा पैकेजों के माध्यम से डेटा खोजने, उस पर भरोसा करने और उसका पुन: उपयोग करने में मदद करता है।
★ 1,370+0पिछले 7 दिनों में स्टार का बदलाव - #21
Apache Parquet फ़ाइलों को देखने और क्वेरी करने के लिए सरल Windows डेस्कटॉप एप्लिकेशन
★ 1,231+2पिछले 7 दिनों में स्टार का बदलाव - #22
ClickBench: विश्लेषणात्मक डेटाबेस के लिए एक बेंचमार्क
★ 1,101+8पिछले 7 दिनों में स्टार का बदलाव - #23
ADAM एक जीनोमिक्स विश्लेषण प्लेटफ़ॉर्म है जिसमें Apache Avro, Apache Spark और Apache Parquet का उपयोग करके बनाए गए विशेष फ़ाइल फॉर्मेट शामिल हैं। Apache 2 लाइसेंस प्राप्त।
★ 1,059+2पिछले 7 दिनों में स्टार का बदलाव - #24★ 963+1पिछले 7 दिनों में स्टार का बदलाव
- #25★ 950+8पिछले 7 दिनों में स्टार का बदलाव
- #26
.NET के लिए ETL फ्रेमवर्क (CSV, Flat, Xml, JSON, Key-Value, Parquet, Yaml, Avro फ़ॉर्मेटेड फ़ाइलों के लिए Parser / Writer)
★ 859+0पिछले 7 दिनों में स्टार का बदलाव - #27
80+ DevOps और Data CLI टूल्स - AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, Spark Data Converters & Validators (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr आदि
★ 824+0पिछले 7 दिनों में स्टार का बदलाव - #28
Parquet फाइलों को पढ़ने और लिखने के लिए उच्च-प्रदर्शन वाला Go पैकेज
★ 769+2पिछले 7 दिनों में स्टार का बदलाव - #29
Graph Data Science: नॉलेज ग्राफ बनाने के लिए Python में एक एब्स्ट्रैक्शन लेयर, जो लोकप्रिय ग्राफ लाइब्रेरीज़ (Pandas, NetworkX, RAPIDS, RDFlib, pySHACL, PyVis, morph-kgc, pslpython, pyarrow आदि) के साथ एकीकृत है।
★ 691+2पिछले 7 दिनों में स्टार का बदलाव - #30
PostgreSQL के भीतर से S3, Azure Blob Storage, Google Cloud Storage, http(s) स्टोर, स्थानीय फ़ाइलों या मानक इनपुट/आउटपुट स्ट्रीम में/से Parquet कॉपी करें
★ 685+0पिछले 7 दिनों में स्टार का बदलाव