跳到主要內容
buildradar
Sign in
主題 · parquet

parquet

標記 parquet 主題、收錄中的開源專案,依星數排序。

專案數
39
總星數
93,140
平均星數
2,388
佔比
0.00%

常跟 parquet 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 parquet 主題的專案。

  • hflow@Hebbian-Robotics

    Open source SDK for building multimodal data-quality, processing, enrichment, and curation pipelines for robotics and Physical AI.

    143
  • questdb@questdb

    QuestDB 是高效能、開源的時序資料庫

    17,295+6近 7 天星數變化
  • arrow@apache

    Apache Arrow 是通用的列式格式與多語言工具箱,用於快速資料交換與記憶體內分析。

    17,078+6近 7 天星數變化
  • Daft@Eventual-Inc

    高性能数据引擎,适用于 AI 与多模态工作负载。可在任何规模下处理图像、音频、视频和结构化数据

    5,736+4近 7 天星數變化
  • arrow-rs@apache

    Apache Arrow 官方 Rust 實作

    3,600+4近 7 天星數變化
  • roapi@roapi

    為緩慢移動的資料集創建完整功能的 API,無需撰寫任何程式碼。

    3,429+1近 7 天星數變化
  • sail@lakehq

    以 Rust 編寫的 Apache Spark 無縫替代方案,統一了批次處理、串流處理和運算密集型 AI 工作負載。

    3,341+4近 7 天星數變化
  • parquet-java@apache

    Apache Parquet Java。

    3,078+0近 7 天星數變化
  • rill@rilldata

    為人類與 AI 代理打造的最快商業智慧工具。

    2,862+11近 7 天星數變化
  • parquet-format@apache

    Apache Parquet 格式

    2,563+7近 7 天星數變化
  • parseable@parseablehq

    Parseable 是個開源、統一的基礎設施可觀測性平台,採用 Rust 語言及數據湖架構建置。它可以追蹤應用程式、Agent 與系統之間的日誌、指標、追蹤(traces)及事件,並透過欄位式遙測壓縮降低高達 90% 的儲存成本。

    2,450+2近 7 天星數變化
  • drill@apache

    Apache Drill 是一個用於自我描述資料的分散式 MPP 查詢層

    2,022+0近 7 天星數變化
  • pg_mooncake@Mooncake-Labs

    對 Postgres 資料表進行即時分析

    2,003+0近 7 天星數變化
  • petastorm@uber

    Petastorm 庫支援從 Apache Parquet 格式的資料集進行深度學習模型的單機或分散式訓練與評估。它支援 TensorFlow、PyTorch 和 PySpark 等 ML 框架,並可直接從純 Python 程式碼中使用。

    1,892+0近 7 天星數變化
  • nisshi@nisshi-io

    相容 Apache Kafka® 的 Broker,支援 S3、PostgreSQL、SQLite、Apache Iceberg 及 Delta Lake。

    1,853+1近 7 天星數變化
  • anyquery@julien040

    為 60 多種工具(例如 GitHub、Notion、Airtable)提供單一 SQL 介面。透過 MCP 連接到任何 LLM。

    1,772+2近 7 天星數變化
  • tonbo@tonbo-io

    Tonbo 是一個用於無伺服器與邊緣執行環境的嵌入式資料庫。

    1,618+3近 7 天星數變化
  • cryo@paradigmxyz

    cryo 是將區塊鏈資料匯出至 Parquet、CSV、JSON 或 Python 資料框架的最簡單方法。

    1,582+1近 7 天星數變化
  • BemiDB@BemiHQ

    開源的 Snowflake 與 Fivetran 替代方案,具備 Postgres 相容性。

    1,531+0近 7 天星數變化
  • olake@datazip-inc

    OLake - 最快的資料庫、Kafka 與 S3 複製工具,支援 Apache Iceberg 與表格最佳化(稱為 OLake Fusion)。⚡ 針對即時分析提供高效、快速且具擴充性的資料匯入。支援的來源:Postgres, MongoDB, MySQL, Oracle, MSSql, DB2, Kafka, S3。

    1,435+2近 7 天星數變化
  • quilt@quiltdata

    Quilt 是 AWS 上的科學資料管理平臺,透過具有深度版本控制且內容豐富的資料套件,幫助團隊和 AI 尋找、信任並重複使用資料。

    1,370+0近 7 天星數變化
  • 用於檢視與查詢 Apache Parquet 檔案的簡易 Windows 桌面應用程式

    1,231+2近 7 天星數變化
  • ClickBench@ClickHouse

    ClickBench:分析型資料庫的基準測試工具

    1,101+9近 7 天星數變化
  • adam@bigdatagenomics

    ADAM 是一個基因體分析平台,採用 Apache Avro、Apache Spark 和 Apache Parquet 建構特製檔案格式。採用 Apache 2 授權。

    1,059+2近 7 天星數變化
  • lonboard@developmentseed

    在 Jupyter 中進行快速、互動式的地理空間資料視覺化。

    963+1近 7 天星數變化
  • hyparquet@hyparam

    JavaScript 的 parquet 檔案解析器

    950+8近 7 天星數變化
  • ChoETL@Cinchoo

    .NET 的 ETL 框架(支援 CSV、Flat、Xml、JSON、Key-Value、Parquet、Yaml、Avro 格式檔案的解析器與寫入器)

    859-1近 7 天星數變化
  • DevOps-Python-tools@HariSekhon

    80+ DevOps 與資料 CLI 工具 - AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, Spark 資料轉換器與驗證器 (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr 等。

    824+0近 7 天星數變化
  • parquet-go@parquet-go

    高效能的 Go 套件,用於讀寫 Parquet 檔案

    769+2近 7 天星數變化
  • kglab@DerwenAI

    圖學資料科學(Graph Data Science):用於建構知識圖譜的 Python 抽象層,整合了熱門的圖學函式庫——基於 Pandas、NetworkX、RAPIDS、RDFlib、pySHACL、PyVis、morph-kgc、pslpython、pyarrow 等。

    691+2近 7 天星數變化
  • pg_parquet@CrunchyData

    在 PostgreSQL 內部與 S3、Azure Blob Storage、Google Cloud Storage、http(s) 儲存空間、本機檔案或標準輸入輸出串流之間進行 Parquet 複製

    686+0近 7 天星數變化
← 返回主題列表