跳到主要内容
buildradar
登录
主题 · parquet

parquet

标记 parquet 主题、收录中的开源项目,按星标数排序。

项目数
39
总星标数
93,140
平均星标数
2,388
占比
0.00%

常跟 parquet 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 parquet 主题的项目。

  • hflow@Hebbian-Robotics

    Open source SDK for building multimodal data-quality, processing, enrichment, and curation pipelines for robotics and Physical AI.

    143
  • questdb@questdb

    QuestDB 是高性能、开源的时序数据库

    17,295+0近 7 天星标变化
  • arrow@apache

    Apache Arrow 是通用的列式格式与多语言工具箱,用于快速数据交换与内存分析。

    17,078+0近 7 天星标变化
  • Daft@Eventual-Inc

    高性能数据引擎,适用于 AI 与多模态工作负载。可在任何规模下处理图像、音频、视频和结构化数据

    5,736+0近 7 天星标变化
  • arrow-rs@apache

    Apache Arrow 官方 Rust 实作

    3,600+0近 7 天星标变化
  • roapi@roapi

    为缓慢移动的数据集创建完整功能的 API,无需编写任何代码。

    3,429+0近 7 天星标变化
  • sail@lakehq

    以 Rust 编写的 Apache Spark 无缝替代方案,统一了批处理、流处理和计算密集型 AI 工作负载。

    3,341+0近 7 天星标变化
  • parquet-java@apache

    Apache Parquet Java。

    3,078+0近 7 天星标变化
  • rill@rilldata

    为人类与 AI 代理打造的最快商业智能工具。

    2,862+0近 7 天星标变化
  • parquet-format@apache

    Apache Parquet 格式

    2,563+0近 7 天星标变化
  • parseable@parseablehq

    Parseable 是一个开源、统一的基础设施可观测性平台,采用 Rust 语言及数据湖架构构建。它可以跟踪应用程序、Agent 与系统之间的日志、指标、追踪(traces)及事件,并通过列式遥测压缩降低高达 90% 的存储成本。

    2,450+0近 7 天星标变化
  • drill@apache

    Apache Drill 是一个用于自描述数据的分布式 MPP 查询层

    2,022+0近 7 天星标变化
  • pg_mooncake@Mooncake-Labs

    对 Postgres 数据表进行实时分析

    2,003+0近 7 天星标变化
  • petastorm@uber

    Petastorm 库支持从 Apache Parquet 格式的数据集进行深度学习模型的单机或分布式训练与评估。它支持 TensorFlow、PyTorch 和 PySpark 等 ML 框架,并可直接从纯 Python 代码中使用。

    1,892+0近 7 天星标变化
  • nisshi@nisshi-io

    兼容 Apache Kafka® 的 Broker,支持 S3、PostgreSQL、SQLite、Apache Iceberg 和 Delta Lake。

    1,853+0近 7 天星标变化
  • anyquery@julien040

    为 60 多种工具(例如 GitHub、Notion、Airtable)提供单一 SQL 接口。通过 MCP 连接到任何 LLM。

    1,772+0近 7 天星标变化
  • tonbo@tonbo-io

    Tonbo 是一个用于无服务器与边缘运行环境的嵌入式数据库。

    1,618+0近 7 天星标变化
  • cryo@paradigmxyz

    cryo 是将区块链数据导出至 Parquet、CSV、JSON 或 Python 数据框架的最简单方法。

    1,582+0近 7 天星标变化
  • BemiDB@BemiHQ

    开源的 Snowflake 与 Fivetran 替代方案,具备 Postgres 兼容性。

    1,531+0近 7 天星标变化
  • olake@datazip-inc

    OLake - 最快的数据库、Kafka 与 S3 复制工具,支持 Apache Iceberg 与表格优化(称为 OLake Fusion)。⚡ 针对实时分析提供高效、快速且具可扩展性的数据导入。支持的来源:Postgres, MongoDB, MySQL, Oracle, MSSql, DB2, Kafka, S3。

    1,435+0近 7 天星标变化
  • quilt@quiltdata

    Quilt 是 AWS 上的科学数据管理平台,通过具有深度版本控制且内容丰富的数据套件,帮助团队和 AI 寻找、信任并重复使用数据。

    1,370+0近 7 天星标变化
  • 用于查看与查询 Apache Parquet 文件的简易 Windows 桌面应用程序

    1,231+0近 7 天星标变化
  • ClickBench@ClickHouse

    ClickBench:分析型数据库的基准测试工具

    1,102+7近 7 天星标变化
  • adam@bigdatagenomics

    ADAM 是一个基因组分析平台,采用 Apache Avro、Apache Spark 和 Apache Parquet 建构特制档案格式。采用 Apache 2 授权。

    1,059+0近 7 天星标变化
  • lonboard@developmentseed

    在 Jupyter 中进行快速、交互式的地理空间数据可视化。

    963-1近 7 天星标变化
  • hyparquet@hyparam

    JavaScript 的 parquet 文件解析器

    950+0近 7 天星标变化
  • ChoETL@Cinchoo

    .NET 的 ETL 框架(支持 CSV、Flat、Xml、JSON、Key-Value、Parquet、Yaml、Avro 格式文件的解析器与写入器)

    859-1近 7 天星标变化
  • DevOps-Python-tools@HariSekhon

    80+ DevOps 与数据 CLI 工具 - AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, Spark 数据转换器与验证器 (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr 等。

    824+0近 7 天星标变化
  • parquet-go@parquet-go

    高性能的 Go 软件包,用于读写 Parquet 文件

    770+2近 7 天星标变化
  • kglab@DerwenAI

    图资料科学(Graph Data Science):用于构建知识图谱的 Python 抽象层,集成了热门的图函式库——基于 Pandas、NetworkX、RAPIDS、RDFlib、pySHACL、PyVis、morph-kgc、pslpython、pyarrow 等。

    691+0近 7 天星标变化
  • pg_parquet@CrunchyData

    在 PostgreSQL 内部与 S3、Azure Blob Storage、Google Cloud Storage、http(s) 存储空间、本地文件或标准输入输出流之间进行 Parquet 复制

    686+1近 7 天星标变化
← 返回主题列表