Pular para o conteúdo principal
buildradar
Sign in
Tópico · parquet

parquet

Repositórios de código aberto acompanhados marcados com parquet, ordenados por estrelas.

Repositórios
39
Total de estrelas
93.140
Média de estrelas
2.388
Participação
0,00%

Tópicos que aparecem com frequência ao lado de parquet no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com parquet.

  • hflow@Hebbian-Robotics

    Open source SDK for building multimodal data-quality, processing, enrichment, and curation pipelines for robotics and Physical AI.

    143
  • questdb@questdb

    QuestDB é um banco de dados de séries temporais de alto desempenho e open-source.

    17.295+6Variação de estrelas nos últimos 7 dias
  • arrow@apache

    Apache Arrow é o formato colunar universal e a caixa de ferramentas multilíngue para troca rápida de dados e análise em memória

    17.078+6Variação de estrelas nos últimos 7 dias
  • Daft@Eventual-Inc

    Motor de dados de alto desempenho para IA e cargas de trabalho multimodais. Processe imagens, áudio, vídeo e dados estruturados em qualquer escala.

    5.736+4Variação de estrelas nos últimos 7 dias
  • arrow-rs@apache

    Implementação oficial em Rust do Apache Arrow

    3.600+4Variação de estrelas nos últimos 7 dias
  • roapi@roapi

    Crie APIs completas para conjuntos de dados de movimentação lenta sem escrever uma única linha de código.

    3.429+1Variação de estrelas nos últimos 7 dias
  • sail@lakehq

    Substituto direto para o Apache Spark escrito em Rust, unificando processamento em lote, processamento de fluxo e cargas de trabalho de IA intensivas em computação.

    3.341+4Variação de estrelas nos últimos 7 dias
  • parquet-java@apache

    Apache Parquet Java

    3.078+0Variação de estrelas nos últimos 7 dias
  • rill@rilldata

    A ferramenta de inteligência de negócios mais rápida para humanos e agentes.

    2.862+11Variação de estrelas nos últimos 7 dias
  • parquet-format@apache

    Formato Apache Parquet.

    2.563+7Variação de estrelas nos últimos 7 dias
  • parseable@parseablehq

    Parseable é uma plataforma de observabilidade de infraestrutura unificada de código aberto, construída em Rust sobre uma arquitetura de data lake. Ela rastreia logs, métricas, traces e eventos em aplicativos, agentes e sistemas, reduzindo os custos de armazenamento em até 90% por meio de compressão de telemetria colunar.

    2.450+2Variação de estrelas nos últimos 7 dias
  • drill@apache

    Apache Drill é uma camada de consulta MPP distribuída para dados autodescritivos.

    2.022+0Variação de estrelas nos últimos 7 dias
  • pg_mooncake@Mooncake-Labs

    Análise em tempo real em tabelas Postgres

    2.003+0Variação de estrelas nos últimos 7 dias
  • petastorm@uber

    A biblioteca Petastorm permite o treinamento e avaliação, em máquina única ou distribuída, de modelos de deep learning a partir de datasets no formato Apache Parquet. Suporta frameworks de ML como Tensorflow, Pytorch e PySpark, podendo ser utilizada a partir de código Python puro

    1.892+0Variação de estrelas nos últimos 7 dias
  • nisshi@nisshi-io

    Broker compatível com Apache Kafka® com suporte para S3, PostgreSQL, SQLite, Apache Iceberg e Delta Lake.

    1.853+1Variação de estrelas nos últimos 7 dias
  • anyquery@julien040

    Uma interface SQL para mais de 60 ferramentas (ex: GitHub, Notion, Airtable). Conecte-se a qualquer LLM via MCP.

    1.772+2Variação de estrelas nos últimos 7 dias
  • tonbo@tonbo-io

    Tonbo é um banco de dados embarcado para runtimes serverless e edge.

    1.618+3Variação de estrelas nos últimos 7 dias
  • cryo@paradigmxyz

    cryo é a maneira mais fácil de extrair dados de blockchain para parquet, csv, json ou dataframes do python

    1.582+1Variação de estrelas nos últimos 7 dias
  • BemiDB@BemiHQ

    Alternativa open-source ao Snowflake e Fivetran, com compatibilidade com Postgres.

    1.531+0Variação de estrelas nos últimos 7 dias
  • olake@datazip-inc

    OLake - Replicação mais rápida de bancos de dados, Kafka e S3 para Apache Iceberg com otimização de tabelas (chamada OLake Fusion). Ingestão de dados eficiente, rápida e escalável para análise em tempo real. Fontes suportadas: Postgres, MongoDB, MySQL, Oracle, MSSql, DB2, Kafka, S3.

    1.435+2Variação de estrelas nos últimos 7 dias
  • quilt@quiltdata

    Quilt é uma plataforma de gerenciamento de dados científicos na AWS que ajuda equipes e IA a encontrar, confiar e reutilizar dados por meio de pacotes de dados profundamente versionados e ricos em contexto.

    1.370+0Variação de estrelas nos últimos 7 dias
  • Aplicativo de desktop Windows simples para visualizar e consultar arquivos Apache Parquet.

    1.231+2Variação de estrelas nos últimos 7 dias
  • ClickBench@ClickHouse

    ClickBench: um benchmark para bancos de dados analíticos.

    1.101+8Variação de estrelas nos últimos 7 dias
  • adam@bigdatagenomics

    ADAM é uma plataforma de análise genômica com formatos de arquivo especializados construída usando Apache Avro, Apache Spark e Apache Parquet. Licenciado sob Apache 2.

    1.059+2Variação de estrelas nos últimos 7 dias
  • lonboard@developmentseed

    Visualização de dados geoespaciais rápida e interativa no Jupyter.

    963+1Variação de estrelas nos últimos 7 dias
  • hyparquet@hyparam

    Analisador de arquivos parquet para javascript

    950+8Variação de estrelas nos últimos 7 dias
  • ChoETL@Cinchoo

    Framework ETL para .NET (Parser / Writer para arquivos formatados em CSV, Flat, Xml, JSON, Key-Value, Parquet, Yaml, Avro)

    859+0Variação de estrelas nos últimos 7 dias
  • DevOps-Python-tools@HariSekhon

    Mais de 80 ferramentas CLI para DevOps e Dados - AWS, GCP, GCF Python Cloud Functions, anonimizador de logs, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, conversores e validadores de dados Spark (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr, etc.

    824+0Variação de estrelas nos últimos 7 dias
  • parquet-go@parquet-go

    Pacote Go de alto desempenho para leitura e escrita de arquivos Parquet

    769+2Variação de estrelas nos últimos 7 dias
  • kglab@DerwenAI

    Graph Data Science: uma camada de abstração em Python para construir grafos de conhecimento, integrada com bibliotecas de grafos populares – sobre Pandas, NetworkX, RAPIDS, RDFlib, pySHACL, PyVis, morph-kgc, pslpython, pyarrow, etc.

    691+2Variação de estrelas nos últimos 7 dias
  • pg_parquet@CrunchyData

    Copiar para/de Parquet no S3, Azure Blob Storage, Google Cloud Storage, armazenamentos http(s), arquivos locais ou fluxo de entrada/saída padrão a partir do PostgreSQL

    685+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos