Saltar al contenido principal
buildradar
Sign in
Tema · parquet

parquet

Repositorios de código abierto monitorizados etiquetados con parquet, ordenados por estrellas.

Repositorios
39
Estrellas totales
93.140
Estrellas de media
2388
Proporción
0,00%

Temas que aparecen con frecuencia junto a parquet en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con parquet.

  • hflow@Hebbian-Robotics

    Open source SDK for building multimodal data-quality, processing, enrichment, and curation pipelines for robotics and Physical AI.

    143
  • questdb@questdb

    QuestDB es una base de datos de series temporales de código abierto y alto rendimiento

    17.295+6Variación de estrellas de los últimos 7 días
  • arrow@apache

    Apache Arrow es el formato columnar universal y conjunto de herramientas multi-lenguaje para el intercambio rápido de datos y análisis en memoria

    17.078+6Variación de estrellas de los últimos 7 días
  • Daft@Eventual-Inc

    Motor de datos de alto rendimiento para IA y cargas de trabajo multimodales. Procesa imágenes, audio, video y datos estructurados a cualquier escala

    5736+4Variación de estrellas de los últimos 7 días
  • arrow-rs@apache

    Implementación oficial en Rust de Apache Arrow

    3600+4Variación de estrellas de los últimos 7 días
  • roapi@roapi

    Crea API completas para conjuntos de datos de cambio lento sin escribir una sola línea de código.

    3429+1Variación de estrellas de los últimos 7 días
  • sail@lakehq

    Reemplazo directo de Apache Spark escrito en Rust, que unifica el procesamiento por lotes, el procesamiento de flujos y las cargas de trabajo de IA intensivas en computación.

    3341+4Variación de estrellas de los últimos 7 días
  • parquet-java@apache

    Apache Parquet para Java

    3078+0Variación de estrellas de los últimos 7 días
  • rill@rilldata

    La herramienta de inteligencia empresarial más rápida para humanos y agentes.

    2862+11Variación de estrellas de los últimos 7 días
  • parquet-format@apache

    Formato Apache Parquet

    2563+7Variación de estrellas de los últimos 7 días
  • parseable@parseablehq

    Parseable es una plataforma de observabilidad de infraestructura unificada y de código abierto construida en Rust sobre una arquitectura de lago de datos. Rastrea registros, métricas, trazas y eventos en aplicaciones, agentes y sistemas, reduciendo los costos de almacenamiento hasta en un 90% mediante compresión de telemetría columnar.

    2450+2Variación de estrellas de los últimos 7 días
  • drill@apache

    Apache Drill es una capa de consulta MPP distribuida para datos autodescriptivos.

    2022+0Variación de estrellas de los últimos 7 días
  • pg_mooncake@Mooncake-Labs

    Analítica en tiempo real en tablas de Postgres

    2003+0Variación de estrellas de los últimos 7 días
  • petastorm@uber

    La biblioteca Petastorm permite el entrenamiento y evaluación distribuida o en máquina única de modelos de deep learning desde conjuntos de datos en formato Apache Parquet.

    1892+0Variación de estrellas de los últimos 7 días
  • nisshi@nisshi-io

    Broker compatible con Apache Kafka® con S3, PostgreSQL, SQLite, Apache Iceberg y Delta Lake

    1853+1Variación de estrellas de los últimos 7 días
  • anyquery@julien040

    Una interfaz SQL única para más de 60 herramientas (por ejemplo, GitHub, Notion, Airtable). Conéctate a cualquier LLM a través de MCP.

    1772+2Variación de estrellas de los últimos 7 días
  • tonbo@tonbo-io

    Tonbo es una base de datos embebida para entornos de ejecución serverless y edge.

    1618+3Variación de estrellas de los últimos 7 días
  • cryo@paradigmxyz

    cryo es la forma más sencilla de extraer datos de blockchain a parquet, csv, json o dataframes de python

    1582+1Variación de estrellas de los últimos 7 días
  • BemiDB@BemiHQ

    Alternativa de código abierto a Snowflake y Fivetran, con compatibilidad con Postgres.

    1531+0Variación de estrellas de los últimos 7 días
  • olake@datazip-inc

    OLake: replicación rápida de bases de datos, Kafka y S3 a Apache Iceberg con optimización de tablas (OLake Fusion). Ingesta de datos eficiente, rápida y escalable para análisis en tiempo real. Fuentes compatibles: Postgres, MongoDB, MySQL, Oracle, MSSql, DB2, Kafka, S3.

    1435+2Variación de estrellas de los últimos 7 días
  • quilt@quiltdata

    Quilt es una plataforma de gestión de datos científicos en AWS que ayuda a los equipos y a la IA a encontrar, confiar y reutilizar datos a través de paquetes de datos con versiones profundas y ricos en contexto.

    1370+0Variación de estrellas de los últimos 7 días
  • Aplicación de escritorio simple para Windows para ver y consultar archivos Apache Parquet

    1231+2Variación de estrellas de los últimos 7 días
  • ClickBench@ClickHouse

    ClickBench: una prueba de rendimiento para bases de datos analíticas

    1100+8Variación de estrellas de los últimos 7 días
  • adam@bigdatagenomics

    ADAM es una plataforma de análisis genómico con formatos de archivo especializados construidos usando Apache Avro, Apache Spark y Apache Parquet. Licenciado bajo Apache 2.

    1059+2Variación de estrellas de los últimos 7 días
  • lonboard@developmentseed

    Visualización de datos geoespaciales rápida e interactiva en Jupyter.

    963+1Variación de estrellas de los últimos 7 días
  • hyparquet@hyparam

    Analizador de archivos parquet para JavaScript

    950+8Variación de estrellas de los últimos 7 días
  • ChoETL@Cinchoo

    Framework ETL para .NET (analizador/escritor para archivos en formato CSV, Flat, Xml, JSON, Key-Value, Parquet, Yaml y Avro).

    859+0Variación de estrellas de los últimos 7 días
  • DevOps-Python-tools@HariSekhon

    Más de 80 herramientas CLI para DevOps y datos: AWS, GCP, GCF Python Cloud Functions, anonimizador de logs, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, conversores y validadores de datos Spark (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr, etc.

    824+0Variación de estrellas de los últimos 7 días
  • parquet-go@parquet-go

    Paquete de Go de alto rendimiento para leer y escribir archivos Parquet

    769+2Variación de estrellas de los últimos 7 días
  • kglab@DerwenAI

    Graph Data Science: una capa de abstracción en Python para construir grafos de conocimiento, integrada con bibliotecas de grafos populares como Pandas, NetworkX, RAPIDS, RDFlib, pySHACL, PyVis, morph-kgc, pslpython, pyarrow, entre otras.

    691+2Variación de estrellas de los últimos 7 días
  • pg_parquet@CrunchyData

    Copiar hacia/desde Parquet en S3, Azure Blob Storage, Google Cloud Storage, almacenes http(s), archivos locales o flujo de entrada/salida estándar desde PostgreSQL

    685+0Variación de estrellas de los últimos 7 días
← Volver a temas