parquet
Repositorios de código abierto monitorizados etiquetados con parquet, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a parquet en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con parquet.
- #1
QuestDB es una base de datos de series temporales de código abierto y alto rendimiento
★ 17.295+6Variación de estrellas de los últimos 7 días - #2
Apache Arrow es el formato columnar universal y conjunto de herramientas multi-lenguaje para el intercambio rápido de datos y análisis en memoria
★ 17.078+6Variación de estrellas de los últimos 7 días - #3
Motor de datos de alto rendimiento para IA y cargas de trabajo multimodales. Procesa imágenes, audio, video y datos estructurados a cualquier escala
★ 5736+4Variación de estrellas de los últimos 7 días - #4★ 3600+4Variación de estrellas de los últimos 7 días
- #5
Crea API completas para conjuntos de datos de cambio lento sin escribir una sola línea de código.
★ 3429+1Variación de estrellas de los últimos 7 días - #6
Reemplazo directo de Apache Spark escrito en Rust, que unifica el procesamiento por lotes, el procesamiento de flujos y las cargas de trabajo de IA intensivas en computación.
★ 3341+4Variación de estrellas de los últimos 7 días - #7
Apache Parquet para Java
★ 3078+0Variación de estrellas de los últimos 7 días - #8★ 2862+11Variación de estrellas de los últimos 7 días
- #9
Formato Apache Parquet
★ 2563+7Variación de estrellas de los últimos 7 días - #10
Parseable es una plataforma de observabilidad de infraestructura unificada y de código abierto construida en Rust sobre una arquitectura de lago de datos. Rastrea registros, métricas, trazas y eventos en aplicaciones, agentes y sistemas, reduciendo los costos de almacenamiento hasta en un 90% mediante compresión de telemetría columnar.
★ 2450+2Variación de estrellas de los últimos 7 días - #11★ 2022+0Variación de estrellas de los últimos 7 días
- #12
Analítica en tiempo real en tablas de Postgres
★ 2003+0Variación de estrellas de los últimos 7 días - #13
La biblioteca Petastorm permite el entrenamiento y evaluación distribuida o en máquina única de modelos de deep learning desde conjuntos de datos en formato Apache Parquet.
★ 1892+0Variación de estrellas de los últimos 7 días - #14
Broker compatible con Apache Kafka® con S3, PostgreSQL, SQLite, Apache Iceberg y Delta Lake
★ 1853+1Variación de estrellas de los últimos 7 días - #15
Una interfaz SQL única para más de 60 herramientas (por ejemplo, GitHub, Notion, Airtable). Conéctate a cualquier LLM a través de MCP.
★ 1772+2Variación de estrellas de los últimos 7 días - #16★ 1618+3Variación de estrellas de los últimos 7 días
- #17
cryo es la forma más sencilla de extraer datos de blockchain a parquet, csv, json o dataframes de python
★ 1582+1Variación de estrellas de los últimos 7 días - #18
Alternativa de código abierto a Snowflake y Fivetran, con compatibilidad con Postgres.
★ 1531+0Variación de estrellas de los últimos 7 días - #19
OLake: replicación rápida de bases de datos, Kafka y S3 a Apache Iceberg con optimización de tablas (OLake Fusion). Ingesta de datos eficiente, rápida y escalable para análisis en tiempo real. Fuentes compatibles: Postgres, MongoDB, MySQL, Oracle, MSSql, DB2, Kafka, S3.
★ 1435+2Variación de estrellas de los últimos 7 días - #20
Quilt es una plataforma de gestión de datos científicos en AWS que ayuda a los equipos y a la IA a encontrar, confiar y reutilizar datos a través de paquetes de datos con versiones profundas y ricos en contexto.
★ 1370+0Variación de estrellas de los últimos 7 días - #21
Aplicación de escritorio simple para Windows para ver y consultar archivos Apache Parquet
★ 1231+2Variación de estrellas de los últimos 7 días - #22
ClickBench: una prueba de rendimiento para bases de datos analíticas
★ 1100+8Variación de estrellas de los últimos 7 días - #23
ADAM es una plataforma de análisis genómico con formatos de archivo especializados construidos usando Apache Avro, Apache Spark y Apache Parquet. Licenciado bajo Apache 2.
★ 1059+2Variación de estrellas de los últimos 7 días - #24★ 963+1Variación de estrellas de los últimos 7 días
- #25★ 950+8Variación de estrellas de los últimos 7 días
- #26
Framework ETL para .NET (analizador/escritor para archivos en formato CSV, Flat, Xml, JSON, Key-Value, Parquet, Yaml y Avro).
★ 859+0Variación de estrellas de los últimos 7 días - #27
Más de 80 herramientas CLI para DevOps y datos: AWS, GCP, GCF Python Cloud Functions, anonimizador de logs, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, conversores y validadores de datos Spark (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr, etc.
★ 824+0Variación de estrellas de los últimos 7 días - #28
Paquete de Go de alto rendimiento para leer y escribir archivos Parquet
★ 769+2Variación de estrellas de los últimos 7 días - #29
Graph Data Science: una capa de abstracción en Python para construir grafos de conocimiento, integrada con bibliotecas de grafos populares como Pandas, NetworkX, RAPIDS, RDFlib, pySHACL, PyVis, morph-kgc, pslpython, pyarrow, entre otras.
★ 691+2Variación de estrellas de los últimos 7 días - #30
Copiar hacia/desde Parquet en S3, Azure Blob Storage, Google Cloud Storage, almacenes http(s), archivos locales o flujo de entrada/salida estándar desde PostgreSQL
★ 685+0Variación de estrellas de los últimos 7 días