Zum Hauptinhalt springen
buildradar
Sign in
Thema · parquet

parquet

Erfasste Open-Source-Repos mit dem Tag parquet, sortiert nach Sternen.

Repos
39
Sterne gesamt
93.140
Sterne im Schnitt
2.388
Anteil
0,00%

Themen, die häufig gemeinsam mit parquet am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit parquet getaggt wurden.

  • hflow@Hebbian-Robotics

    Open source SDK for building multimodal data-quality, processing, enrichment, and curation pipelines for robotics and Physical AI.

    143
  • questdb@questdb

    QuestDB ist eine hochperformante, Open-Source-Zeitreihendatenbank

    17.295+6Sterne-Änderung der letzten 7 Tage
  • arrow@apache

    Apache Arrow ist das universelle Spaltenformat und die mehrsprachige Toolbox für schnellen Datenaustausch und In-Memory-Analysen

    17.078+6Sterne-Änderung der letzten 7 Tage
  • Daft@Eventual-Inc

    Hochleistungs-Daten-Engine für KI- und multimodale Workloads. Verarbeitet Bilder, Audio, Video und strukturierte Daten in beliebigem Maßstab.

    5.736+4Sterne-Änderung der letzten 7 Tage
  • arrow-rs@apache

    Offizielle Rust-Implementierung von Apache Arrow

    3.600+4Sterne-Änderung der letzten 7 Tage
  • roapi@roapi

    Erstellen Sie vollwertige APIs für sich langsam ändernde Datensätze, ohne eine einzige Zeile Code zu schreiben.

    3.429+1Sterne-Änderung der letzten 7 Tage
  • sail@lakehq

    Drop-in-Ersatz für Apache Spark, geschrieben in Rust, der Batch-Verarbeitung, Stream-Verarbeitung und rechenintensive KI-Workloads vereint.

    3.341+4Sterne-Änderung der letzten 7 Tage
  • parquet-java@apache

    Apache Parquet Java

    3.078+0Sterne-Änderung der letzten 7 Tage
  • rill@rilldata

    Das schnellste Business-Intelligence-Tool für Menschen und Agents.

    2.862+11Sterne-Änderung der letzten 7 Tage
  • parquet-format@apache

    Apache Parquet Format

    2.563+7Sterne-Änderung der letzten 7 Tage
  • parseable@parseablehq

    Parseable ist eine in Rust auf einer Data-Lake-Architektur entwickelte Open-Source-Plattform für einheitliche Infrastruktur-Observability. Sie erfasst Logs, Metriken, Traces und Events über Apps, Agenten und Systeme hinweg und reduziert Speicherkosten durch spaltenbasierte Telemetriekompression um bis zu 90 %.

    2.450+2Sterne-Änderung der letzten 7 Tage
  • drill@apache

    Apache Drill ist eine verteilte MPP-Abfrageschicht für selbstdokumentierende Daten

    2.022+0Sterne-Änderung der letzten 7 Tage
  • pg_mooncake@Mooncake-Labs

    Echtzeit-Analysen auf Postgres-Tabellen

    2.003+0Sterne-Änderung der letzten 7 Tage
  • petastorm@uber

    Die Petastorm-Bibliothek ermöglicht das Training und die Evaluierung von Deep-Learning-Modellen auf einzelnen Maschinen oder verteilt aus Datensätzen im Apache Parquet-Format. Sie unterstützt ML-Frameworks wie Tensorflow, Pytorch und PySpark und kann aus reinem Python-Code heraus verwendet werden.

    1.892+0Sterne-Änderung der letzten 7 Tage
  • nisshi@nisshi-io

    Apache Kafka®-kompatibler Broker mit S3, PostgreSQL, SQLite, Apache Iceberg und Delta Lake

    1.853+1Sterne-Änderung der letzten 7 Tage
  • anyquery@julien040

    Eine SQL-Schnittstelle für über 60 Tools (z. B. GitHub, Notion, Airtable). Anbindung an jedes LLM über MCP.

    1.772+2Sterne-Änderung der letzten 7 Tage
  • tonbo@tonbo-io

    Tonbo ist eine eingebettete Datenbank für Serverless- und Edge-Runtimes.

    1.618+3Sterne-Änderung der letzten 7 Tage
  • cryo@paradigmxyz

    cryo ist der einfachste Weg, Blockchain-Daten in die Formate parquet, csv, json oder in python dataframes zu exportieren

    1.582+1Sterne-Änderung der letzten 7 Tage
  • BemiDB@BemiHQ

    Open-Source-Alternative zu Snowflake & Fivetran mit Postgres-Kompatibilität

    1.531+0Sterne-Änderung der letzten 7 Tage
  • olake@datazip-inc

    OLake – Die schnellste Replikation von Datenbanken, Kafka und S3 zu Apache Iceberg mit Tabellenoptimierung (genannt OLake Fusion). Effiziente, schnelle und skalierbare Datenaufnahme für Echtzeitanalysen. Unterstützte Quellen: Postgres, MongoDB, MySQL, Oracle, MSSql, DB2, Kafka, S3.

    1.435+2Sterne-Änderung der letzten 7 Tage
  • quilt@quiltdata

    Quilt ist eine Scientific-Data-Management-Plattform auf AWS, die Teams und KI dabei unterstützt, Daten durch tief versionierte, kontextreiche Datenpakete zu finden, zu vertrauen und wiederzuverwenden.

    1.370+0Sterne-Änderung der letzten 7 Tage
  • Einfache Windows-Desktopanwendung zum Anzeigen und Abfragen von Apache Parquet-Dateien

    1.231+2Sterne-Änderung der letzten 7 Tage
  • ClickBench@ClickHouse

    ClickBench: Ein Benchmark für analytische Datenbanken

    1.100+8Sterne-Änderung der letzten 7 Tage
  • adam@bigdatagenomics

    ADAM ist eine Genomanalyse-Plattform mit spezialisierten Dateiformaten, entwickelt unter Verwendung von Apache Avro, Apache Spark und Apache Parquet. Lizenziert unter Apache 2.

    1.059+2Sterne-Änderung der letzten 7 Tage
  • lonboard@developmentseed

    Schnelle, interaktive Geospatial-Datenvisualisierung in Jupyter.

    963+1Sterne-Änderung der letzten 7 Tage
  • hyparquet@hyparam

    Parquet-Dateiparser für JavaScript

    950+8Sterne-Änderung der letzten 7 Tage
  • ChoETL@Cinchoo

    ETL-Framework für .NET (Parser/Writer für CSV-, Flat-, Xml-, JSON-, Key-Value-, Parquet-, Yaml- und Avro-formatierte Dateien)

    859+0Sterne-Änderung der letzten 7 Tage
  • DevOps-Python-tools@HariSekhon

    80+ DevOps- und Data-CLI-Tools – AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, Spark Data Converters & Validators (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr usw.

    824+0Sterne-Änderung der letzten 7 Tage
  • parquet-go@parquet-go

    Leistungsstarkes Go-Paket zum Lesen und Schreiben von Parquet-Dateien

    769+2Sterne-Änderung der letzten 7 Tage
  • kglab@DerwenAI

    Graph Data Science: Eine Abstraktionsschicht in Python zum Erstellen von Wissensgraphen, integriert in gängige Graph-Bibliotheken – basierend auf Pandas, NetworkX, RAPIDS, RDFlib, pySHACL, PyVis, morph-kgc, pslpython, pyarrow usw.

    691+2Sterne-Änderung der letzten 7 Tage
  • pg_parquet@CrunchyData

    Kopieren von Parquet-Daten zwischen S3, Azure Blob Storage, Google Cloud Storage, HTTP(S)-Speichern, lokalen Dateien oder Standard-Streams direkt aus PostgreSQL.

    685+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen