Zum Hauptinhalt springen
buildradar
Sign in
Thema · datalake

datalake

Erfasste Open-Source-Repos mit dem Tag datalake, sortiert nach Sternen.

Repos
17
Sterne gesamt
86.093
Sterne im Schnitt
5.064
Anteil
0,00%

Themen, die häufig gemeinsam mit datalake am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit datalake getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • pandas-ai@sinaptik-ai

    Chat mit Ihrer Datenbank oder Ihrem Data Lake (SQL, CSV, parquet). PandasAI macht Datenanalyse konversationell mit LLMs und RAG.

    23.778+14Sterne-Änderung der letzten 7 Tage
  • trino@trinodb

    Offizielles Repository von Trino, der verteilten SQL-Abfrageengine für Big Data, ehemals bekannt als PrestoSQL (https://trino.io)

    13.194+24Sterne-Änderung der letzten 7 Tage
  • starrocks@StarRocks

    Die weltch schnellste offene Query-Engine für Sub-Sekunden-Analysen auf und neben dem Data Lakehouse. Mit der Flexibilität, nahezu jedes Szenario zu unterstützen, bietet StarRocks erstklassige Leistung für mehrdimensionale Analysen, Echtzeitanalysen und Ad-hoc-Abfragen. Ein Projekt der Linux Foundation.

    12.057+28Sterne-Änderung der letzten 7 Tage
  • deeplake@activeloopai

    Deeplake ist eine KI-Daten-Runtime für Agenten. Es bietet serverloses Postgres mit einem multimodalen Data Lake, was eine skalierbare Abfrage und Training ermöglicht.

    9.230+3Sterne-Änderung der letzten 7 Tage
  • hudi@apache

    Upserts, Deletes und inkrementelle Verarbeitung bei Big Data.

    6.227+12Sterne-Änderung der letzten 7 Tage
  • lakeFS@treeverse

    lakeFS – Datenversionskontrolle für Ihren Data Lake | Git für Daten

    5.499+8Sterne-Änderung der letzten 7 Tage
  • dinky@DataLinkDC

    Dinky ist eine Echtzeit-Datenentwicklungsplattform basierend auf Apache Flink, die agile Datenentwicklung, -bereitstellung und den -betrieb ermöglicht.

    3.754+3Sterne-Änderung der letzten 7 Tage
  • gravitino@apache

    Der weltweit leistungsfähigste Open-Data-Katalog zum Aufbau eines hochleistungsfähigen, geoverteilten und föderierten Metadatensees.

    3.189+3Sterne-Änderung der letzten 7 Tage
  • nisshi@nisshi-io

    Apache Kafka®-kompatibler Broker mit S3, PostgreSQL, SQLite, Apache Iceberg und Delta Lake

    1.852+2Sterne-Änderung der letzten 7 Tage
  • leofs@leo-project

    Das LeoFS Storage System

    1.594+0Sterne-Änderung der letzten 7 Tage
  • zingg@zinggAI

    Skalierbare Stammdatenverwaltung, Identitätsauflösung, Entitätsauflösung und Deduplizierung mittels ML

    1.238+2Sterne-Änderung der letzten 7 Tage
  • ClickBench@ClickHouse

    ClickBench: Ein Benchmark für analytische Datenbanken

    1.092+4Sterne-Änderung der letzten 7 Tage
  • Ein umfassender Leitfaden zum Erstellen eines modernen Data Warehouse mit SQL Server, einschließlich ETL-Prozessen, Datenmodellierung und Analysen.

    921+14Sterne-Änderung der letzten 7 Tage
  • awesome-data-agents@HKUSTDial

    Kontinuierlich aktualisierte Liste von Arbeiten zu Fortschritten bei Data Agents. Begleitrepo zu unserem Paper „A Survey of Data Agents: Emerging Paradigm or Overstated Hype?“

    721+14Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von Open-Source-Tools für Analyseplattformen und Data-Engineering-Ökosysteme

    600+0Sterne-Änderung der letzten 7 Tage
  • automate-dv@Datavault-UK

    Ein kostenlos nutzbares dbt-Paket zum Erstellen und Laden von Data Vault 2.0-konformen Data Warehouses (unterstützt durch dbt, ein Open-Source-Daten-Engineering-Tool, eingetragene Marke von dbt Labs)

    595-1Sterne-Änderung der letzten 7 Tage
  • Zusammenstellung von Ressourcen zu Apache Hudi.

    556+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen