Zum Hauptinhalt springen
buildradar
Sign in
Thema · data-pipelines

data-pipelines

Erfasste Open-Source-Repos mit dem Tag data-pipelines, sortiert nach Sternen.

Repos
25
Sterne gesamt
221.273
Sterne im Schnitt
8.851
Anteil
0,01%

Themen, die häufig gemeinsam mit data-pipelines am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit data-pipelines getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • pathway@pathwaycom

    Python‑ETL‑Framework für Stream‑Processing, Echtzeit‑Analyse, LLM‑Pipelines und RAG.

    62.348-17Sterne-Änderung der letzten 7 Tage
  • airflow@apache

    Apache Airflow – Eine Plattform zum programmgesteuerten Autorisieren, Planen und Überwachen von Workflows

    46.701+63Sterne-Änderung der letzten 7 Tage
  • dagster@dagster-io

    Eine Orchestrierungsplattform für die Entwicklung, Produktion und Beobachtung von Daten-Assets.

    16.092+19Sterne-Änderung der letzten 7 Tage
  • unstructured@Unstructured-IO

    Konvertieren Sie Dokumente mühelos in strukturierte Daten. Unstructured ist eine Open-Source-ETL-Lösung zur Umwandlung komplexer Dokumente in saubere, strukturierte Formate für Sprachmodelle.

    15.381+19Sterne-Änderung der letzten 7 Tage
  • Apache DolphinScheduler ist die moderne Datenorchestrierungsplattform. Agil beim Erstellen von Hochleistungs-Workflows mit Low-Code

    14.456+1Sterne-Änderung der letzten 7 Tage
  • kedro@kedro-org

    Kedro ist eine Toolchain für produktionsreife Data Science. Es nutzt bewährte Softwareentwicklungspraktiken, um reproduzierbare, wartbare und modulare Data-Engineering- und Data-Science-Pipelines zu erstellen.

    10.989+14Sterne-Änderung der letzten 7 Tage
  • mage-ai@mage-ai

    🧙 Datenpelines für die Integration und Transformation von Daten erstellen, ausführen und verwalten.

    8.818+4Sterne-Änderung der letzten 7 Tage
  • DataFlow@OpenDCAI

    Einfache Datenaufbereitung mit neuesten LLM-basierten Operatoren und Pipelines.

    7.893+68Sterne-Änderung der letzten 7 Tage
  • fluvio@fluvio-community

    🦀 Event-Stream-Verarbeitung für Entwickler zum Sammeln und Transformieren von Daten in Bewegung, um reaktionsschnelle, datenintensive Anwendungen zu betreiben.

    5.248-1Sterne-Änderung der letzten 7 Tage
  • preswald@StructuredLabs

    Preswald ist ein WASM-Packer für Python-basierte interaktive Datenanwendungen: Bündelt komplexe Daten-Workflows, insbesondere Visualisierungen, in einzelnen Dateien, die dank Pyodide, DuckDB, Pandas, Plotly, Matplotlib etc. vollständig im Browser ausgeführt werden können. Erstellen Sie Dashboards, Berichte und Notebooks, die offline laufen, schnell laden und wie ein Dokument geteilt werden können.

    4.276-2Sterne-Änderung der letzten 7 Tage
  • docetl@ucbepic

    Ein System für agentenbasierte, LLM-gestützte Datenverarbeitung und ETL.

    4.074+34Sterne-Änderung der letzten 7 Tage
  • maestro@Netflix

    Maestro: Der Workflow-Orchestrator von Netflix

    3.831+0Sterne-Änderung der letzten 7 Tage
  • meltano@meltano

    Meltano: Die deklarative, codebasierte Datenintegrations-Engine für Ihre kühnsten Daten- und ML-gestützten Produktideen. Verabschieden Sie sich vom Schreiben, Warten und Skalieren eigener API-Integrationen.

    2.616+2Sterne-Änderung der letzten 7 Tage
  • elementary@elementary-data

    Die dbt-native Daten-Observability-Lösung für Data- und Analytics-Engineers. Überwachen Sie Ihre Daten-Pipelines in wenigen Minuten. Als Self-Hosted- oder Cloud-Service mit Premium-Funktionen verfügbar.

    2.405+4Sterne-Änderung der letzten 7 Tage
  • feldera@feldera

    Die Feldera Incremental Computation Engine

    2.076+8Sterne-Änderung der letzten 7 Tage
  • data-engineering-wiki@data-engineering-community

    Der beste Ort, um Data Engineering zu lernen. Erstellt und gepflegt von der Data-Engineering-Community.

    2.021+3Sterne-Änderung der letzten 7 Tage
  • extractous@yobix-ai

    Schnelle und effiziente Extraktion unstrukturierter Daten. Geschrieben in Rust mit Bindings für viele Sprachen.

    1.772+0Sterne-Änderung der letzten 7 Tage
  • bruin@bruin-data

    Daten-Pipelines mit SQL und Python erstellen, Daten aus verschiedenen Quellen einlesen, Qualitätsprüfungen hinzufügen und End-to-End-Abläufe aufbauen.

    1.683+4Sterne-Änderung der letzten 7 Tage
  • mleap@combust

    MLeap: ML-Pipelines in die Produktion überführen

    1.544+1Sterne-Änderung der letzten 7 Tage
  • pyper@pyper-dev

    Nebenläufiges Python leicht gemacht

    1.517-1Sterne-Änderung der letzten 7 Tage
  • odd-platform@opendatadiscovery

    Die erste Open-Source-Plattform zur Datenerkennung und -beobachtbarkeit. Wir erleichtern Datenexperten das Leben, damit Sie sich auf Ihr Geschäft konzentrieren können.

    1.427+1Sterne-Änderung der letzten 7 Tage
  • mlops-python-package@fmind

    Eine umfassende Python-Paketvorlage zum Starten und Standardisieren Ihrer MLOps-Initiativen und Daten-Pipelines.

    1.416+0Sterne-Änderung der letzten 7 Tage
  • amphi-etl@amphi-ai

    visuelle Datenaufbereitung, angetrieben durch Python

    1.401+0Sterne-Änderung der letzten 7 Tage
  • optimus@raystack

    Optimus ist ein benutzerfreundlicher, zuverlässiger und leistungsstarker Workflow-Orchestrator für Datentransformation, Datenmodellierung, Pipelines und Datenqualitätsmanagement.

    766+2Sterne-Änderung der letzten 7 Tage
  • dbt-data-reliability@elementary-data

    Dieses dbt-Paket erfasst Metadaten, Artefakte und Testergebnisse zur Anomalieerkennung, Überwachung der Datenqualität und Erstellung von Metadatentabellen. Es bildet die Basis für Elementary OSS und speist die umfassendere Kontextschicht der Data & AI Control Plane von Elementary Cloud.

    523+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen