data-pipelines
Erfasste Open-Source-Repos mit dem Tag data-pipelines, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit data-pipelines am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit data-pipelines getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
Python‑ETL‑Framework für Stream‑Processing, Echtzeit‑Analyse, LLM‑Pipelines und RAG.
★ 62.348-17Sterne-Änderung der letzten 7 Tage - #2
Apache Airflow – Eine Plattform zum programmgesteuerten Autorisieren, Planen und Überwachen von Workflows
★ 46.701+63Sterne-Änderung der letzten 7 Tage - #3
Eine Orchestrierungsplattform für die Entwicklung, Produktion und Beobachtung von Daten-Assets.
★ 16.092+19Sterne-Änderung der letzten 7 Tage - #4
Konvertieren Sie Dokumente mühelos in strukturierte Daten. Unstructured ist eine Open-Source-ETL-Lösung zur Umwandlung komplexer Dokumente in saubere, strukturierte Formate für Sprachmodelle.
★ 15.381+19Sterne-Änderung der letzten 7 Tage - #5
Apache DolphinScheduler ist die moderne Datenorchestrierungsplattform. Agil beim Erstellen von Hochleistungs-Workflows mit Low-Code
★ 14.456+1Sterne-Änderung der letzten 7 Tage - #6
Kedro ist eine Toolchain für produktionsreife Data Science. Es nutzt bewährte Softwareentwicklungspraktiken, um reproduzierbare, wartbare und modulare Data-Engineering- und Data-Science-Pipelines zu erstellen.
★ 10.989+14Sterne-Änderung der letzten 7 Tage - #7
🧙 Datenpelines für die Integration und Transformation von Daten erstellen, ausführen und verwalten.
★ 8.818+4Sterne-Änderung der letzten 7 Tage - #8★ 7.893+68Sterne-Änderung der letzten 7 Tage
- #9
🦀 Event-Stream-Verarbeitung für Entwickler zum Sammeln und Transformieren von Daten in Bewegung, um reaktionsschnelle, datenintensive Anwendungen zu betreiben.
★ 5.248-1Sterne-Änderung der letzten 7 Tage - #10
Preswald ist ein WASM-Packer für Python-basierte interaktive Datenanwendungen: Bündelt komplexe Daten-Workflows, insbesondere Visualisierungen, in einzelnen Dateien, die dank Pyodide, DuckDB, Pandas, Plotly, Matplotlib etc. vollständig im Browser ausgeführt werden können. Erstellen Sie Dashboards, Berichte und Notebooks, die offline laufen, schnell laden und wie ein Dokument geteilt werden können.
★ 4.276-2Sterne-Änderung der letzten 7 Tage - #11★ 4.074+34Sterne-Änderung der letzten 7 Tage
- #12★ 3.831+0Sterne-Änderung der letzten 7 Tage
- #13
Meltano: Die deklarative, codebasierte Datenintegrations-Engine für Ihre kühnsten Daten- und ML-gestützten Produktideen. Verabschieden Sie sich vom Schreiben, Warten und Skalieren eigener API-Integrationen.
★ 2.616+2Sterne-Änderung der letzten 7 Tage - #14
Die dbt-native Daten-Observability-Lösung für Data- und Analytics-Engineers. Überwachen Sie Ihre Daten-Pipelines in wenigen Minuten. Als Self-Hosted- oder Cloud-Service mit Premium-Funktionen verfügbar.
★ 2.405+4Sterne-Änderung der letzten 7 Tage - #15★ 2.076+8Sterne-Änderung der letzten 7 Tage
- #16
Der beste Ort, um Data Engineering zu lernen. Erstellt und gepflegt von der Data-Engineering-Community.
★ 2.021+3Sterne-Änderung der letzten 7 Tage - #17
Schnelle und effiziente Extraktion unstrukturierter Daten. Geschrieben in Rust mit Bindings für viele Sprachen.
★ 1.772+0Sterne-Änderung der letzten 7 Tage - #18
Daten-Pipelines mit SQL und Python erstellen, Daten aus verschiedenen Quellen einlesen, Qualitätsprüfungen hinzufügen und End-to-End-Abläufe aufbauen.
★ 1.683+4Sterne-Änderung der letzten 7 Tage - #19★ 1.544+1Sterne-Änderung der letzten 7 Tage
- #20★ 1.517-1Sterne-Änderung der letzten 7 Tage
- #21
Die erste Open-Source-Plattform zur Datenerkennung und -beobachtbarkeit. Wir erleichtern Datenexperten das Leben, damit Sie sich auf Ihr Geschäft konzentrieren können.
★ 1.427+1Sterne-Änderung der letzten 7 Tage - #22
Eine umfassende Python-Paketvorlage zum Starten und Standardisieren Ihrer MLOps-Initiativen und Daten-Pipelines.
★ 1.416+0Sterne-Änderung der letzten 7 Tage - #23★ 1.401+0Sterne-Änderung der letzten 7 Tage
- #24
Optimus ist ein benutzerfreundlicher, zuverlässiger und leistungsstarker Workflow-Orchestrator für Datentransformation, Datenmodellierung, Pipelines und Datenqualitätsmanagement.
★ 766+2Sterne-Änderung der letzten 7 Tage - #25
Dieses dbt-Paket erfasst Metadaten, Artefakte und Testergebnisse zur Anomalieerkennung, Überwachung der Datenqualität und Erstellung von Metadatentabellen. Es bildet die Basis für Elementary OSS und speist die umfassendere Kontextschicht der Data & AI Control Plane von Elementary Cloud.
★ 523+0Sterne-Änderung der letzten 7 Tage