data-pipelines
Dépôts open source suivis étiquetés data-pipelines, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de data-pipelines sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés data-pipelines.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
Framework ETL Python pour le traitement de flux, l'analyse en temps réel, les pipelines LLM et le RAG.
★ 62 348-33Évolution des étoiles sur les 7 derniers jours - #2
Apache Airflow - Une plateforme pour créer, planifier et surveiller des flux de travail par programmation
★ 46 701+86Évolution des étoiles sur les 7 derniers jours - #3
Une plateforme d'orchestration pour le développement, la production et l'observation d'actifs de données.
★ 16 092+25Évolution des étoiles sur les 7 derniers jours - #4
Convertissez facilement des documents en données structurées. Unstructured est une solution ETL open-source pour transformer des documents complexes en formats structurés et propres pour les modèles de langage.
★ 15 381+31Évolution des étoiles sur les 7 derniers jours - #5
Apache DolphinScheduler est la plateforme moderne d'orchestration de données. Agile pour créer des flux de travail haute performance avec du low-code
★ 14 456+9Évolution des étoiles sur les 7 derniers jours - #6
Kedro est une boîte à outils pour la science des données en production. Il utilise les meilleures pratiques d'ingénierie logicielle pour créer des pipelines de données reproductibles, maintenables et modulaires.
★ 10 989+18Évolution des étoiles sur les 7 derniers jours - #7
Construisez, exécutez et gérez des pipelines de données pour l'intégration et la transformation de données.
★ 8 818+4Évolution des étoiles sur les 7 derniers jours - #8
Préparation de données simplifiée grâce aux derniers opérateurs et pipelines basés sur les LLM.
★ 7 893+125Évolution des étoiles sur les 7 derniers jours - #9
🦀 Traitement de flux d'événements pour collecter et transformer des données en mouvement afin d'alimenter des applications réactives intensives en données.
★ 5 248+1Évolution des étoiles sur les 7 derniers jours - #10
Preswald est un packager WASM pour les applications de données interactives basées sur Python : il permet de regrouper des flux de travail complexes, notamment des visualisations, dans des fichiers uniques exécutables entièrement dans le navigateur, en utilisant Pyodide, DuckDB, Pandas, Plotly, Matplotlib, etc. Créez des tableaux de bord, des rapports et des notebooks qui fonctionnent hors ligne, se chargent rapidement et se partagent comme un document.
★ 4 276-3Évolution des étoiles sur les 7 derniers jours - #11★ 4 074+78Évolution des étoiles sur les 7 derniers jours
- #12★ 3 831+2Évolution des étoiles sur les 7 derniers jours
- #13
Meltano : le moteur d'intégration de données déclaratif axé sur le code qui propulse vos idées de produits basées sur les données et le ML. Dites adieu à l'écriture, à la maintenance et à la mise à l'échelle de vos propres intégrations d'API.
★ 2 616+6Évolution des étoiles sur les 7 derniers jours - #14
La solution d'observabilité des données native dbt pour les ingénieurs data et analytiques. Surveillez vos pipelines de données en quelques minutes. Disponible en auto-hébergé ou en service cloud avec des fonctionnalités premium.
★ 2 405+7Évolution des étoiles sur les 7 derniers jours - #15★ 2 076+11Évolution des étoiles sur les 7 derniers jours
- #16
La meilleure plateforme pour apprendre l'ingénierie des données. Construite et maintenue par la communauté d'ingénierie des données.
★ 2 021+3Évolution des étoiles sur les 7 derniers jours - #17
Extraction de données non structurées rapide et efficace. Écrit en Rust avec des bindings pour de nombreux langages.
★ 1 772+0Évolution des étoiles sur les 7 derniers jours - #18
Construisez des pipelines de données avec SQL et Python, ingérez des données provenant de diverses sources, ajoutez des contrôles de qualité et créez des flux de bout en bout.
★ 1 683+5Évolution des étoiles sur les 7 derniers jours - #19★ 1 544+1Évolution des étoiles sur les 7 derniers jours
- #20★ 1 517-1Évolution des étoiles sur les 7 derniers jours
- #21
Première plateforme open source de découverte et d'observabilité des données. Nous simplifions la vie des praticiens de la donnée pour que vous puissiez vous concentrer sur votre activité.
★ 1 427+2Évolution des étoiles sur les 7 derniers jours - #22
Un modèle de package Python complet pour démarrer et standardiser vos initiatives MLOps et vos pipelines de données.
★ 1 416+1Évolution des étoiles sur les 7 derniers jours - #23★ 1 401+0Évolution des étoiles sur les 7 derniers jours
- #24
Optimus est un orchestrateur de flux de travail simple, fiable et performant pour la transformation de données, la modélisation, les pipelines et la gestion de la qualité des données.
★ 766+2Évolution des étoiles sur les 7 derniers jours - #25
Ce package dbt capture les métadonnées, les artefacts et les résultats de tests pour détecter les anomalies, surveiller la qualité des données et créer des tables de métadonnées. Il alimente Elementary OSS et fournit la couche de contexte utilisée par le plan de contrôle Data & AI d'Elementary Cloud.
★ 523+0Évolution des étoiles sur les 7 derniers jours