Aller au contenu principal
buildradar
Sign in
Sujet · data-pipelines

data-pipelines

Dépôts open source suivis étiquetés data-pipelines, triés par étoiles.

Dépôts
25
Total d'étoiles
221 273
Étoiles en moyenne
8 851
Part
0,01%

Sujets qui apparaissent souvent aux côtés de data-pipelines sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés data-pipelines.

Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.

  • pathway@pathwaycom

    Framework ETL Python pour le traitement de flux, l'analyse en temps réel, les pipelines LLM et le RAG.

    62 348-33Évolution des étoiles sur les 7 derniers jours
  • airflow@apache

    Apache Airflow - Une plateforme pour créer, planifier et surveiller des flux de travail par programmation

    46 701+86Évolution des étoiles sur les 7 derniers jours
  • dagster@dagster-io

    Une plateforme d'orchestration pour le développement, la production et l'observation d'actifs de données.

    16 092+25Évolution des étoiles sur les 7 derniers jours
  • unstructured@Unstructured-IO

    Convertissez facilement des documents en données structurées. Unstructured est une solution ETL open-source pour transformer des documents complexes en formats structurés et propres pour les modèles de langage.

    15 381+31Évolution des étoiles sur les 7 derniers jours
  • Apache DolphinScheduler est la plateforme moderne d'orchestration de données. Agile pour créer des flux de travail haute performance avec du low-code

    14 456+9Évolution des étoiles sur les 7 derniers jours
  • kedro@kedro-org

    Kedro est une boîte à outils pour la science des données en production. Il utilise les meilleures pratiques d'ingénierie logicielle pour créer des pipelines de données reproductibles, maintenables et modulaires.

    10 989+18Évolution des étoiles sur les 7 derniers jours
  • mage-ai@mage-ai

    Construisez, exécutez et gérez des pipelines de données pour l'intégration et la transformation de données.

    8 818+4Évolution des étoiles sur les 7 derniers jours
  • DataFlow@OpenDCAI

    Préparation de données simplifiée grâce aux derniers opérateurs et pipelines basés sur les LLM.

    7 893+125Évolution des étoiles sur les 7 derniers jours
  • fluvio@fluvio-community

    🦀 Traitement de flux d'événements pour collecter et transformer des données en mouvement afin d'alimenter des applications réactives intensives en données.

    5 248+1Évolution des étoiles sur les 7 derniers jours
  • preswald@StructuredLabs

    Preswald est un packager WASM pour les applications de données interactives basées sur Python : il permet de regrouper des flux de travail complexes, notamment des visualisations, dans des fichiers uniques exécutables entièrement dans le navigateur, en utilisant Pyodide, DuckDB, Pandas, Plotly, Matplotlib, etc. Créez des tableaux de bord, des rapports et des notebooks qui fonctionnent hors ligne, se chargent rapidement et se partagent comme un document.

    4 276-3Évolution des étoiles sur les 7 derniers jours
  • docetl@ucbepic

    Système de traitement de données et ETL piloté par des agents LLM

    4 074+78Évolution des étoiles sur les 7 derniers jours
  • maestro@Netflix

    Maestro : l'orchestrateur de workflow de Netflix

    3 831+2Évolution des étoiles sur les 7 derniers jours
  • meltano@meltano

    Meltano : le moteur d'intégration de données déclaratif axé sur le code qui propulse vos idées de produits basées sur les données et le ML. Dites adieu à l'écriture, à la maintenance et à la mise à l'échelle de vos propres intégrations d'API.

    2 616+6Évolution des étoiles sur les 7 derniers jours
  • elementary@elementary-data

    La solution d'observabilité des données native dbt pour les ingénieurs data et analytiques. Surveillez vos pipelines de données en quelques minutes. Disponible en auto-hébergé ou en service cloud avec des fonctionnalités premium.

    2 405+7Évolution des étoiles sur les 7 derniers jours
  • feldera@feldera

    Moteur de calcul incrémental Feldera

    2 076+11Évolution des étoiles sur les 7 derniers jours
  • data-engineering-wiki@data-engineering-community

    La meilleure plateforme pour apprendre l'ingénierie des données. Construite et maintenue par la communauté d'ingénierie des données.

    2 021+3Évolution des étoiles sur les 7 derniers jours
  • extractous@yobix-ai

    Extraction de données non structurées rapide et efficace. Écrit en Rust avec des bindings pour de nombreux langages.

    1 772+0Évolution des étoiles sur les 7 derniers jours
  • bruin@bruin-data

    Construisez des pipelines de données avec SQL et Python, ingérez des données provenant de diverses sources, ajoutez des contrôles de qualité et créez des flux de bout en bout.

    1 683+5Évolution des étoiles sur les 7 derniers jours
  • mleap@combust

    MLeap : déploiement de pipelines de machine learning en production

    1 544+1Évolution des étoiles sur les 7 derniers jours
  • pyper@pyper-dev

    La programmation concurrente en Python simplifiée

    1 517-1Évolution des étoiles sur les 7 derniers jours
  • odd-platform@opendatadiscovery

    Première plateforme open source de découverte et d'observabilité des données. Nous simplifions la vie des praticiens de la donnée pour que vous puissiez vous concentrer sur votre activité.

    1 427+2Évolution des étoiles sur les 7 derniers jours
  • mlops-python-package@fmind

    Un modèle de package Python complet pour démarrer et standardiser vos initiatives MLOps et vos pipelines de données.

    1 416+1Évolution des étoiles sur les 7 derniers jours
  • amphi-etl@amphi-ai

    Préparation de données visuelle propulsée par Python

    1 401+0Évolution des étoiles sur les 7 derniers jours
  • optimus@raystack

    Optimus est un orchestrateur de flux de travail simple, fiable et performant pour la transformation de données, la modélisation, les pipelines et la gestion de la qualité des données.

    766+2Évolution des étoiles sur les 7 derniers jours
  • dbt-data-reliability@elementary-data

    Ce package dbt capture les métadonnées, les artefacts et les résultats de tests pour détecter les anomalies, surveiller la qualité des données et créer des tables de métadonnées. Il alimente Elementary OSS et fournit la couche de contexte utilisée par le plan de contrôle Data & AI d'Elementary Cloud.

    523+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets