Zum Hauptinhalt springen
buildradar
Sign in
Thema · data-engineering

data-engineering

Erfasste Open-Source-Repos mit dem Tag data-engineering, sortiert nach Sternen.

97 Repos
  • sql-translator@whoiskatrin

    SQL Translator ist ein Tool zur Konvertierung von natürlichsprachlichen Abfragen in SQL-Code mithilfe von künstlicher Intelligenz. Dieses Projekt ist zu 100 % kostenlos und Open Source.

    4.321+0Sterne-Änderung der letzten 7 Tage
  • pandas auf AWS – Einfache Integration mit Athena, Glue, Redshift, Timestream, Neptune, OpenSearch, QuickSight, Chime, CloudWatchLogs, DynamoDB, EMR, SecretManager, PostgreSQL, MySQL, SQLServer und S3 (Parquet, CSV, JSON und EXCEL).

    4.119+0Sterne-Änderung der letzten 7 Tage
  • Eine Liste nützlicher Ressourcen, um Data Engineering von Grund auf zu lernen.

    4.009-2Sterne-Änderung der letzten 7 Tage
  • maestro@Netflix

    Maestro: Der Workflow-Orchestrator von Netflix

    3.831+0Sterne-Änderung der letzten 7 Tage
  • qsv@dathere

    Blitzschnelles Data-Wrangling-Toolkit

    3.774+4Sterne-Änderung der letzten 7 Tage
  • memphis@superstreamlabs

    Memphis.dev ist eine hochskalierbare und mühelose Data-Streaming-Plattform

    3.440+0Sterne-Änderung der letzten 7 Tage
  • mlops-course@GokuMohandas

    Lernen Sie, wie man produktionsbereite ML-Anwendungen entwirft, entwickelt, bereitstellt und iteriert.

    3.399+2Sterne-Änderung der letzten 7 Tage
  • sail@lakehq

    Drop-in-Ersatz für Apache Spark, geschrieben in Rust, der Batch-Verarbeitung, Stream-Verarbeitung und rechenintensive KI-Workloads vereint.

    3.341+4Sterne-Änderung der letzten 7 Tage
  • Eine Awesome-Liste von Open-Source-Data-Engineering-Projekten

    3.278+5Sterne-Änderung der letzten 7 Tage
  • devlake@apache

    Apache DevLake ist eine Open-Source-Entwicklerdatenplattform zum Erfassen, Analysieren und Visualisieren fragmentierter Daten aus DevOps-Tools, um Einblicke für Engineering Excellence, Developer Experience und Community-Wachstum zu gewinnen.

    3.121+5Sterne-Änderung der letzten 7 Tage
  • second-brain-ai-assistant-course@decodingai-magazine

    Lernen Sie, Ihren KI-Assistenten für das zweite Gehirn mit LLMs, Agents, RAG, Fine-Tuning, LLMOps und KI-Systemtechniken zu entwickeln.

    3.068+9Sterne-Änderung der letzten 7 Tage
  • meltano@meltano

    Meltano: Die deklarative, codebasierte Datenintegrations-Engine für Ihre kühnsten Daten- und ML-gestützten Produktideen. Verabschieden Sie sich vom Schreiben, Warten und Skalieren eigener API-Integrationen.

    2.616+2Sterne-Änderung der letzten 7 Tage
  • hamilton@apache

    Apache Hamilton hilft Data Scientists und Engineers dabei, testbare, modulare und selbstdokumentierende Datenflüsse zu definieren, die Abstammung (Lineage/Tracing) und Metadaten kodieren. Läuft und skaliert überall dort, wo Python läuft.

    2.584+1Sterne-Änderung der letzten 7 Tage
  • SAG@Zleap-AI

    Ein neuer SOTA für RAG — eine originale Retrieval-Architektur und eine Open-Source-Wissensdatenbank für Menschen und Agenten.

    2.456+20Sterne-Änderung der letzten 7 Tage
  • metarank@metarank

    Ein Low-Code-Dienst für personalisiertes Machine-Learning-Ranking von Artikeln, Einträgen, Suchergebnissen und Empfehlungen zur Steigerung der Nutzerinteraktion. Eine benutzerfreundliche Learn-to-Rank-Engine

    2.434+0Sterne-Änderung der letzten 7 Tage
  • soda-core@sodadata

    Data-Contracts-Engine für den modernen Data Stack. https://www.soda.io

    2.420-1Sterne-Änderung der letzten 7 Tage
  • datart@running-elephant

    Datart ist eine Open-Source-Plattform der nächsten Generation für Datenvisualisierung

    2.303+1Sterne-Änderung der letzten 7 Tage
  • bytewax@bytewax

    Python-Datenstromverarbeitung

    2.048+1Sterne-Änderung der letzten 7 Tage
  • data-engineering-wiki@data-engineering-community

    Der beste Ort, um Data Engineering zu lernen. Erstellt und gepflegt von der Data-Engineering-Community.

    2.021+3Sterne-Änderung der letzten 7 Tage
  • feathr@feathr-ai

    Feathr – Eine skalierbare, vereinheitlichte Daten- und KI-Engineering-Plattform für Unternehmen

    1.937+0Sterne-Änderung der letzten 7 Tage
  • awesome-dbt@Hiflylabs

    Eine kuratierte Liste fantastischer dbt-Ressourcen

    1.722+1Sterne-Änderung der letzten 7 Tage
  • Mehr als 2000+ Interviewfragen für Data Engineers

    1.721+5Sterne-Änderung der letzten 7 Tage
  • mlrun@mlrun

    MLRun ist eine Open-Source-MLOps-Plattform zum schnellen Erstellen und Verwalten kontinuierlicher ML-Anwendungen über ihren gesamten Lebenszyklus. MLRun lässt sich in Ihre Entwicklungs- und CI/CD-Umgebung integrieren und automatisiert die Bereitstellung von Produktionsdaten, ML-Pipelines und Online-Anwendungen.

    1.694+1Sterne-Änderung der letzten 7 Tage
  • multiwoven@Multiwoven

    🔥🔥🔥 Open-Source-Reverse-ETL – Alternative zu Hightouch und Census.

    1.673+0Sterne-Änderung der letzten 7 Tage
  • Eine umfassende Liste von über 180 YouTube-Kanälen für Data Science, Data Engineering, Machine Learning, Deep Learning, Informatik, Programmierung, Software Engineering usw.

    1.624+1Sterne-Änderung der letzten 7 Tage
  • nao@getnao

    👾 nao ist ein Open-Source-Analytics-Agent. (1) Kontext mit der nao-core CLI erstellen, (2) nao-Chat-Interface für alle bereitstellen.

    1.600+9Sterne-Änderung der letzten 7 Tage
  • just-dashboard@kantord

    :bar_chart: :clipboard: Dashboards mit YAML- oder JSON-Dateien

    1.582+1Sterne-Änderung der letzten 7 Tage
  • ktx@Kaelio

    ktx ist eine ausführbare Kontextschicht für Daten- und Analyse-Agenten 🐙 Ermöglicht es Claude Code, Codex oder anderen KI-Agenten, analytische Datenbanken präzise und mit dem vollen Kontext Ihres Unternehmens abzufragen.

    1.571+5Sterne-Änderung der letzten 7 Tage
  • quix-streams@quixio

    Python Streaming DataFrames für Kafka

    1.569+1Sterne-Änderung der letzten 7 Tage
  • pyper@pyper-dev

    Nebenläufiges Python leicht gemacht

    1.517-1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen