data-processing
Erfasste Open-Source-Repos mit dem Tag data-processing, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit data-processing am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit data-processing getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
Python‑ETL‑Framework für Stream‑Processing, Echtzeit‑Analyse, LLM‑Pipelines und RAG.
★ 62.365-36Sterne-Änderung der letzten 7 Tage - #2
Inkrementelle Engine für Agenten mit langfristigem Horizont 🌟 Stern geben, wenn es Ihnen gefällt!
★ 11.430+48Sterne-Änderung der letzten 7 Tage - #3
Eine Sammlung nützlicher Bash-Einzeiler und Terminal-Tricks für die Datenverarbeitung und Linux-Systemwartung.
★ 10.767+5Sterne-Änderung der letzten 7 Tage - #4
Miller ist wie awk, sed, cut, join und sort für namensindexierte Daten wie CSV, TSV und tabellarisches JSON
★ 10.005+4Sterne-Änderung der letzten 7 Tage - #5
Einheitliche Abfrage, Transformation und Modifikation von JSON, TOML, YAML, XML, INI, HCL, KDL und CSV.
★ 8.028+7Sterne-Änderung der letzten 7 Tage - #6★ 7.825+164Sterne-Änderung der letzten 7 Tage
- #7
Hochleistungs-KI-Pipeline-Engine mit einem C++-Kern und über 50 per Python erweiterbaren Nodes. Erstellen, debuggen und skalieren Sie LLM-Workflows mit über 13 Modellanbietern, über 8 Vektordatenbanken und Agenten-Orchestrierung, alles direkt aus Ihrer IDE. Inklusive VS Code-Erweiterung, TypeScript/Python-SDKs und Docker-Deployment.
★ 7.371+416Sterne-Änderung der letzten 7 Tage - #8
Datenverarbeitung für und mit Foundation Models! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷
★ 6.949+28Sterne-Änderung der letzten 7 Tage - #9
Eine GPU-beschleunigte Bibliothek mit hochoptimierten Bausteinen und einer Ausführungs-Engine für die Datenverarbeitung zur Beschleunigung von Deep-Learning-Training- und Inferenzanwendungen.
★ 5.738+4Sterne-Änderung der letzten 7 Tage - #10
Ein leichtgewichtigenes Datenverarbeitungs-Framework, aufgebaut auf DuckDB und 3FS.
★ 5.002+5Sterne-Änderung der letzten 7 Tage - #11★ 4.443+5Sterne-Änderung der letzten 7 Tage
- #12
Kubernetes-native Plattform zur Ausführung massiv paralleler Daten-/Streaming-Jobs
★ 2.827+2Sterne-Änderung der letzten 7 Tage - #13
Die Kontextschicht für unstrukturierte Daten: typisierte, versionierte Datensätze über S3, GCS, Azure
★ 2.814+3Sterne-Änderung der letzten 7 Tage - #14★ 2.680+1Sterne-Änderung der letzten 7 Tage
- #15
Toolkit für maschinelles Lernen, natürliche Sprachverarbeitung und Textgenerierung in TensorFlow. Dies ist Teil des CASL-Projekts: http://casl-project.ai/
★ 2.388+0Sterne-Änderung der letzten 7 Tage - #16★ 2.048+1Sterne-Änderung der letzten 7 Tage
- #17★ 1.742+12Sterne-Änderung der letzten 7 Tage
- #18★ 1.538+2Sterne-Änderung der letzten 7 Tage
- #19★ 1.518+0Sterne-Änderung der letzten 7 Tage
- #20
Quellcode zum Buch: Data Science on the Google Cloud Platform, Valliappa Lakshmanan, O'Reilly 2017
★ 1.429+1Sterne-Änderung der letzten 7 Tage - #21
KI-Workloads in Python magisch auf Kubernetes verteilen und ausführen, wie PyTorch für ML-Infra.
★ 1.224+0Sterne-Änderung der letzten 7 Tage - #22
Kommandozeilen-Tool zum Herunterladen und Extrahieren von Daten aus HTML/XML-Seiten oder JSON-APIs mittels CSS, XPath 3.0, XQuery 3.0, JSONiq oder Pattern Matching. Es kann zudem neue oder transformierte XML/HTML/JSON-Dokumente erstellen.
★ 843+0Sterne-Änderung der letzten 7 Tage - #23
Alles-in-Einer-Text-Deduplizierung
★ 763+0Sterne-Änderung der letzten 7 Tage - #24
HStreamDB ist eine Open-Source, Cloud-native Streaming-Datenbank für IoT und darüber hinaus. Modernisieren Sie Ihren Daten-Stack für Echtzeitanwendungen.
★ 722+0Sterne-Änderung der letzten 7 Tage - #25★ 705+1Sterne-Änderung der letzten 7 Tage
- #26
Eine kuratierte Liste rund um Apache Kafka.
★ 591+0Sterne-Änderung der letzten 7 Tage - #27★ 581+1Sterne-Änderung der letzten 7 Tage
- #28
Ein Tool, das fortschrittliche Monte-Carlo-Simulationen und Turbit-Parallelverarbeitung verwendet, um mögliche Bitcoin-Vorhersageszenarien zu erstellen.
★ 526+0Sterne-Änderung der letzten 7 Tage - #29
MARVIS-Agent: Universeller Kreditrisiko-Agent für Modellentwicklung, Validierung, Datenverarbeitung, Feature Engineering und Strategie-Workflows.
★ 518+2Sterne-Änderung der letzten 7 Tage - #30★ 505+1Sterne-Änderung der letzten 7 Tage