table-extraction
Erfasste Open-Source-Repos mit dem Tag table-extraction, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit table-extraction am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit table-extraction getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
Durchsucht eine PDF-Datei nach detaillierten Informationen zu jedem Zeichen, Rechteck, jeder Linie usw. – und extrahiert mühelos Text und Tabellen.
★ 10.701+15Sterne-Änderung der letzten 7 Tage - #2
PyMuPDF ist eine leistungsstarke Python-Bibliothek für Datenextraktion, Analyse, Konvertierung und Bearbeitung von PDF- (und anderen) Dokumenten.
★ 10.602+67Sterne-Änderung der letzten 7 Tage - #3
Ein polyglottes Dokumenten-Intelligenz-Framework mit einem Rust-Kern. Extrahiert Text, Metadaten, Bilder und strukturierte Daten aus 101 Formaten (115 Dateiendungen) sowie Code-Intelligenz für 371 Programmiersprachen. 15 Sprachbindungen – Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript – sowie CLI, REST-API und MCP-Server.
★ 9.233+48Sterne-Änderung der letzten 7 Tage - #4
Table Transformer (TATR) ist ein Deep-Learning-Modell zum Extrakt von Tabellen aus unstrukturierten Dokumenten (PDFs und Bildern). Dies ist zudem das offizielle Repository für das PubTables-1M-Dataset und die GriTS-Evaluierungsmetrik.
★ 2.943+2Sterne-Änderung der letzten 7 Tage - #5
Ein lokales, OCR-freies Toolkit zur Extraktion unstrukturierter Daten, Markdown-Konvertierung und Leistungsbewertung. (https://idp-leaderboard.org/)
★ 2.086+4Sterne-Änderung der letzten 7 Tage - #6
PDF zu Markdown mit Vision LLMs — Tabellen, Layouts und Struktur bleiben erhalten
★ 901-2Sterne-Änderung der letzten 7 Tage - #7
img2table ist eine Python-Bibliothek zur Tabellenidentifikation und -extraktion für PDFs und Bilder, basierend auf OpenCV-Bildverarbeitung
★ 894+2Sterne-Änderung der letzten 7 Tage - #8
ParseBench - Ein Dokumenten-Parsing-Benchmark für KI-Agenten
★ 558+2Sterne-Änderung der letzten 7 Tage