Zum Hauptinhalt springen
buildradar
Sign in
Thema · table-extraction

table-extraction

Erfasste Open-Source-Repos mit dem Tag table-extraction, sortiert nach Sternen.

Repos
8
Sterne gesamt
37.910
Sterne im Schnitt
4.739
Anteil
0,00%

Themen, die häufig gemeinsam mit table-extraction am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit table-extraction getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • pdfplumber@jsvine

    Durchsucht eine PDF-Datei nach detaillierten Informationen zu jedem Zeichen, Rechteck, jeder Linie usw. – und extrahiert mühelos Text und Tabellen.

    10.701+15Sterne-Änderung der letzten 7 Tage
  • PyMuPDF@pymupdf

    PyMuPDF ist eine leistungsstarke Python-Bibliothek für Datenextraktion, Analyse, Konvertierung und Bearbeitung von PDF- (und anderen) Dokumenten.

    10.602+67Sterne-Änderung der letzten 7 Tage
  • xberg@xberg-io

    Ein polyglottes Dokumenten-Intelligenz-Framework mit einem Rust-Kern. Extrahiert Text, Metadaten, Bilder und strukturierte Daten aus 101 Formaten (115 Dateiendungen) sowie Code-Intelligenz für 371 Programmiersprachen. 15 Sprachbindungen – Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript – sowie CLI, REST-API und MCP-Server.

    9.233+48Sterne-Änderung der letzten 7 Tage
  • table-transformer@microsoft

    Table Transformer (TATR) ist ein Deep-Learning-Modell zum Extrakt von Tabellen aus unstrukturierten Dokumenten (PDFs und Bildern). Dies ist zudem das offizielle Repository für das PubTables-1M-Dataset und die GriTS-Evaluierungsmetrik.

    2.943+2Sterne-Änderung der letzten 7 Tage
  • docext@NanoNets

    Ein lokales, OCR-freies Toolkit zur Extraktion unstrukturierter Daten, Markdown-Konvertierung und Leistungsbewertung. (https://idp-leaderboard.org/)

    2.086+4Sterne-Änderung der letzten 7 Tage
  • api-llm-ocr@yigitkonur

    PDF zu Markdown mit Vision LLMs — Tabellen, Layouts und Struktur bleiben erhalten

    901-2Sterne-Änderung der letzten 7 Tage
  • img2table@xavctn

    img2table ist eine Python-Bibliothek zur Tabellenidentifikation und -extraktion für PDFs und Bilder, basierend auf OpenCV-Bildverarbeitung

    894+2Sterne-Änderung der letzten 7 Tage
  • ParseBench@run-llama

    ParseBench - Ein Dokumenten-Parsing-Benchmark für KI-Agenten

    558+2Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen