Zum Hauptinhalt springen
buildradar
Sign in
Thema · document-analysis

document-analysis

Erfasste Open-Source-Repos mit dem Tag document-analysis, sortiert nach Sternen.

Repos
12
Sterne gesamt
103.717
Sterne im Schnitt
8.643
Anteil
0,01%

Themen, die häufig gemeinsam mit document-analysis am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit document-analysis getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • MinerU@opendatalab

    🕷️ Ein adaptives Web-Scraping-Framework, das alles von einer einzelnen Anfrage bis zu einem groß angelegten Crawl behandelt!

    78.747+564Sterne-Änderung der letzten 7 Tage
  • Dolphin@bytedance

    Das offizielle Repository für „Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting“, ACL, 2025.

    9.049-1Sterne-Änderung der letzten 7 Tage
  • docetl@ucbepic

    Ein System für agentenbasierte, LLM-gestützte Datenverarbeitung und ETL.

    4.040+54Sterne-Änderung der letzten 7 Tage
  • PdfPig@UglyToad

    Lesen und Extrahieren von Text und anderen Inhalten aus PDFs in C# (Portierung von PDFBox)

    2.552+5Sterne-Änderung der letzten 7 Tage
  • docext@NanoNets

    Ein lokales, OCR-freies Toolkit zur Extraktion unstrukturierter Daten, Markdown-Konvertierung und Leistungsbewertung. (https://idp-leaderboard.org/)

    2.086+4Sterne-Änderung der letzten 7 Tage
  • AdvancedLiterateMachinery@AlibabaResearch

    Eine Sammlung originaler, innovativer Ideen und Algorithmen für Advanced Literate Machinery. Dieses Projekt wird vom OCR-Team im Language Technology Lab, Tongyi Lab der Alibaba Group gepflegt.

    1.834-1Sterne-Änderung der letzten 7 Tage
  • documind@DocumindHQ

    Open-Source-Plattform zum Extrahieren strukturierter Daten aus Dokumenten mittels KI.

    1.520-1Sterne-Änderung der letzten 7 Tage
  • OpenOCR@Topdu

    OpenOCR: Ein Open-Source-Toolkit für die allgemeine OCR-Forschung und -Anwendungen. Es integriert einen einheitlichen Trainings- und Evaluierungs-Benchmark, kommerzielle OCR- und Dokumentenanalysesysteme sowie originalgetreue Reproduktionen der Kernimplementierungen aus einer Vielzahl akademischer Arbeiten.

    1.440+3Sterne-Änderung der letzten 7 Tage
  • dedoc@ispras

    Dedoc ist eine Bibliothek (ein Service) zur automatisierten Dokumentenanalyse und Überführung in ein einheitliches Format. Sie extrahiert automatisch Inhalte, logische Strukturen, Tabellen und Metadaten aus textbasierten elektronischen Dokumenten.

    732+13Sterne-Änderung der letzten 7 Tage
  • MinerU-Diffusion@opendatalab

    [ECCV 2026] Ein auf Diffusion basierendes Framework für Dokumenten-OCR, das autoregressive Dekodierung durch blockbasierte parallele Diffusionsdekodierung ersetzt.

    615+1Sterne-Änderung der letzten 7 Tage
  • PICK-pytorch@wenwenyu

    Code für das Paper "PICK: Processing Key Information Extraction from Documents using Improved Graph Learning-Convolutional Networks" (ICPR 2020)

    570+0Sterne-Änderung der letzten 7 Tage
  • assemblyline@CybercentreCanada

    AssemblyLine 4: Dateitriage und Malware-Analyse.

    531+3Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen