Zum Hauptinhalt springen
buildradar
Sign in

CatchTheTornado/text-extract-api

@CatchTheTornado

Dokumenten-Extraktions- und Parse-API (PDF, Word, PPTX ...) unter Verwendung modernster OCRs + von Ollama unterstützter Modelle. Dokumente anonymisieren. PII entfernen. Konvertieren Sie jedes Dokument oder Bild in strukturiertes JSON oder Markdown.

Sterne
3.177
Forks
279
Sprache
Python
Lizenz
MIT
Letzter Push
vor 9 Monaten
Pythonjsonpdfllmapipiiextractanonymizationocrocr-python

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.