pdf-extraction
Erfasste Open-Source-Repos mit dem Tag pdf-extraction, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit pdf-extraction am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit pdf-extraction getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
PDF-Parser für KI-fähige Daten. Automatisiert PDF-Accessibility. Open-source.
★ 28.905+0Sterne-Änderung der letzten 7 Tage - #2
Schnelle Rust-Bibliothek für PDF-Inspektion, -Klassifizierung und -Textextraktion. Erkennt intelligent gescannte im Vergleich zu textbasierten PDFs, um intelligente Routing-Entcheidungen zu ermöglichen.
★ 18.547+0Sterne-Änderung der letzten 7 Tage - #3
Ein polyglottes Dokumenten-Intelligenz-Framework mit einem Rust-Kern. Extrahiert Text, Metadaten, Bilder und strukturierte Daten aus 101 Formaten (115 Dateiendungen) sowie Code-Intelligenz für 371 Programmiersprachen. 15 Sprachbindungen – Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript – sowie CLI, REST-API und MCP-Server.
★ 9.254+0Sterne-Änderung der letzten 7 Tage - #4
LLM-gesteuerte Extraktion unstrukturierter Daten – entwickelt für API-Bereitstellungen und ETL-Pipeline-Workflows.
★ 7.191+0Sterne-Änderung der letzten 7 Tage - #5★ 1.060+12Sterne-Änderung der letzten 7 Tage
- #6
Kostenlose Open-Source-Websoftware zum Signieren von PDFs (allein oder gemeinsam), zum Organisieren von Seiten, Bearbeiten von Metadaten und Komprimieren von PDFs.
★ 828+2Sterne-Änderung der letzten 7 Tage - #7★ 794+4Sterne-Änderung der letzten 7 Tage
- #8★ 608+1Sterne-Änderung der letzten 7 Tage
- #9
Java PDF-Tabellenextraktions- & OCR-Bibliothek. Extrahieren Sie strukturierte Tabellen aus textbasierten und gescannten PDFs mithilfe von Stream-, Lattice- (OpenCV-ähnliche Gittererkennung) und Hybrid-Parsing.
★ 521+2Sterne-Änderung der letzten 7 Tage