tesseract
Erfasste Open-Source-Repos mit dem Tag tesseract, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit tesseract am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit tesseract getaggt wurden.
- #1★ 76.310+61Sterne-Änderung der letzten 7 Tage
- #2
Reines JavaScript OCR für über 100 Sprachen 📖🎉🖥
★ 38.688+11Sterne-Änderung der letzten 7 Tage - #3
OCRmyPDF fügt einer gescannten PDF-Datei eine OCR-Textschicht hinzu, sodass diese durchsucht werden kann.
★ 34.654+43Sterne-Änderung der letzten 7 Tage - #4
PyMuPDF ist eine leistungsstarke Python-Bibliothek für Datenextraktion, Analyse, Konvertierung und Bearbeitung von PDF- (und anderen) Dokumenten.
★ 10.628+26Sterne-Änderung der letzten 7 Tage - #5
Ein polyglottes Dokumenten-Intelligenz-Framework mit einem Rust-Kern. Extrahiert Text, Metadaten, Bilder und strukturierte Daten aus 101 Formaten (115 Dateiendungen) sowie Code-Intelligenz für 371 Programmiersprachen. 15 Sprachbindungen – Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript – sowie CLI, REST-API und MCP-Server.
★ 9.254+21Sterne-Änderung der letzten 7 Tage - #6
Trainierte Modelle mit schneller Variante der „besten“ LSTM-Modelle + älteren Modellen
★ 7.647+4Sterne-Änderung der letzten 7 Tage - #7★ 6.327+2Sterne-Änderung der letzten 7 Tage
- #8
Python-Paket zur Durchführung von RPA
★ 5.496+2Sterne-Änderung der letzten 7 Tage - #9
Go-Paket für OCR (Optical Character Recognition) unter Verwendung der C++-Bibliothek Tesseract
★ 3.134+2Sterne-Änderung der letzten 7 Tage - #10
Ein Wrapper für die Arbeit mit Tesseract OCR in PHP.
★ 3.039-2Sterne-Änderung der letzten 7 Tage - #11
Verbessert die Tesseract-OCR-Ausgabe mithilfe von LLMs (lokal oder API) zur Fehlerkorrektur, intelligenten Aufteilung und Markdown-Formatierung von gescannten PDFs.
★ 2.996+3Sterne-Änderung der letzten 7 Tage - #12
Dokumentensscanning-App
★ 2.393+4Sterne-Änderung der letzten 7 Tage - #13★ 2.171+0Sterne-Änderung der letzten 7 Tage
- #14★ 1.772-1Sterne-Änderung der letzten 7 Tage
- #15
Ein persönlicher Assistent, der mit Python-Bibliotheken erstellt wurde. Er erledigt fast alles, darunter das Senden von E-Mails, optische Texterkennung, dynamische Nachrichtenberichterstattung zu jeder Zeit mit API-Integration, Erstellung von To-Do-Listen, Öffnen von Websites per Sprachbefehl, Musikwiedergabe, Wikipedia-Suche, Wörterbuch mit intelligenter Erkennung (d. h. automatischer Rechtschreibprüfung), Wetterbericht (Temperatur, Windgeschwindigkeit, Luftfeuchtigkeit).
★ 1.341+5Sterne-Änderung der letzten 7 Tage - #16
Ein von Grund auf neu geschriebener Fork von tess-two zur Unterstützung der neuesten Version von Tesseract OCR.
★ 939+1Sterne-Änderung der letzten 7 Tage - #17
CCExtractor – Offizielle Version, gewartet vom Kernteam
★ 901+2Sterne-Änderung der letzten 7 Tage - #18
Ruby-Bibliothek für die Arbeit mit Tesseract OCR.
★ 883+0Sterne-Änderung der letzten 7 Tage - #19
Web-Oberfläche zur Texterkennung, zum Korrekturlesen von OCR und zur Erstellung vollständig digitalisierter Dokumente.
★ 810+0Sterne-Änderung der letzten 7 Tage - #20★ 723+0Sterne-Änderung der letzten 7 Tage
- #21
🔍 Bessere Texterkennung durch die Kombination mehrerer OCR-Engines (EasyOCR, Tesseract und Pororo) mit 🧠 LLM.
★ 639+0Sterne-Änderung der letzten 7 Tage - #22
Schnelle Integer-Versionen von trainierten LSTM-Modellen.
★ 610+0Sterne-Änderung der letzten 7 Tage - #23
Tesseract-basierte OCR für Android.
★ 599+2Sterne-Änderung der letzten 7 Tage - #24
Tesseract OCR-Wrapper für React Native
★ 595+1Sterne-Änderung der letzten 7 Tage - #25
Eine robuste, streng typisierte Node.js- und Browser-Bibliothek zum Parsen von Office-Dateien in einen reichhaltigen Abstract Syntax Tree (AST) und zur Erzeugung hochwertiger Ausgaben in verschiedenen Formaten. Unterstützt: docx · pptx · xlsx · odt · odp · ods · pdf · rtf · csv · md · html. Erzeugt: Markdown · HTML · CSV · RTF · PDF · Plain Text · RAG Chunks
★ 535+2Sterne-Änderung der letzten 7 Tage