tesseract
tesseract टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर tesseract के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और tesseract टैग वाली रिपॉजिटरी।
- #1★ 76,310+108पिछले 7 दिनों में स्टार का बदलाव
- #2
100 से अधिक भाषाओं के लिए प्योर Javascript OCR 📖🎉🖥
★ 38,688+17पिछले 7 दिनों में स्टार का बदलाव - #3
OCRmyPDF स्कैन की गई PDF फाइलों में एक OCR टेक्स्ट लेयर जोड़ता है, जिससे उन्हें खोजा जा सकता है
★ 34,654+62पिछले 7 दिनों में स्टार का बदलाव - #4
PyMuPDF डेटा निष्कर्षण, विश्लेषण, रूपांतरण और PDF (तथा अन्य) दस्तावेजों के हेरफेर के लिए एक उच्च-प्रदर्शन Python लाइब्रेरी है।
★ 10,628+48पिछले 7 दिनों में स्टार का बदलाव - #5
Rust कोर के साथ एक पॉलीग्लॉट डॉक्यूमेंट इंटेलिजेंस फ्रेमवर्क। 101 फॉर्मेट्स (115 फ़ाइल एक्सटेंशन) से टेक्स्ट, मेटाडेटा, इमेज और संरचित डेटा निकालें, साथ ही 371 कोड भाषाओं के लिए कोड इंटेलिजेंस। 15 भाषा बाइंडिंग्स — Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript — साथ ही CLI, REST API, और MCP सर्वर।
★ 9,254+31पिछले 7 दिनों में स्टार का बदलाव - #6
"सर्वश्रेष्ठ" LSTM मॉडल के तेज़ वेरिएंट + लीगेसी मॉडल के साथ प्रशिक्षित मॉडल।
★ 7,647+8पिछले 7 दिनों में स्टार का बदलाव - #7★ 6,327+2पिछले 7 दिनों में स्टार का बदलाव
- #8
RPA करने के लिए Python पैकेज
★ 5,496+2पिछले 7 दिनों में स्टार का बदलाव - #9
Tesseract C++ लाइब्रेरी का उपयोग करके OCR (ऑप्टिकल कैरेक्टर रिकॉग्निशन) के लिए Go पैकेज
★ 3,134+4पिछले 7 दिनों में स्टार का बदलाव - #10
PHP के भीतर Tesseract OCR के साथ काम करने के लिए एक रैपर।
★ 3,039-1पिछले 7 दिनों में स्टार का बदलाव - #11
स्कैन किए गए PDF के त्रुटि सुधार, स्मार्ट चंकिंग और मार्कडाउन फ़ॉर्मेटिंग के लिए LLMs (स्थानीय या API) का उपयोग करके Tesseract OCR आउटपुट को बढ़ाता है
★ 2,996+3पिछले 7 दिनों में स्टार का बदलाव - #12
दस्तावेज़ स्कैनिंग ऐप
★ 2,393+8पिछले 7 दिनों में स्टार का बदलाव - #13★ 2,171+0पिछले 7 दिनों में स्टार का बदलाव
- #14★ 1,772-2पिछले 7 दिनों में स्टार का बदलाव
- #15
पायथन लाइब्रेरी का उपयोग करके बनाया गया पर्सनल असिस्टेंट। यह लगभग कुछ भी करता है जिसमें ईमेल भेजना, ऑप्टिकल टेक्स्ट रिकग्निशन, एपीआई इंटीग्रेशन के साथ किसी भी समय गतिशील समाचार रिपोर्टिंग, टू-डू लिस्ट जनरेटर, केवल एक वॉयस कमांड से कोई भी वेबसाइट खोलना, संगीत बजाना, विकिपीडिया खोजना, इंटेलिजेंट सेंसिंग यानी ऑटो स्पेल चेकिंग के साथ डिक्शनरी, मौसम रिपोर्टिंग यानी तापमान, हवा की गति, आर्द्रता शामिल है।
★ 1,341+9पिछले 7 दिनों में स्टार का बदलाव - #16
Tesseract OCR के नवीनतम संस्करण का समर्थन करने के लिए शून्य से फिर से लिखा गया tess-two का फोर्क।
★ 939+0पिछले 7 दिनों में स्टार का बदलाव - #17
CCExtractor - कोर टीम द्वारा अनुरक्षित आधिकारिक संस्करण
★ 901+2पिछले 7 दिनों में स्टार का बदलाव - #18
Tesseract OCR के साथ काम करने के लिए Ruby लाइब्रेरी।
★ 883+0पिछले 7 दिनों में स्टार का बदलाव - #19
टेक्स्ट पहचानने, OCR प्रूफरीडिंग और पूरी तरह से डिजिटाइज़्ड दस्तावेज़ बनाने के लिए वेब इंटरफ़ेस।
★ 810+2पिछले 7 दिनों में स्टार का बदलाव - #20★ 723+0पिछले 7 दिनों में स्टार का बदलाव
- #21
🔍 कई OCR इंजन (EasyOCR, Tesseract, और Pororo) को 🧠 LLM के साथ जोड़कर बेहतर टेक्स्ट डिटेक्शन।
★ 639+0पिछले 7 दिनों में स्टार का बदलाव - #22
प्रशिक्षित LSTM मॉडल के तेज़ पूर्णांक संस्करण
★ 610+1पिछले 7 दिनों में स्टार का बदलाव - #23
एंड्रॉइड के लिए Tesseract आधारित OCR
★ 599+1पिछले 7 दिनों में स्टार का बदलाव - #24
React Native के लिए Tesseract OCR रैपर
★ 594+0पिछले 7 दिनों में स्टार का बदलाव - #25
ऑफिस फाइलों को एक समृद्ध एब्सट्रैक्ट सिंटैक्स ट्री (AST) में पार्स करने और कई प्रारूपों में उच्च-गुणवत्ता वाला आउटपुट उत्पन्न करने के लिए एक मजबूत, सख्ती से टाइप की गई Node.js और ब्राउज़र लाइब्रेरी। पार्स करता है: docx · pptx · xlsx · odt · odp · ods · pdf · rtf · csv · md · html। उत्पन्न करता है: Markdown · HTML · CSV · RTF · PDF · Plain Text · RAG Chunks
★ 534+4पिछले 7 दिनों में स्टार का बदलाव