table-extraction
table-extraction टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर table-extraction के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और table-extraction टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
प्रत्येक वर्ण, आयत, रेखा आदि के बारे में विस्तृत जानकारी के लिए PDF को प्लंब करें और आसानी से टेक्स्ट और टेबल निकालें।
★ 10,701+15पिछले 7 दिनों में स्टार का बदलाव - #2
PyMuPDF डेटा निष्कर्षण, विश्लेषण, रूपांतरण और PDF (तथा अन्य) दस्तावेजों के हेरफेर के लिए एक उच्च-प्रदर्शन Python लाइब्रेरी है।
★ 10,602+67पिछले 7 दिनों में स्टार का बदलाव - #3
Rust कोर के साथ एक पॉलीग्लॉट डॉक्यूमेंट इंटेलिजेंस फ्रेमवर्क। 101 फॉर्मेट्स (115 फ़ाइल एक्सटेंशन) से टेक्स्ट, मेटाडेटा, इमेज और संरचित डेटा निकालें, साथ ही 371 कोड भाषाओं के लिए कोड इंटेलिजेंस। 15 भाषा बाइंडिंग्स — Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript — साथ ही CLI, REST API, और MCP सर्वर।
★ 9,233+48पिछले 7 दिनों में स्टार का बदलाव - #4
Table Transformer (TATR) असंरचित दस्तावेजों (PDF और छवियों) से टेबल निकालने के लिए एक डीप लर्निंग मॉडल है। यह PubTables-1M डेटासेट और GriTS मूल्यांकन मीट्रिक के लिए आधिकारिक रिपॉजिटरी भी है।
★ 2,943+2पिछले 7 दिनों में स्टार का बदलाव - #5
एक ऑन-प्रिमाइसेस, OCR-मुक्त असं estructured डेटा निष्कर्षण, मार्कडाउन रूपांतरण और बेंचमार्किंग टूलकिट। (https://idp-leaderboard.org/)
★ 2,086+4पिछले 7 दिनों में स्टार का बदलाव - #6
विज़न LLMs का उपयोग करके PDF से मार्कडाउन - टेबल, लेआउट और संरचना सुरक्षित रहती है
★ 901-2पिछले 7 दिनों में स्टार का बदलाव - #7
img2table, OpenCV इमेज प्रोसेसिंग पर आधारित PDF और छवियों के लिए एक टेबल पहचान और निष्कर्षण Python लाइब्रेरी है
★ 894+2पिछले 7 दिनों में स्टार का बदलाव - #8
ParseBench - AI एजेंटों के लिए एक दस्तावेज़ पार्सिंग बेंचमार्क
★ 558+2पिछले 7 दिनों में स्टार का बदलाव