pdf-extraction
pdf-extraction टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर pdf-extraction के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और pdf-extraction टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
AI-तैयार डेटा के लिए PDF पार्सर। PDF एक्सेसिबिलिटी को स्वचालित करें। ओपन-सोर्स।
★ 28,856+215पिछले 7 दिनों में स्टार का बदलाव - #2
PDF निरीक्षण, वर्गीकरण और टेक्स्ट एक्सट्रैक्शन के लिए तेज़ Rust लाइब्रेरी। स्मार्ट रूटिंग निर्णयों को सक्षम करने के लिए स्कैन किए गए बनाम टेक्स्ट-आधारित PDF का बुद्धिमानी से पता लगाता है।
★ 16,883+436पिछले 7 दिनों में स्टार का बदलाव - #3
Rust कोर के साथ एक पॉलीग्लॉट डॉक्यूमेंट इंटेलिजेंस फ्रेमवर्क। 101 फॉर्मेट्स (115 फ़ाइल एक्सटेंशन) से टेक्स्ट, मेटाडेटा, इमेज और संरचित डेटा निकालें, साथ ही 371 कोड भाषाओं के लिए कोड इंटेलिजेंस। 15 भाषा बाइंडिंग्स — Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, TypeScript — साथ ही CLI, REST API, और MCP सर्वर।
★ 9,233+48पिछले 7 दिनों में स्टार का बदलाव - #4
असंरचित डेटा का LLM-चालित निष्कर्षण - API तैनाती और ETL पाइपलाइन वर्कफ़्लो के लिए निर्मित
★ 7,182+26पिछले 7 दिनों में स्टार का बदलाव - #5★ 1,041+23पिछले 7 दिनों में स्टार का बदलाव
- #6
PDF पर हस्ताक्षर करने (अकेले या दूसरों के साथ), पेजों को व्यवस्थित करने, मेटाडेटा संपादित करने और PDF को कंप्रेस करने के लिए मुफ्त ओपन-सोर्स वेब सॉफ़्टवेयर।
★ 826+1पिछले 7 दिनों में स्टार का बदलाव - #7★ 788+3पिछले 7 दिनों में स्टार का बदलाव
- #8★ 607-1पिछले 7 दिनों में स्टार का बदलाव
- #9
जावा पीडीएफ टेबल एक्सट्रैक्शन और ओसीआर लाइब्रेरी। स्ट्रीम, लैटिस (ओपनसीवी-शैली ग्रिड डिटेक्शन) और हाइब्रिड पार्सिंग का उपयोग करके टेक्स्ट-आधारित और स्कैन किए गए पीडीएफ से संरचित टेबल निकालें।
★ 517-27पिछले 7 दिनों में स्टार का बदलाव