data-extraction
data-extraction टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर data-extraction के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और data-extraction टैग वाली रिपॉजिटरी।
- #1
AI कोडिंग असिस्टेंट चैट इतिहास के लिए मुफ्त ओपन-सोर्स एक्सट्रैक्टर। यह Claude Code, Cursor, Windsurf, Aider, Cline/Roo Code और अन्य को सपोर्ट करता है।
★ 554
- #1
बड़े पैमाने पर वेब को खोजने, स्क्रैप करने और इंटरैक्ट करने के लिए कॉन्टेक्स्ट API। 🔥
★ 1,75,781+1,747पिछले 7 दिनों में स्टार का बदलाव - #2
🕷️ एक एडेप्टिव Web Scraping फ्रेमवर्क जो सिंगल रिक्वेस्ट से लेकर फुल-स्केल क्रॉल तक सब कुछ संभालता है!
★ 78,099+941पिछले 7 दिनों में स्टार का बदलाव - #3
AI पर आधारित Python scraper
★ 30,435+388पिछले 7 दिनों में स्टार का बदलाव - #4
🔥 web scraping, crawling, खोज और AI डेटा निष्कर्षण (data extraction) के लिए ओपन-सोर्स नो-कोड प्लेटफॉर्म • वेबसाइटों को मिनटों में संरचित (structured) APIs में बदलें 🔥
★ 17,349+27पिछले 7 दिनों में स्टार का बदलाव - #5★ 6,009+1पिछले 7 दिनों में स्टार का बदलाव
- #6★ 5,709-3पिछले 7 दिनों में स्टार का बदलाव
- #7
AI एजेंटों के लिए निर्मित ब्राउज़र ऑटोमेशन CLI। एंटी-बॉट दीवारों को तोड़ें, अटकने पर प्लेटफार्मों पर मनुष्यों को सौंपें। समानांतर मल्टी-टास्क निष्पादन, स्वतंत्र मल्टी-सेशन संचालन, पृथक मल्टी-अकाउंट ब्राउज़िंग।
★ 5,549+27पिछले 7 दिनों में स्टार का बदलाव - #8
एक शक्तिशाली Model Context Protocol (MCP) सर्वर जो सार्वजनिक वेब एक्सेस के लिए ऑल-इन-वन समाधान प्रदान करता है।
★ 2,624+10पिछले 7 दिनों में स्टार का बदलाव - #9
अटेम्प्टेड सेल्फ-होस्टेड ब्राउज़र ऑटोमेशन प्लेटफ़ॉर्म। 0% डिटेक्शन दरों के लिए Camoufox (Firefox) द्वारा संचालित। गति, गोपनीयता और मापनीयता के लिए बनाया गया।
★ 2,279+7पिछले 7 दिनों में स्टार का बदलाव - #10
रेसिपी डेटा स्क्रैप करने के लिए Python पैकेज
★ 2,218+2पिछले 7 दिनों में स्टार का बदलाव - #11
ContextGem: दस्तावेजों से सहज LLM निष्कर्षण
★ 1,996+1पिछले 7 दिनों में स्टार का बदलाव - #12
दिए गए URL से लेख निकालने के लिए
★ 1,911+1पिछले 7 दिनों में स्टार का बदलाव - #13
:truck: Pandas, Dask, cuDF, Dask-cuDF, Vaex और PySpark के साथ एगिले डेटा प्रिपरेशन वर्कफ़्लो को आसान बनाया गया
★ 1,536+0पिछले 7 दिनों में स्टार का बदलाव - #14
वित्तीय विश्लेषण और स्वचालन के लिए एक शुरुआती-अनुकूल लेकिन शक्तिशाली Python टूलकिट — जिसे आधुनिक निवेश को सभी के लिए सुलभ बनाने के लिए बनाया गया है
★ 1,391+3पिछले 7 दिनों में स्टार का बदलाव - #15★ 1,353+3पिछले 7 दिनों में स्टार का बदलाव
- #16
Maigret के पीछे का एक्सट्रैक्शन इंजन: किसी भी प्रोफाइल URL को 150+ साइटों पर एक स्ट्रक्चर्ड OSINT रिकॉर्ड में बदलें
★ 1,081+5पिछले 7 दिनों में स्टार का बदलाव - #17
Python और Rust के लिए सबसे तेज़ PDF लाइब्रेरी। टेक्स्ट एक्सट्रैक्शन, इमेज एक्सट्रैक्शन, मार्कडाउन कन्वर्ज़न, PDF निर्माण और संपादन। 0.8ms औसत, उद्योग के नेताओं से 5 गुना तेज़, 3,830 PDF पर 100% पास दर। MIT/Apache-2.0।
★ 1,017+11पिछले 7 दिनों में स्टार का बदलाव - #18
Rust में बना तेज़ और हल्का Firecrawl/Tavily विकल्प। AI एजेंटों के लिए MCP सर्वर के साथ वेब स्क्रैपर, क्रॉलर और सर्च API। Firecrawl-संगत API (/scrape, /crawl, /search)। 1K-URL बेंचमार्क में Tavily से 2.3 गुना तेज़ और Firecrawl से 1.5 गुना तेज़। 6 MB RAM, सिंगल बाइनरी। सेल्फ-होस्ट करें या मैनेज्ड क्लाउड का उपयोग करें।
★ 955+87पिछले 7 दिनों में स्टार का बदलाव - #19
आपके डेटा के लिए लोकल-फर्स्ट, ओपन-सोर्स AI असिस्टेंट। कार्यों, नोट्स, दस्तावेज़ों, फ़ोटो और बुकमार्क को एकीकृत करें। निजी, सेल्फ-होस्टेड और API के माध्यम से विस्तार योग्य।
★ 918+5पिछले 7 दिनों में स्टार का बदलाव - #20
ChatGPT से Hacker News का सारांश प्राप्त करें
★ 756+0पिछले 7 दिनों में स्टार का बदलाव - #21
Effortlessly extract data with our AI scraper API. Simplify data extraction, get clean JSON outputs and adapt to page changes. Try it free today!
★ 706+135पिछले 7 दिनों में स्टार का बदलाव - #22
PDF फ़ाइलों से टेक्स्ट और टेबल पार्स करें।
★ 704+0पिछले 7 दिनों में स्टार का बदलाव - #23
🤖 विजुअल वर्कफ़्लो बिल्डर के साथ AI-संचालित वेब स्क्रैपिंग एडिटर। नेचुरल लैंग्वेज का उपयोग करके वेब स्क्रैपर्स बनाएं, टेस्ट करें और तैनात करें। ScrapeGraphAI और LangGraph द्वारा संचालित।
★ 695+10पिछले 7 दिनों में स्टार का बदलाव - #24
संरचित Google Review API का उपयोग करके Google Maps से रेटिंग, समीक्षा पाठ और व्यावसायिक अंतर्दृष्टि निकालने के लिए Google Reviews API एकीकरण और स्केलेबल Google Reviews स्क्रaper।
★ 594+1पिछले 7 दिनों में स्टार का बदलाव - #25
Python में अनडिटेक्टेड वेब-स्क्रैपिंग और सीमलेस HTML पार्सिंग
★ 563+2पिछले 7 दिनों में स्टार का बदलाव - #26
द मिसिंग GitHub स्टेटस पेज — GitHub स्टेटस को ऐतिहासिक रूप से प्रलेखित करने के लिए एक फ्लैट डेटा प्रयास।
★ 562+0पिछले 7 दिनों में स्टार का बदलाव - #27
AI के लिए ओपन सोर्स वेब इन्फ्रास्ट्रक्चर। स्क्रैप करें, क्रॉल करें और वेब को स्वचालित करें, साफ मार्कडाउन, ब्राउज़र सेशन, आपके एजेंटों के लिए तैयार।
★ 559+0पिछले 7 दिनों में स्टार का बदलाव - #28
AI कोडिंग असिस्टेंट चैट इतिहास के लिए मुफ्त ओपन-सोर्स एक्सट्रैक्टर। यह Claude Code, Cursor, Windsurf, Aider, Cline/Roo Code और अन्य को सपोर्ट करता है।
★ 554+5पिछले 7 दिनों में स्टार का बदलाव