web-crawling
web-crawling टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर web-crawling के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और web-crawling टैग वाली रिपॉजिटरी।
- #1
Crawlee—विश्वसनीय crawlers बनाने के लिए Node.js का एक web scraping और browser automation लाइब्रेरी। JavaScript और TypeScript में। AI, LLMs, RAG या GPTs के लिए डेटा एक्सट्रैक्ट करें। वेबसाइटों से HTML, PDF, JPG, PNG और अन्य फ़ाइलें डाउनलोड करें। Puppeteer, Playwright, Cheerio, JSDOM और raw HTTP के साथ काम करता है। headful और headless दोनों मोड उपलब्ध। proxy rotation के साथ।
★ 25,622+66पिछले 7 दिनों में स्टार का बदलाव - #2
Crawlee—विश्वसनीय क्रॉलर बनाने के लिए Python के लिए एक वेब स्क्रैपिंग और ब्राउज़र ऑटोमेशन लाइब्रेरी। AI, LLMs, RAG, या GPTs के लिए डेटा निकालें। वेबसाइटों से HTML, PDF, JPG, PNG और अन्य फ़ाइलें डाउनलोड करें। Parsel, BeautifulSoup, Playwright, और raw HTTP के साथ काम करता है। हेडफुल और हेडलेस दोनों मोड। प्रॉक्सी रोटेशन के साथ।
★ 9,481+4पिछले 7 दिनों में स्टार का बदलाव - #3★ 6,009+1पिछले 7 दिनों में स्टार का बदलाव
- #4
अजेय स्क्रेपर्स बनाने के लिए ऑल इन वन फ्रेमवर्क
★ 5,695+3पिछले 7 दिनों में स्टार का बदलाव - #5
एक शक्तिशाली Model Context Protocol (MCP) सर्वर जो सार्वजनिक वेब एक्सेस के लिए ऑल-इन-वन समाधान प्रदान करता है।
★ 2,624+10पिछले 7 दिनों में स्टार का बदलाव - #6
AI एजेंटों के लिए सर्वश्रेष्ठ हेडलेस ब्राउज़र। हल्का, तेज़, उच्च-संगतता। Rust में निर्मित।
★ 1,764+331पिछले 7 दिनों में स्टार का बदलाव - #7★ 664+1पिछले 7 दिनों में स्टार का बदलाव