scraper
Dépôts open source suivis étiquetés scraper, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de scraper sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés scraper.
- #1
Scraper pour BOSS Zhipin : outil d'extraction de données d'emploi utilisant le protocole Chrome CDP pour réutiliser les sessions authentifiées, contourner les protections par police de caractères et exporter les salaires en JSON/CSV avec analyse des compétences.
★ 1 256 - #2
Moteur de scraping auto-hébergé — contourne tous les défis JS et captchas : Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Alternative à FlareSolverr & Byparr et remplacement direct pour votre suite *arr.
★ 742
- #1
L'API contextuelle pour rechercher, extraire et interagir avec le Web à grande échelle.
★ 174 034+3 406Évolution des étoiles sur les 7 derniers jours - #2★ 49 872+40Évolution des étoiles sur les 7 derniers jours
- #3
Un crawler/spider web visuel sans code. YiCaiJi : un logiciel d'automatisation de navigateur, de collecte de données et de web scraping visuel permettant de concevoir et d'exécuter des tâches de scraping sans code. Alias : ServiceWrapper, un système d'encapsulation de services intelligents pour applications Web.
★ 44 470+72Évolution des étoiles sur les 7 derniers jours - #4★ 31 659+21Évolution des étoiles sur les 7 derniers jours
- #5
La bibliothèque rapide, flexible et élégante pour analyser et manipuler le HTML et le XML.
★ 30 471+11Évolution des étoiles sur les 7 derniers jours - #6
Crawlee — Une bibliothèque de web scraping et d'automatisation de navigateur pour Node.js afin de créer des crawlers fiables. En JavaScript et TypeScript. Extrayez des données pour l'IA, les LLM, le RAG ou les GPT. Téléchargez des fichiers HTML, PDF, JPG, PNG et autres depuis des sites web. Fonctionne avec Puppeteer, Playwright, Cheerio, JSDOM et HTTP brut. Modes avec et sans interface graphique. Avec rotation de proxy.
★ 25 556+98Évolution des étoiles sur les 7 derniers jours - #7★ 25 488+26Évolution des étoiles sur les 7 derniers jours
- #8
Douyin_TikTok_Download_API est un outil de scraping asynchrone haute performance prêt à l'emploi pour Douyin, Kuaishou, TikTok et Bilibili, prenant en charge les appels API, l'analyse par lots en ligne et le téléchargement.
★ 19 727+192Évolution des étoiles sur les 7 derniers jours - #9
La plateforme open-source no-code pour le web scraping, le crawling, la recherche et l'extraction de données par IA • Transformez des sites web en API structurées en quelques minutes
★ 17 322+70Évolution des étoiles sur les 7 derniers jours - #10
newspaper3k est une bibliothèque Python 3 pour l'extraction d'actualités, de textes complets et de métadonnées d'articles.
★ 15 146+8Évolution des étoiles sur les 7 derniers jours - #11
Système de gestion de vidéos AV, scrapers pour avmoo, javbus et javlibrary, bibliothèque AV en ligne, base de données de liens magnétiques AV, bibliothèque de vidéos pour adultes japonaises.
★ 10 044+10Évolution des étoiles sur les 7 derniers jours - #12
Crawlee : une bibliothèque de web scraping et d'automatisation de navigateur pour Python permettant de créer des crawlers fiables. Extrayez des données pour l'IA, les LLM, le RAG ou les GPT. Téléchargez des fichiers HTML, PDF, JPG, PNG et autres depuis des sites web. Compatible avec Parsel, BeautifulSoup, Playwright et HTTP brut. Modes avec ou sans interface graphique, avec rotation de proxy.
★ 9 477+19Évolution des étoiles sur les 7 derniers jours - #13
Un scraper web intelligent, automatique, rapide et léger pour Python
★ 7 915+25Évolution des étoiles sur les 7 derniers jours - #14
Une collection de web crawlers et spiders dans différents langages.
★ 7 298+6Évolution des étoiles sur les 7 derniers jours - #15★ 7 082+14Évolution des étoiles sur les 7 derniers jours
- #16
Transformez n'importe quelle page web en données structurées à l'aide de LLM
★ 6 917+2Évolution des étoiles sur les 7 derniers jours - #17
💡 Téléchargez le code source complet de n'importe quel site web (y compris tous les assets : Javascripts, feuilles de style, images) en utilisant Node.js
★ 5 274+76Évolution des étoiles sur les 7 derniers jours - #18
Analyse des systèmes de protection contre les bots et contre-mesures disponibles. Comment déjouer les systèmes anti-bot et contourner les scripts d'empreinte numérique du navigateur lors du web scraping ?
★ 5 129+3Évolution des étoiles sur les 7 derniers jours - #19
Outil multifonction pour le scraping et l'extraction de données à partir de ressources en ligne, conçu pour les hackers.
★ 4 771+1Évolution des étoiles sur les 7 derniers jours - #20
Téléchargeur de vidéos YouTube en JavaScript.
★ 4 730+0Évolution des étoiles sur les 7 derniers jours - #21
Scraper pour l'API Twitter | Sans clé API | API interne Twitter | Gratuit | Scraper Twitter | Bot Twitter
★ 4 638+11Évolution des étoiles sur les 7 derniers jours - #22
Une bibliothèque pour extraire les données utilisateur de LinkedIn
★ 4 458+15Évolution des étoiles sur les 7 derniers jours - #23
Une plateforme communautaire pour lire et discuter avec des bots IA, propulsée par chatGPT.
★ 4 418-1Évolution des étoiles sur les 7 derniers jours - #24
Scraper pour extraire tous les médias d'un compte OnlyFans, mis à jour régulièrement.
★ 4 271-2Évolution des étoiles sur les 7 derniers jours - #25★ 4 073-2Évolution des étoiles sur les 7 derniers jours
- #26
Un plugin de scraping de films japonais pour Emby/Jellyfin, capable de récupérer des informations sur les films depuis certains sites web.
★ 3 796-2Évolution des étoiles sur les 7 derniers jours - #27
Prend une liste de domaines, explore les URL et recherche des points de terminaison, des secrets, des clés API, des extensions de fichiers, des jetons et plus encore.
★ 3 756+6Évolution des étoiles sur les 7 derniers jours - #28★ 3 725-6Évolution des étoiles sur les 7 derniers jours
- #29
Ce script utilise le web-scraping et l'automatisation pour trouver des coupons Udemy et vous inscrire gratuitement à des cours Udemy payants.
★ 3 291+3Évolution des étoiles sur les 7 derniers jours - #30
Un puissant scraper web propulsé par LLM | OpenAI, Gemini & Ollama
★ 3 250+27Évolution des étoiles sur les 7 derniers jours