crawler
Dépôts open source suivis étiquetés crawler, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de crawler sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés crawler.
- #1
Surveillance, collecte et transfert de contenu multiplateforme via un panneau Web pour gérer Douyin, Xiaohongshu et Kuaishou.
★ 1 833 - #2
Scraper pour BOSS Zhipin : outil d'extraction de données d'emploi utilisant le protocole Chrome CDP pour réutiliser les sessions authentifiées, contourner les protections par police de caractères et exporter les salaires en JSON/CSV avec analyse des compétences.
★ 1 282
- #1
L'API contextuelle pour rechercher, extraire et interagir avec le Web à grande échelle.
★ 175 781+1 747Évolution des étoiles sur les 7 derniers jours - #2
🕷️ Un framework de web scraping adaptatif qui gère tout, d'une simple requête à un crawl à grande échelle !
★ 78 099+941Évolution des étoiles sur les 7 derniers jours - #3
Scrapy, un framework de crawling et de scraping web rapide et de haut niveau pour Python.
★ 64 179+81Évolution des étoiles sur les 7 derniers jours - #4
Un crawler/spider web visuel sans code. YiCaiJi : un logiciel d'automatisation de navigateur, de collecte de données et de web scraping visuel permettant de concevoir et d'exécuter des tâches de scraping sans code. Alias : ServiceWrapper, un système d'encapsulation de services intelligents pour applications Web.
★ 44 492+22Évolution des étoiles sur les 7 derniers jours - #5★ 31 660+1Évolution des étoiles sur les 7 derniers jours
- #6
Scraper Python basé sur l'IA.
★ 30 435+388Évolution des étoiles sur les 7 derniers jours - #7
Bot open source de candidature à des emplois en Python : automatisation de navigateur et web scraping pour lire les offres, puis candidature automatique avec un CV et une lettre de motivation personnalisés pour chaque poste.
★ 30 304+26Évolution des étoiles sur les 7 derniers jours - #8
Crawlee — Une bibliothèque de web scraping et d'automatisation de navigateur pour Node.js afin de créer des crawlers fiables. En JavaScript et TypeScript. Extrayez des données pour l'IA, les LLM, le RAG ou les GPT. Téléchargez des fichiers HTML, PDF, JPG, PNG et autres depuis des sites web. Fonctionne avec Puppeteer, Playwright, Cheerio, JSDOM et HTTP brut. Modes avec et sans interface graphique. Avec rotation de proxy.
★ 25 622+66Évolution des étoiles sur les 7 derniers jours - #9★ 25 494+6Évolution des étoiles sur les 7 derniers jours
- #10
ProxyPool Python pour le web scraping
★ 23 659+11Évolution des étoiles sur les 7 derniers jours - #11
Douyin_TikTok_Download_API est un outil de scraping asynchrone haute performance prêt à l'emploi pour Douyin, Kuaishou, TikTok et Bilibili, prenant en charge les appels API, l'analyse par lots en ligne et le téléchargement.
★ 19 789+62Évolution des étoiles sur les 7 derniers jours - #12★ 17 378+20Évolution des étoiles sur les 7 derniers jours
- #13
La plateforme open-source no-code pour le web scraping, le crawling, la recherche et l'extraction de données par IA • Transformez des sites web en API structurées en quelques minutes
★ 17 349+27Évolution des étoiles sur les 7 derniers jours - #14
newspaper3k est une bibliothèque Python 3 pour l'extraction d'actualités, de textes complets et de métadonnées d'articles.
★ 15 148+2Évolution des étoiles sur les 7 derniers jours - #15
Exemples de crawlers Python intéressants et accessibles aux débutants, ciblant notamment Taobao, Tmall, WeChat, WeChat Reading, Douban et QQ.
★ 14 686+5Évolution des étoiles sur les 7 derniers jours - #16★ 13 160+4Évolution des étoiles sur les 7 derniers jours
- #17
Plateforme d'administration de web crawler distribué pour la gestion de spiders, indépendante des langages et des frameworks
★ 12 268+4Évolution des étoiles sur les 7 derniers jours - #18★ 11 681+1Évolution des étoiles sur les 7 derniers jours
- #19
Scripts Python pour la connexion simulée à Zhihu, le web scraping, l'automatisation Excel, les comptes officiels WeChat et le démarrage à distance.
★ 10 808+5Évolution des étoiles sur les 7 derniers jours - #20
Système de gestion de vidéos AV, scrapers pour avmoo, javbus et javlibrary, bibliothèque AV en ligne, base de données de liens magnétiques AV, bibliothèque de vidéos pour adultes japonaises.
★ 10 047+3Évolution des étoiles sur les 7 derniers jours - #21
Crawlee : une bibliothèque de web scraping et d'automatisation de navigateur pour Python permettant de créer des crawlers fiables. Extrayez des données pour l'IA, les LLM, le RAG ou les GPT. Téléchargez des fichiers HTML, PDF, JPG, PNG et autres depuis des sites web. Compatible avec Parsel, BeautifulSoup, Playwright et HTTP brut. Modes avec ou sans interface graphique, avec rotation de proxy.
★ 9 481+4Évolution des étoiles sur les 7 derniers jours - #22
Agent intelligent d'acquisition de clients via les médias sociaux, conçu pour les OPC et les PME
★ 8 489+14Évolution des étoiles sur les 7 derniers jours - #23
Liste de bibliothèques, outils et API pour le web scraping et le traitement de données.
★ 8 139+1Évolution des étoiles sur les 7 derniers jours - #24
Un scraper web intelligent, automatique, rapide et léger pour Python
★ 7 932+17Évolution des étoiles sur les 7 derniers jours - #25
Une collection de web crawlers et spiders dans différents langages.
★ 7 303+5Évolution des étoiles sur les 7 derniers jours - #26
API Python pour JMComic | Fournit une API Python pour accéder à JMComic, avec prise en charge des versions web et mobile | Téléchargeur GitHub Actions pour JMComic 🚀
★ 7 075+37Évolution des étoiles sur les 7 derniers jours - #27
Pydoll est une bibliothèque d'automatisation pour navigateurs basés sur Chromium sans WebDriver, offrant des interactions réalistes.
★ 7 060+7Évolution des étoiles sur les 7 derniers jours - #28
Web crawler/spider pour NodeJS avec jQuery côté serveur
★ 6 796-2Évolution des étoiles sur les 7 derniers jours - #29
Outil Python et en ligne de commande pour collecter du texte et des métadonnées sur le Web : crawling, scraping, extraction, avec sortie en CSV, JSON, HTML, MD, TXT, XML.
★ 6 754+26Évolution des étoiles sur les 7 derniers jours - #30
Interface de crawler pour comptes publics WeChat basée sur la recherche Sogou WeChat.
★ 6 378+0Évolution des étoiles sur les 7 derniers jours