spider
Dépôts open source suivis étiquetés spider, triés par étoiles.
- #31★ 2 463+0Évolution des étoiles sur les 7 derniers jours
- #32
CrawlerDetect est une classe PHP pour détecter les bots, crawlers et spiders via l'user agent
★ 2 403+2Évolution des étoiles sur les 7 derniers jours - #33
Téléchargement d'images depuis Google, Bing et Baidu.
★ 2 360-2Évolution des étoiles sur les 7 derniers jours - #34
Framework de crawler web multiplateforme en C# conçu pour la vitesse et la flexibilité
★ 2 310+0Évolution des étoiles sur les 7 derniers jours - #35
BlueSky Crawler est un système de scraping open source gratuit. Il permet de collecter des données par simple clic, fonctionne en local, sur hébergement mutualisé ou cloud, supporte presque tous les types de pages web, s'intègre aux CMS et publie les données en temps réel sans intervention humaine.
★ 2 088-1Évolution des étoiles sur les 7 derniers jours - #36★ 2 019+0Évolution des étoiles sur les 7 derniers jours
- #37★ 1 891+3Évolution des étoiles sur les 7 derniers jours
- #38★ 1 879+2Évolution des étoiles sur les 7 derniers jours
- #39
Un scanner d'applications web basé sur Python pour collecter des données OSINT et effectuer du fuzzing sur les vulnérabilités OWASP d'un site web cible.
★ 1 820-1Évolution des étoiles sur les 7 derniers jours - #40
QQ空间导出助手,用于备份QQ空间的说说、日志、私密日记、相册、视频、留言板、QQ好友、收藏夹、分享、最近访客为文件,便于迁移与保存
★ 1 815+13Évolution des étoiles sur les 7 derniers jours - #41
Collection de scrapers Python : musique NetEase, vidéos Bilibili, questions Zhihu, fonds d'écran, vidéos xvideos, livres audio, Weibo, données Anjuke avec visualisation, extracteur de miniatures Bilibili, pool de proxys IP, et analyse de données utilisateurs Zhihu.
★ 1 649+4Évolution des étoiles sur les 7 derniers jours - #42
Web crawler pour archivistes : sortie au format WARC, tableau de bord pour tous les crawls et modèles d'exclusion dynamiques.
★ 1 609+2Évolution des étoiles sur les 7 derniers jours - #43
Crawler Douyin : collecte de données publiques telles que les pages de profil, les likes, les favoris, les pistes audio, les hashtags, les recherches, les collections, les publications, les abonnements et les abonnés.
★ 1 605+1Évolution des étoiles sur les 7 derniers jours - #44★ 1 410+0Évolution des étoiles sur les 7 derniers jours
- #45
Partage de code de scraping, rétro-ingénierie JS et techniques avancées de scraping. Suivez le compte officiel : K哥爬虫.
★ 1 379+0Évolution des étoiles sur les 7 derniers jours - #46
Journaux officiels brésiliens accessibles à tous
★ 1 375+1Évolution des étoiles sur les 7 derniers jours - #47
La boîte à outils de référence pour l'audit et l'exploitation des failles CSRF (Cross Site Request Forgery).
★ 1 303+1Évolution des étoiles sur les 7 derniers jours - #48
Outil de téléchargement pour récupérer des livres numériques sur Internet.
★ 1 294+0Évolution des étoiles sur les 7 derniers jours - #49
Scraper pour BOSS Zhipin : outil d'extraction de données d'emploi utilisant le protocole Chrome CDP pour réutiliser les sessions authentifiées, contourner les protections par police de caractères et exporter les salaires en JSON/CSV avec analyse des compétences.
★ 1 282+33Évolution des étoiles sur les 7 derniers jours - #50
Beanbun est un framework de web scraping multi-processus écrit en PHP, basé sur Workerman, offrant une grande ouverture et une haute extensibilité.
★ 1 258-1Évolution des étoiles sur les 7 derniers jours - #51
50 notes sur les grands modèles de langage (LLM). Ce dépôt contient des projets pratiques dans les domaines du machine learning, du deep learning, de la vision par ordinateur, du traitement du langage naturel, des LLM et du web scraping.
★ 1 117+3Évolution des étoiles sur les 7 derniers jours - #52
Crawly, un framework de crawling et de scraping web de haut niveau pour Elixir.
★ 1 116+2Évolution des étoiles sur les 7 derniers jours - #53★ 1 104+2Évolution des étoiles sur les 7 derniers jours
- #54
Crawler pour les articles de comptes officiels WeChat
★ 1 079+4Évolution des étoiles sur les 7 derniers jours - #55
Scripts de web scraping Python évolutifs pour plus de 40 domaines populaires
★ 1 076+5Évolution des étoiles sur les 7 derniers jours - #56
Ingénierie inverse et décryptage de paramètres JS anti-scraping : inclut le support pour GeeTest, QQ Music, Pinduoduo, Boss Zhipin, Zhihu, Kugou, Vipshop, China Judgements Online, Taobao, Tianan Insurance, Bilibili, Fang.com, WPS, Weibo, Youdao, NetEase, WeChat, Kongzhong, Jingou, systèmes de gestion scolaire, etc.
★ 1 035+0Évolution des étoiles sur les 7 derniers jours - #57
Suppression de filigrane pour vidéos courtes en Golang : Douyin, Pipixia, Huoshan, Weishi, Zuiyou, Kuaishou, Quanmin, Pipigaoxiao, Xigua, Huya, Pear Video, AcFun, Haokan, etc.
★ 1 032+11Évolution des étoiles sur les 7 derniers jours - #58
Téléchargement et scraping de romans, prise en charge de Qidian et Biquge, exportation vers Markdown ou txt, conversion en epub, filtrage publicitaire et correction automatique.
★ 1 018+9Évolution des étoiles sur les 7 derniers jours - #59★ 998+0Évolution des étoiles sur les 7 derniers jours
- #60
Releases, wiki et roadmap de SpiderSuite (crawler de sécurité web)
★ 975+1Évolution des étoiles sur les 7 derniers jours