crawler
Dépôts open source suivis étiquetés crawler, triés par étoiles.
- #121
Exemples de reverse engineering pour le web scraping, incluant : empreinte TLS |瑞数 | Zhenkunhang | NetEase Yidun | décompilation et reverse engineering de mini-programmes WeChat (Baidaxingxi) | Tonghuashun | déchiffrement RPC | Jiasule | captcha slider Geetest | Ocean Engine | Boss Zhipin | Qichacha | China Minmetals | QQ Music | plateforme de données sur les politiques industrielles | Qizhidao | Xueqiu (acw_sc__v2) | 1688 | Qimai Data | whggzy | Qiming Technology | mohurd | EntGroup | OKLink.
★ 914+4Évolution des étoiles sur les 7 derniers jours - #122
SiteOne Crawler est un outil multiplateforme d'exploration et d'analyse de sites web pour le SEO, la sécurité, l'accessibilité et l'optimisation des performances. Idéal pour les développeurs, DevOps, ingénieurs QA et consultants. Supporte Windows, macOS et Linux (x64 et arm64).
★ 896+13Évolution des étoiles sur les 7 derniers jours - #123★ 884+1Évolution des étoiles sur les 7 derniers jours
- #124
API haute performance asynchrone pour la résolution de CAPTCHA et les e-mails temporaires pour Douyin, TikTok, Xiaohongshu, Kuaishou, Weibo, Instagram, YouTube, Twitter (X)
★ 876+10Évolution des étoiles sur les 7 derniers jours - #125
Bibliothèque de test, de scraping et d'analyse basée sur Kotlin, permettant d'extraire des données de pages HTML (rendues côté serveur ou client). Elle met l'accent sur la facilité d'utilisation et la lisibilité grâce à un DSL intuitif. Conçue comme bibliothèque de test, elle peut également servir au scraping de sites web.
★ 875-1Évolution des étoiles sur les 7 derniers jours - #126
ArrowDL (Arrow Downloader) est un gestionnaire de téléchargement pour Windows, MacOS et Linux.
★ 848+4Évolution des étoiles sur les 7 derniers jours - #127
Une bibliothèque de web crawling polyvalente en Ruby capable d'explorer un site, plusieurs domaines, des liens spécifiques ou à l'infini. Spidr est conçu pour être rapide et facile à utiliser.
★ 836+0Évolution des étoiles sur les 7 derniers jours - #128
Outil de rétro-ingénierie IA tout-en-un
★ 824+35Évolution des étoiles sur les 7 derniers jours - #129
Code de tutoriel simple mais utile pour le web scraping en Python.
★ 820+0Évolution des étoiles sur les 7 derniers jours - #130★ 805+0Évolution des étoiles sur les 7 derniers jours
- #131★ 803+1Évolution des étoiles sur les 7 derniers jours
- #132
Outil de rétro-ingénierie pour cookies JS : outil de visualisation du suivi des changements de cookies JS et points d'arrêt conditionnels par hook.
★ 785-1Évolution des étoiles sur les 7 derniers jours - #133★ 780+7Évolution des étoiles sur les 7 derniers jours
- #134
Scraper de profils LinkedIn retournant des données structurées au format JSON
★ 776+0Évolution des étoiles sur les 7 derniers jours - #135
Dépôt de code pour le livre "Pratique avancée de l'ingénierie inverse pour le web scraping"
★ 769+0Évolution des étoiles sur les 7 derniers jours - #136
Un framework de crawler web léger.
★ 760-1Évolution des étoiles sur les 7 derniers jours - #137
The Big Brother V6.0 est une plateforme OSINT militarisée comprenant l'énumération de noms d'utilisateur (plus de 473 plateformes), une intelligence visuelle à quatre vecteurs, le suivi Sky Radar, l'analyse de portefeuilles crypto, l'intelligence SSL, la reconstruction d'empreinte numérique, l'extraction EXIF, le dorking avancé et la reconnaissance réseau.
★ 758+8Évolution des étoiles sur les 7 derniers jours - #138
Laissez ChatGPT résumer Hacker News pour vous.
★ 756+0Évolution des étoiles sur les 7 derniers jours - #139
Application de sauvegarde pour blogs Tumblr et Twitter
★ 733+0Évolution des étoiles sur les 7 derniers jours - #140★ 732+0Évolution des étoiles sur les 7 derniers jours
- #141
Wscan est un scanner de sécurité Web axé sur la sécurité Web, visant à la rendre accessible à tous.
★ 713+2Évolution des étoiles sur les 7 derniers jours - #142
Recherchez google, bing, yahoo et d'autres moteurs de recherche avec python
★ 671+2Évolution des étoiles sur les 7 derniers jours - #143
Dépôt officiel pour "Craw4LLM: Crawling web efficace pour le pré-entraînement des LLM"
★ 664+1Évolution des étoiles sur les 7 derniers jours - #144
NetDiscovery est un framework/middleware de web scraping universel basé sur des frameworks tels que Vert.x et RxJava 2.
★ 646+0Évolution des étoiles sur les 7 derniers jours - #145
Krawl est un serveur de duperie web et anti-robot léger, personnalisable et natif pour le cloud, qui crée de fausses applications web présentant des vulnérabilités faciles à exploiter à l'aide de données leurres réalistes générées aléatoirement et de modèles HTML générés par IA.
★ 646+4Évolution des étoiles sur les 7 derniers jours - #146
Sauvegarde localement des pages web sur votre disque dur avec les images, CSS, JS et liens tels quels.
★ 639+1Évolution des étoiles sur les 7 derniers jours - #147
Moodle-DL télécharge rapidement le contenu des cours depuis Moodle (par ex. les PDF de cours)
★ 634+2Évolution des étoiles sur les 7 derniers jours - #148
Jie est un outil complet d'évaluation et d'exploitation de la sécurité conçu pour les applications web. Son ensemble robuste de fonctionnalités comprend l'analyse des vulnérabilités, la collecte d'informations et l'exploitation, en faisant un kit d'outils indispensable pour les professionnels de la sécurité et les testeurs d'intrusion. Outil d'assistance au bug bounty (analyse de vulnérabilités, collecte d'informations)
★ 608-1Évolution des étoiles sur les 7 derniers jours - #149★ 560+1Évolution des étoiles sur les 7 derniers jours
- #150
Infrastructure web open source pour l'IA. Extrayez, explorez et automatisez le web, du markdown propre, des sessions de navigateur, prêts pour vos agents.
★ 559+0Évolution des étoiles sur les 7 derniers jours