Aller au contenu principal
buildradar
Sign in
Sujet · spider

spider

Dépôts open source suivis étiquetés spider, triés par étoiles.

85 dépôts
  • grab@lorien

    Framework de web scraping

    2 463+0Évolution des étoiles sur les 7 derniers jours
  • Crawler-Detect@JayBizzle

    CrawlerDetect est une classe PHP pour détecter les bots, crawlers et spiders via l'user agent

    2 403+2Évolution des étoiles sur les 7 derniers jours
  • Image-Downloader@QianyanTech

    Téléchargement d'images depuis Google, Bing et Baidu.

    2 360-2Évolution des étoiles sur les 7 derniers jours
  • abot@sjdirect

    Framework de crawler web multiplateforme en C# conçu pour la vitesse et la flexibilité

    2 310+0Évolution des étoiles sur les 7 derniers jours
  • skycaiji@zorlan

    BlueSky Crawler est un système de scraping open source gratuit. Il permet de collecter des données par simple clic, fonctionne en local, sur hébergement mutualisé ou cloud, supporte presque tous les types de pages web, s'intègre aux CMS et publie les données en temps réel sans intervention humaine.

    2 088-1Évolution des étoiles sur les 7 derniers jours
  • gain@elliotgao2

    Framework de crawling web basé sur asyncio.

    2 019+0Évolution des étoiles sur les 7 derniers jours
  • Présentation du site de liens magnet U3C3 et mise à jour du nom de domaine

    1 891+3Évolution des étoiles sur les 7 derniers jours
  • x-crawl@coder-hxl

    Bibliothèque de crawler flexible assistée par IA pour Node.js.

    1 879+2Évolution des étoiles sur les 7 derniers jours
  • BlackWidow@1N3

    Un scanner d'applications web basé sur Python pour collecter des données OSINT et effectuer du fuzzing sur les vulnérabilités OWASP d'un site web cible.

    1 820-1Évolution des étoiles sur les 7 derniers jours
  • QZoneExport@ShunCai

    QQ空间导出助手,用于备份QQ空间的说说、日志、私密日记、相册、视频、留言板、QQ好友、收藏夹、分享、最近访客为文件,便于迁移与保存

    1 815+13Évolution des étoiles sur les 7 derniers jours
  • spider_collection@srx-2000

    Collection de scrapers Python : musique NetEase, vidéos Bilibili, questions Zhihu, fonds d'écran, vidéos xvideos, livres audio, Weibo, données Anjuke avec visualisation, extracteur de miniatures Bilibili, pool de proxys IP, et analyse de données utilisateurs Zhihu.

    1 649+4Évolution des étoiles sur les 7 derniers jours
  • grab-site@ArchiveTeam

    Web crawler pour archivistes : sortie au format WARC, tableau de bord pour tous les crawls et modèles d'exclusion dynamiques.

    1 609+2Évolution des étoiles sur les 7 derniers jours
  • douyin@erma0

    Crawler Douyin : collecte de données publiques telles que les pages de profil, les likes, les favoris, les pistes audio, les hashtags, les recherches, les collections, les publications, les abonnements et les abonnés.

    1 605+1Évolution des étoiles sur les 7 derniers jours
  • sperm@darbra

    Compilation d'articles remarquables sur le reverse engineering, à consulter.

    1 410+0Évolution des étoiles sur les 7 derniers jours
  • crawler@kgspider

    Partage de code de scraping, rétro-ingénierie JS et techniques avancées de scraping. Suivez le compte officiel : K哥爬虫.

    1 379+0Évolution des étoiles sur les 7 derniers jours
  • querido-diario@okfn-brasil

    Journaux officiels brésiliens accessibles à tous

    1 375+1Évolution des étoiles sur les 7 derniers jours
  • XSRFProbe@0xInfection

    La boîte à outils de référence pour l'audit et l'exploitation des failles CSRF (Cross Site Request Forgery).

    1 303+1Évolution des étoiles sur les 7 derniers jours
  • bookhunter@bookstairs

    Outil de téléchargement pour récupérer des livres numériques sur Internet.

    1 294+0Évolution des étoiles sur les 7 derniers jours
  • boss-zhipin-scraper@eatmoreduck

    Scraper pour BOSS Zhipin : outil d'extraction de données d'emploi utilisant le protocole Chrome CDP pour réutiliser les sessions authentifiées, contourner les protections par police de caractères et exporter les salaires en JSON/CSV avec analyse des compétences.

    1 282+33Évolution des étoiles sur les 7 derniers jours
  • Beanbun@kiddyuchina

    Beanbun est un framework de web scraping multi-processus écrit en PHP, basé sur Workerman, offrant une grande ouverture et une haute extensibilité.

    1 258-1Évolution des étoiles sur les 7 derniers jours
  • DL-Hub@skygazer42

    50 notes sur les grands modèles de langage (LLM). Ce dépôt contient des projets pratiques dans les domaines du machine learning, du deep learning, de la vision par ordinateur, du traitement du langage naturel, des LLM et du web scraping.

    1 117+3Évolution des étoiles sur les 7 derniers jours
  • crawly@elixir-crawly

    Crawly, un framework de crawling et de scraping web de haut niveau pour Elixir.

    1 116+2Évolution des étoiles sur les 7 derniers jours
  • OneBlog@zhangyd-c

    OneBlog : un blog Java simple, esthétique, puissant et adaptatif.

    1 104+2Évolution des étoiles sur les 7 derniers jours
  • WeChat_Article@1061700625

    Crawler pour les articles de comptes officiels WeChat

    1 079+4Évolution des étoiles sur les 7 derniers jours
  • scrapfly-scrapers@scrapfly

    Scripts de web scraping Python évolutifs pour plus de 40 domaines populaires

    1 076+5Évolution des étoiles sur les 7 derniers jours
  • Crack-JS-Spider@LoseNine

    Ingénierie inverse et décryptage de paramètres JS anti-scraping : inclut le support pour GeeTest, QQ Music, Pinduoduo, Boss Zhipin, Zhihu, Kugou, Vipshop, China Judgements Online, Taobao, Tianan Insurance, Bilibili, Fang.com, WPS, Weibo, Youdao, NetEase, WeChat, Kongzhong, Jingou, systèmes de gestion scolaire, etc.

    1 035+0Évolution des étoiles sur les 7 derniers jours
  • parse-video@wujunwei928

    Suppression de filigrane pour vidéos courtes en Golang : Douyin, Pipixia, Huoshan, Weishi, Zuiyou, Kuaishou, Quanmin, Pipigaoxiao, Xigua, Huya, Pear Video, AcFun, Haokan, etc.

    1 032+11Évolution des étoiles sur les 7 derniers jours
  • Téléchargement et scraping de romans, prise en charge de Qidian et Biquge, exportation vers Markdown ou txt, conversion en epub, filtrage publicitaire et correction automatique.

    1 018+9Évolution des étoiles sur les 7 derniers jours
  • spider@gsh199449

    Un robot d'indexation web configurable avec une console web facile à utiliser.

    998+0Évolution des étoiles sur les 7 derniers jours
  • SpiderSuite@spidersuite

    Releases, wiki et roadmap de SpiderSuite (crawler de sécurité web)

    975+1Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets