Aller au contenu principal
buildradar
Sign in
Sujet · crawler

crawler

Dépôts open source suivis étiquetés crawler, triés par étoiles.

Dépôts
153
Total d'étoiles
971 385
Étoiles en moyenne
6 349
Part
0,05%

Sujets qui apparaissent souvent aux côtés de crawler sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés crawler.

  • creatorhub@3441293738

    Surveillance, collecte et transfert de contenu multiplateforme via un panneau Web pour gérer Douyin, Xiaohongshu et Kuaishou.

    1 833
  • boss-zhipin-scraper@eatmoreduck

    Scraper pour BOSS Zhipin : outil d'extraction de données d'emploi utilisant le protocole Chrome CDP pour réutiliser les sessions authentifiées, contourner les protections par police de caractères et exporter les salaires en JSON/CSV avec analyse des compétences.

    1 282
  • firecrawl@firecrawl

    L'API contextuelle pour rechercher, extraire et interagir avec le Web à grande échelle.

    175 781+1 747Évolution des étoiles sur les 7 derniers jours
  • Scrapling@D4Vinci

    🕷️ Un framework de web scraping adaptatif qui gère tout, d'une simple requête à un crawl à grande échelle !

    78 099+941Évolution des étoiles sur les 7 derniers jours
  • scrapy@scrapy

    Scrapy, un framework de crawling et de scraping web rapide et de haut niveau pour Python.

    64 179+81Évolution des étoiles sur les 7 derniers jours
  • EasySpider@NaiboWang

    Un crawler/spider web visuel sans code. YiCaiJi : un logiciel d'automatisation de navigateur, de collecte de données et de web scraping visuel permettant de concevoir et d'exécuter des tâches de scraping sans code. Alias : ServiceWrapper, un système d'encapsulation de services intelligents pour applications Web.

    44 492+22Évolution des étoiles sur les 7 derniers jours
  • lux@iawia002

    👾 Bibliothèque de téléchargement vidéo rapide et simple et outil CLI écrit en Go.

    31 660+1Évolution des étoiles sur les 7 derniers jours
  • Scrapegraph-ai@ScrapeGraphAI

    Scraper Python basé sur l'IA.

    30 435+388Évolution des étoiles sur les 7 derniers jours
  • AIHawk@feder-cr

    Bot open source de candidature à des emplois en Python : automatisation de navigateur et web scraping pour lire les offres, puis candidature automatique avec un CV et une lettre de motivation personnalisés pour chaque poste.

    30 304+26Évolution des étoiles sur les 7 derniers jours
  • crawlee@apify

    Crawlee — Une bibliothèque de web scraping et d'automatisation de navigateur pour Node.js afin de créer des crawlers fiables. En JavaScript et TypeScript. Extrayez des données pour l'IA, les LLM, le RAG ou les GPT. Téléchargez des fichiers HTML, PDF, JPG, PNG et autres depuis des sites web. Fonctionne avec Puppeteer, Playwright, Cheerio, JSDOM et HTTP brut. Modes avec et sans interface graphique. Avec rotation de proxy.

    25 622+66Évolution des étoiles sur les 7 derniers jours
  • colly@gocolly

    Framework de scraping et de crawling élégant pour Golang

    25 494+6Évolution des étoiles sur les 7 derniers jours
  • proxy_pool@jhao104

    ProxyPool Python pour le web scraping

    23 659+11Évolution des étoiles sur les 7 derniers jours
  • Douyin_TikTok_Download_API est un outil de scraping asynchrone haute performance prêt à l'emploi pour Douyin, Kuaishou, TikTok et Bilibili, prenant en charge les appels API, l'analyse par lots en ligne et le téléchargement.

    19 789+62Évolution des étoiles sur les 7 derniers jours
  • katana@projectdiscovery

    Un framework de crawling et de spidering de nouvelle génération.

    17 378+20Évolution des étoiles sur les 7 derniers jours
  • maxun@getmaxun

    La plateforme open-source no-code pour le web scraping, le crawling, la recherche et l'extraction de données par IA • Transformez des sites web en API structurées en quelques minutes

    17 349+27Évolution des étoiles sur les 7 derniers jours
  • newspaper@codelucas

    newspaper3k est une bibliothèque Python 3 pour l'extraction d'actualités, de textes complets et de métadonnées d'articles.

    15 148+2Évolution des étoiles sur les 7 derniers jours
  • examples-of-web-crawlers@shengqiangzhang

    Exemples de crawlers Python intéressants et accessibles aux débutants, ciblant notamment Taobao, Tmall, WeChat, WeChat Reading, Douban et QQ.

    14 686+5Évolution des étoiles sur les 7 derniers jours
  • Photon@s0md3v

    Crawler extrêmement rapide conçu pour l'OSINT.

    13 160+4Évolution des étoiles sur les 7 derniers jours
  • crawlab@crawlab-team

    Plateforme d'administration de web crawler distribué pour la gestion de spiders, indépendante des langages et des frameworks

    12 268+4Évolution des étoiles sur les 7 derniers jours
  • webmagic@code4craft

    Un framework de crawler web évolutif pour Java.

    11 681+1Évolution des étoiles sur les 7 derniers jours
  • Python@injetlee

    Scripts Python pour la connexion simulée à Zhihu, le web scraping, l'automatisation Excel, les comptes officiels WeChat et le démarrage à distance.

    10 808+5Évolution des étoiles sur les 7 derniers jours
  • avbook@guyueyingmu

    Système de gestion de vidéos AV, scrapers pour avmoo, javbus et javlibrary, bibliothèque AV en ligne, base de données de liens magnétiques AV, bibliothèque de vidéos pour adultes japonaises.

    10 047+3Évolution des étoiles sur les 7 derniers jours
  • crawlee-python@apify

    Crawlee : une bibliothèque de web scraping et d'automatisation de navigateur pour Python permettant de créer des crawlers fiables. Extrayez des données pour l'IA, les LLM, le RAG ou les GPT. Téléchargez des fichiers HTML, PDF, JPG, PNG et autres depuis des sites web. Compatible avec Parsel, BeautifulSoup, Playwright et HTTP brut. Modes avec ou sans interface graphique, avec rotation de proxy.

    9 481+4Évolution des étoiles sur les 7 derniers jours
  • xiaobei@TeamWiseFlow

    Agent intelligent d'acquisition de clients via les médias sociaux, conçu pour les OPC et les PME

    8 489+14Évolution des étoiles sur les 7 derniers jours
  • awesome-web-scraping@lorien

    Liste de bibliothèques, outils et API pour le web scraping et le traitement de données.

    8 139+1Évolution des étoiles sur les 7 derniers jours
  • autoscraper@alirezamika

    Un scraper web intelligent, automatique, rapide et léger pour Python

    7 932+17Évolution des étoiles sur les 7 derniers jours
  • Une collection de web crawlers et spiders dans différents langages.

    7 303+5Évolution des étoiles sur les 7 derniers jours
  • API Python pour JMComic | Fournit une API Python pour accéder à JMComic, avec prise en charge des versions web et mobile | Téléchargeur GitHub Actions pour JMComic 🚀

    7 075+37Évolution des étoiles sur les 7 derniers jours
  • pydoll@autoscrape-labs

    Pydoll est une bibliothèque d'automatisation pour navigateurs basés sur Chromium sans WebDriver, offrant des interactions réalistes.

    7 060+7Évolution des étoiles sur les 7 derniers jours
  • node-crawler@bda-research

    Web crawler/spider pour NodeJS avec jQuery côté serveur

    6 796-2Évolution des étoiles sur les 7 derniers jours
  • trafilatura@adbar

    Outil Python et en ligne de commande pour collecter du texte et des métadonnées sur le Web : crawling, scraping, extraction, avec sortie en CSV, JSON, HTML, MD, TXT, XML.

    6 754+26Évolution des étoiles sur les 7 derniers jours
  • WechatSogou@chyroc

    Interface de crawler pour comptes publics WeChat basée sur la recherche Sogou WeChat.

    6 378+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets