Aller au contenu principal
buildradar
Sign in
Sujet · crawler

crawler

Dépôts open source suivis étiquetés crawler, triés par étoiles.

153 dépôts
  • sperm@darbra

    Compilation d'articles remarquables sur le reverse engineering, à consulter.

    1 410+0Évolution des étoiles sur les 7 derniers jours
  • mlscraper@lorey

    Scraping automatique de données à partir de sites web HTML en fournissant simplement des exemples.

    1 386+1Évolution des étoiles sur les 7 derniers jours
  • crawler@kgspider

    Partage de code de scraping, rétro-ingénierie JS et techniques avancées de scraping. Suivez le compte officiel : K哥爬虫.

    1 379+0Évolution des étoiles sur les 7 derniers jours
  • wombat@felipecsl

    Crawler/scraper web Ruby léger doté d'un DSL élégant pour extraire des données structurées à partir de pages web.

    1 360+0Évolution des étoiles sur les 7 derniers jours
  • XSRFProbe@0xInfection

    La boîte à outils de référence pour l'audit et l'exploitation des failles CSRF (Cross Site Request Forgery).

    1 303+1Évolution des étoiles sur les 7 derniers jours
  • go-dork@dwisiswant0

    Le scanner de dorks le plus rapide écrit en Go.

    1 302+0Évolution des étoiles sur les 7 derniers jours
  • Extraction rapide d'informations (abonnés, tags, etc.) d'un profil Instagram.

    1 302+1Évolution des étoiles sur les 7 derniers jours
  • boss-zhipin-scraper@eatmoreduck

    Scraper pour BOSS Zhipin : outil d'extraction de données d'emploi utilisant le protocole Chrome CDP pour réutiliser les sessions authentifiées, contourner les protections par police de caractères et exporter les salaires en JSON/CSV avec analyse des compétences.

    1 282+33Évolution des étoiles sur les 7 derniers jours
  • Beanbun@kiddyuchina

    Beanbun est un framework de web scraping multi-processus écrit en PHP, basé sur Workerman, offrant une grande ouverture et une haute extensibilité.

    1 258-1Évolution des étoiles sur les 7 derniers jours
  • Un téléchargeur de mangas Bilibili efficace avec interface graphique, recherche par mots-clés, connexion par QR code, téléchargement de chapitres verrouillés, multi-threading, formats multiples, gestion locale et mise à jour en un clic.

    1 243+1Évolution des étoiles sur les 7 derniers jours
  • AppCrawler@seveniruby

    Outil d'exploration automatique d'applications basé sur Appium.

    1 237+0Évolution des étoiles sur les 7 derniers jours
  • tumblr-crawler@dixudx

    Téléchargez facilement toutes les photos et vidéos des blogs Tumblr.

    1 157+0Évolution des étoiles sur les 7 derniers jours
  • newspaper4k@AndyTheFactory

    Newspaper4k, un fork du célèbre Newspaper3k. Extraction d'articles, de titres et de métadonnées depuis des sites d'actualités.

    1 141+1Évolution des étoiles sur les 7 derniers jours
  • fess@codelibs

    Serveur de recherche d'entreprise et de site open-source auto-hébergé basé sur OpenSearch. Indexe le web, les fichiers, les bases de données et les sources cloud, supporte plus de 20 langues, API REST, recherche sémantique et IA/RAG. Licence Apache-2.0.

    1 128+1Évolution des étoiles sur les 7 derniers jours
  • browsertrix-crawler@webrecorder

    Exécutez un crawler d'archivage web haute fidélité basé sur un navigateur dans un conteneur Docker unique.

    1 127+5Évolution des étoiles sur les 7 derniers jours
  • crawly@elixir-crawly

    Crawly, un framework de crawling et de scraping web de haut niveau pour Elixir.

    1 116+2Évolution des étoiles sur les 7 derniers jours
  • kimuraframework@vifreefly

    Créez des web scrapers en Ruby en utilisant un DSL propre assisté par IA. Kimurai utilise l'IA pour localiser les données, met en cache les sélecteurs et effectue le scraping en Ruby pur. Bénéficiez de l'intelligence d'un LLM sans la latence par requête ni les coûts de jetons.

    1 102+0Évolution des étoiles sur les 7 derniers jours
  • scrapfly-scrapers@scrapfly

    Scripts de web scraping Python évolutifs pour plus de 40 domaines populaires

    1 075+4Évolution des étoiles sur les 7 derniers jours
  • parse-video@wujunwei928

    Suppression de filigrane pour vidéos courtes en Golang : Douyin, Pipixia, Huoshan, Weishi, Zuiyou, Kuaishou, Quanmin, Pipigaoxiao, Xigua, Huya, Pear Video, AcFun, Haokan, etc.

    1 031+10Évolution des étoiles sur les 7 derniers jours
  • Téléchargement et scraping de romans, prise en charge de Qidian et Biquge, exportation vers Markdown ou txt, conversion en epub, filtrage publicitaire et correction automatique.

    1 016+8Évolution des étoiles sur les 7 derniers jours
  • wreq@0x676e67

    Un client HTTP Rust ergonomique et respectueux de la vie privée

    1 016+12Évolution des étoiles sur les 7 derniers jours
  • google-play-scraper@JoMingyu

    Scraper pour Google Play en Python inspiré par <facundoolano/google-play-scraper>.

    1 009+2Évolution des étoiles sur les 7 derniers jours
  • Pxer@pea3nut

    Un outil pour pixiv.net. Un crawler P站 accessible à tous.

    1 009-1Évolution des étoiles sur les 7 derniers jours
  • stormcrawler@apache

    Un crawler web évolutif, mature et polyvalent basé sur Apache Storm.

    994+1Évolution des étoiles sur les 7 derniers jours
  • SpiderSuite@spidersuite

    Releases, wiki et roadmap de SpiderSuite (crawler de sécurité web)

    974+1Évolution des étoiles sur les 7 derniers jours
  • crawler@fredwu

    Un crawler / scraper web haute performance en Elixir.

    956+0Évolution des étoiles sur les 7 derniers jours
  • crw@us

    Alternative rapide et légère de Firecrawl/Tavily en Rust. Web scraper, crawler & API de recherche avec serveur MCP pour agents IA. API compatible Firecrawl en drop-in (/scrape, /crawl, /search). 2,3 fois plus rapide que Tavily, 1,5 fois plus rapide que Firecrawl dans les benchmarks 1K-URL. 6 Mo de RAM, binaire unique. Héberger soi-même ou utiliser le cloud géré.

    955+87Évolution des étoiles sur les 7 derniers jours
  • x-kit@xiaoxiunique

    Outils de protocole en pur Python et notes de recherche pour X.com, incluant des jeux de données de comptes Twitter VibeLoft.

    940-1Évolution des étoiles sur les 7 derniers jours
  • icrawler@hellock

    Framework de crawler multi-thread avec de nombreux crawlers d'images intégrés.

    933+1Évolution des étoiles sur les 7 derniers jours
  • chatWeb@SkywalkerDarren

    ChatWeb peut explorer des pages web, lire des fichiers PDF, DOCX, TXT, en extraire le contenu principal, puis répondre à vos questions ou résumer les points clés.

    916+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets