crawler
Dépôts open source suivis étiquetés crawler, triés par étoiles.
- #91★ 1 410+0Évolution des étoiles sur les 7 derniers jours
- #92
Scraping automatique de données à partir de sites web HTML en fournissant simplement des exemples.
★ 1 386+1Évolution des étoiles sur les 7 derniers jours - #93
Partage de code de scraping, rétro-ingénierie JS et techniques avancées de scraping. Suivez le compte officiel : K哥爬虫.
★ 1 379+0Évolution des étoiles sur les 7 derniers jours - #94
Crawler/scraper web Ruby léger doté d'un DSL élégant pour extraire des données structurées à partir de pages web.
★ 1 360+0Évolution des étoiles sur les 7 derniers jours - #95
La boîte à outils de référence pour l'audit et l'exploitation des failles CSRF (Cross Site Request Forgery).
★ 1 303+1Évolution des étoiles sur les 7 derniers jours - #96★ 1 302+0Évolution des étoiles sur les 7 derniers jours
- #97
Extraction rapide d'informations (abonnés, tags, etc.) d'un profil Instagram.
★ 1 302+1Évolution des étoiles sur les 7 derniers jours - #98
Scraper pour BOSS Zhipin : outil d'extraction de données d'emploi utilisant le protocole Chrome CDP pour réutiliser les sessions authentifiées, contourner les protections par police de caractères et exporter les salaires en JSON/CSV avec analyse des compétences.
★ 1 282+33Évolution des étoiles sur les 7 derniers jours - #99
Beanbun est un framework de web scraping multi-processus écrit en PHP, basé sur Workerman, offrant une grande ouverture et une haute extensibilité.
★ 1 258-1Évolution des étoiles sur les 7 derniers jours - #100
Un téléchargeur de mangas Bilibili efficace avec interface graphique, recherche par mots-clés, connexion par QR code, téléchargement de chapitres verrouillés, multi-threading, formats multiples, gestion locale et mise à jour en un clic.
★ 1 243+1Évolution des étoiles sur les 7 derniers jours - #101
Outil d'exploration automatique d'applications basé sur Appium.
★ 1 237+0Évolution des étoiles sur les 7 derniers jours - #102
Téléchargez facilement toutes les photos et vidéos des blogs Tumblr.
★ 1 157+0Évolution des étoiles sur les 7 derniers jours - #103
Newspaper4k, un fork du célèbre Newspaper3k. Extraction d'articles, de titres et de métadonnées depuis des sites d'actualités.
★ 1 141+1Évolution des étoiles sur les 7 derniers jours - #104
Serveur de recherche d'entreprise et de site open-source auto-hébergé basé sur OpenSearch. Indexe le web, les fichiers, les bases de données et les sources cloud, supporte plus de 20 langues, API REST, recherche sémantique et IA/RAG. Licence Apache-2.0.
★ 1 128+1Évolution des étoiles sur les 7 derniers jours - #105
Exécutez un crawler d'archivage web haute fidélité basé sur un navigateur dans un conteneur Docker unique.
★ 1 127+5Évolution des étoiles sur les 7 derniers jours - #106
Crawly, un framework de crawling et de scraping web de haut niveau pour Elixir.
★ 1 116+2Évolution des étoiles sur les 7 derniers jours - #107
Créez des web scrapers en Ruby en utilisant un DSL propre assisté par IA. Kimurai utilise l'IA pour localiser les données, met en cache les sélecteurs et effectue le scraping en Ruby pur. Bénéficiez de l'intelligence d'un LLM sans la latence par requête ni les coûts de jetons.
★ 1 102+0Évolution des étoiles sur les 7 derniers jours - #108
Scripts de web scraping Python évolutifs pour plus de 40 domaines populaires
★ 1 075+4Évolution des étoiles sur les 7 derniers jours - #109
Suppression de filigrane pour vidéos courtes en Golang : Douyin, Pipixia, Huoshan, Weishi, Zuiyou, Kuaishou, Quanmin, Pipigaoxiao, Xigua, Huya, Pear Video, AcFun, Haokan, etc.
★ 1 031+10Évolution des étoiles sur les 7 derniers jours - #110
Téléchargement et scraping de romans, prise en charge de Qidian et Biquge, exportation vers Markdown ou txt, conversion en epub, filtrage publicitaire et correction automatique.
★ 1 016+8Évolution des étoiles sur les 7 derniers jours - #111★ 1 016+12Évolution des étoiles sur les 7 derniers jours
- #112
Scraper pour Google Play en Python inspiré par <facundoolano/google-play-scraper>.
★ 1 009+2Évolution des étoiles sur les 7 derniers jours - #113★ 1 009-1Évolution des étoiles sur les 7 derniers jours
- #114
Un crawler web évolutif, mature et polyvalent basé sur Apache Storm.
★ 994+1Évolution des étoiles sur les 7 derniers jours - #115
Releases, wiki et roadmap de SpiderSuite (crawler de sécurité web)
★ 974+1Évolution des étoiles sur les 7 derniers jours - #116★ 956+0Évolution des étoiles sur les 7 derniers jours
- #117
Alternative rapide et légère de Firecrawl/Tavily en Rust. Web scraper, crawler & API de recherche avec serveur MCP pour agents IA. API compatible Firecrawl en drop-in (/scrape, /crawl, /search). 2,3 fois plus rapide que Tavily, 1,5 fois plus rapide que Firecrawl dans les benchmarks 1K-URL. 6 Mo de RAM, binaire unique. Héberger soi-même ou utiliser le cloud géré.
★ 955+87Évolution des étoiles sur les 7 derniers jours - #118
Outils de protocole en pur Python et notes de recherche pour X.com, incluant des jeux de données de comptes Twitter VibeLoft.
★ 940-1Évolution des étoiles sur les 7 derniers jours - #119★ 933+1Évolution des étoiles sur les 7 derniers jours
- #120
ChatWeb peut explorer des pages web, lire des fichiers PDF, DOCX, TXT, en extraire le contenu principal, puis répondre à vos questions ou résumer les points clés.
★ 916+0Évolution des étoiles sur les 7 derniers jours