scraper
Dépôts open source suivis étiquetés scraper, triés par étoiles.
- #61
Newspaper4k, un fork du célèbre Newspaper3k. Extraction d'articles, de titres et de métadonnées depuis des sites d'actualités.
★ 1 141+1Évolution des étoiles sur les 7 derniers jours - #62
Crawly, un framework de crawling et de scraping web de haut niveau pour Elixir.
★ 1 116+2Évolution des étoiles sur les 7 derniers jours - #63
Créez des web scrapers en Ruby en utilisant un DSL propre assisté par IA. Kimurai utilise l'IA pour localiser les données, met en cache les sélecteurs et effectue le scraping en Ruby pur. Bénéficiez de l'intelligence d'un LLM sans la latence par requête ni les coûts de jetons.
★ 1 102+0Évolution des étoiles sur les 7 derniers jours - #64
Scripts de web scraping Python évolutifs pour plus de 40 domaines populaires
★ 1 077+5Évolution des étoiles sur les 7 derniers jours - #65
API PHP+REST non officielle pour MyAnimeList offrant des fonctionnalités absentes de l'API officielle
★ 1 073+6Évolution des étoiles sur les 7 derniers jours - #66
Universal Reddit Scraper - Un outil en ligne de commande complet pour le scraping et l'archivage de Reddit.
★ 1 022+1Évolution des étoiles sur les 7 derniers jours - #67
Un gestionnaire complet pour organiser les ressources informatiques avec des éléments de gamification
★ 1 020+9Évolution des étoiles sur les 7 derniers jours - #68★ 1 018+13Évolution des étoiles sur les 7 derniers jours
- #69
Scraper pour Google Play en Python inspiré par <facundoolano/google-play-scraper>.
★ 1 010+3Évolution des étoiles sur les 7 derniers jours - #70
Le tout premier outil pour consulter anonymement des publications Instagram privées
★ 995+14Évolution des étoiles sur les 7 derniers jours - #71★ 956+0Évolution des étoiles sur les 7 derniers jours
- #72
Récupérer des tweets, réponses, timelines et articles X/Twitter sans connexion ni clés API — outil de terrain pour agents IA.
★ 955+7Évolution des étoiles sur les 7 derniers jours - #73★ 884+2Évolution des étoiles sur les 7 derniers jours
- #74
Bibliothèque de test, de scraping et d'analyse basée sur Kotlin, permettant d'extraire des données de pages HTML (rendues côté serveur ou client). Elle met l'accent sur la facilité d'utilisation et la lisibilité grâce à un DSL intuitif. Conçue comme bibliothèque de test, elle peut également servir au scraping de sites web.
★ 875+0Évolution des étoiles sur les 7 derniers jours - #75
Outil en ligne de commande pour télécharger et extraire des données de pages HTML/XML ou d'API JSON, en utilisant CSS, XPath 3.0, XQuery 3.0, JSONiq ou la correspondance de motifs. Il peut également créer ou transformer des documents XML/HTML/JSON.
★ 844+1Évolution des étoiles sur les 7 derniers jours - #76★ 842+5Évolution des étoiles sur les 7 derniers jours
- #77
Un téléchargeur polyvalent de galeries d'images et de doujinshi.
★ 841+0Évolution des étoiles sur les 7 derniers jours - #78
Convertit certains webnovels au format epub.
★ 840+2Évolution des étoiles sur les 7 derniers jours - #79
Une bibliothèque de web crawling polyvalente en Ruby capable d'explorer un site, plusieurs domaines, des liens spécifiques ou à l'infini. Spidr est conçu pour être rapide et facile à utiliser.
★ 836+0Évolution des étoiles sur les 7 derniers jours - #80★ 805+0Évolution des étoiles sur les 7 derniers jours
- #81
Une base de données ouverte de données sur les sanctions internationales, les personnes d'intérêt et les personnes politiquement exposées
★ 797+6Évolution des étoiles sur les 7 derniers jours - #82
Moteur de scraping auto-hébergé — contourne tous les défis JS et captchas : Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Alternative à FlareSolverr & Byparr et remplacement direct pour votre suite *arr.
★ 786+46Évolution des étoiles sur les 7 derniers jours - #83
Scraper de profils LinkedIn retournant des données structurées au format JSON
★ 776+0Évolution des étoiles sur les 7 derniers jours - #84
operative framework est un framework OSINT d'investigation écrit en Rust, permettant d'interagir avec plusieurs cibles, d'exécuter divers modules, de créer des liens avec des cibles, d'exporter des rapports en PDF, d'ajouter des notes, d'interagir avec une API RESTful et de créer ses propres modules.
★ 749-1Évolution des étoiles sur les 7 derniers jours - #85
Suivi de prix multi-utilisateurs auto-hébergé pour Amazon, Aliexpress, eBay et bien d'autres, incluant des boutiques personnalisées. Recevez des notifications lorsque le prix correspond à un ou plusieurs critères définis par l'utilisateur.
★ 740+3Évolution des étoiles sur les 7 derniers jours - #86
Package Python pour le scraping de données immobilières.
★ 739+3Évolution des étoiles sur les 7 derniers jours - #87★ 738+1Évolution des étoiles sur les 7 derniers jours
- #88
Une bibliothèque Scala pour extraire du contenu à partir de pages HTML
★ 732+0Évolution des étoiles sur les 7 derniers jours - #89★ 730+0Évolution des étoiles sur les 7 derniers jours
- #90
Documentation de l'API interne de Twitter
★ 711+2Évolution des étoiles sur les 7 derniers jours