Aller au contenu principal
buildradar
Sign in
Sujet · scraper

scraper

Dépôts open source suivis étiquetés scraper, triés par étoiles.

114 dépôts
  • newspaper4k@AndyTheFactory

    Newspaper4k, un fork du célèbre Newspaper3k. Extraction d'articles, de titres et de métadonnées depuis des sites d'actualités.

    1 141+1Évolution des étoiles sur les 7 derniers jours
  • crawly@elixir-crawly

    Crawly, un framework de crawling et de scraping web de haut niveau pour Elixir.

    1 116+2Évolution des étoiles sur les 7 derniers jours
  • kimuraframework@vifreefly

    Créez des web scrapers en Ruby en utilisant un DSL propre assisté par IA. Kimurai utilise l'IA pour localiser les données, met en cache les sélecteurs et effectue le scraping en Ruby pur. Bénéficiez de l'intelligence d'un LLM sans la latence par requête ni les coûts de jetons.

    1 102+0Évolution des étoiles sur les 7 derniers jours
  • scrapfly-scrapers@scrapfly

    Scripts de web scraping Python évolutifs pour plus de 40 domaines populaires

    1 077+5Évolution des étoiles sur les 7 derniers jours
  • jikan@jikan-me

    API PHP+REST non officielle pour MyAnimeList offrant des fonctionnalités absentes de l'API officielle

    1 073+6Évolution des étoiles sur les 7 derniers jours
  • URS@JosephLai241

    Universal Reddit Scraper - Un outil en ligne de commande complet pour le scraping et l'archivage de Reddit.

    1 022+1Évolution des étoiles sur les 7 derniers jours
  • GreenResourcesManager@klsdf

    Un gestionnaire complet pour organiser les ressources informatiques avec des éléments de gamification

    1 020+9Évolution des étoiles sur les 7 derniers jours
  • wreq@0x676e67

    Un client HTTP Rust ergonomique et respectueux de la vie privée

    1 018+13Évolution des étoiles sur les 7 derniers jours
  • google-play-scraper@JoMingyu

    Scraper pour Google Play en Python inspiré par <facundoolano/google-play-scraper>.

    1 010+3Évolution des étoiles sur les 7 derniers jours
  • Le tout premier outil pour consulter anonymement des publications Instagram privées

    995+14Évolution des étoiles sur les 7 derniers jours
  • crawler@fredwu

    Un crawler / scraper web haute performance en Elixir.

    956+0Évolution des étoiles sur les 7 derniers jours
  • x-tweet-fetcher@ythx-101

    Récupérer des tweets, réponses, timelines et articles X/Twitter sans connexion ni clés API — outil de terrain pour agents IA.

    955+7Évolution des étoiles sur les 7 derniers jours
  • scrapyrt@scrapinghub

    API HTTP pour les spiders Scrapy

    884+2Évolution des étoiles sur les 7 derniers jours
  • skrape.it@skrapeit

    Bibliothèque de test, de scraping et d'analyse basée sur Kotlin, permettant d'extraire des données de pages HTML (rendues côté serveur ou client). Elle met l'accent sur la facilité d'utilisation et la lisibilité grâce à un DSL intuitif. Conçue comme bibliothèque de test, elle peut également servir au scraping de sites web.

    875+0Évolution des étoiles sur les 7 derniers jours
  • xidel@benibela

    Outil en ligne de commande pour télécharger et extraire des données de pages HTML/XML ou d'API JSON, en utilisant CSS, XPath 3.0, XQuery 3.0, JSONiq ou la correspondance de motifs. Il peut également créer ou transformer des documents XML/HTML/JSON.

    844+1Évolution des étoiles sur les 7 derniers jours
  • zimit@openzim

    Créez un fichier ZIM à partir de n'importe quel site web et naviguez hors ligne !

    842+5Évolution des étoiles sur les 7 derniers jours
  • HDoujinDownloader@HDoujinDownloader

    Un téléchargeur polyvalent de galeries d'images et de doujinshi.

    841+0Évolution des étoiles sur les 7 derniers jours
  • epublifier@maoserr

    Convertit certains webnovels au format epub.

    840+2Évolution des étoiles sur les 7 derniers jours
  • spidr@postmodern

    Une bibliothèque de web crawling polyvalente en Ruby capable d'explorer un site, plusieurs domaines, des liens spécifiques ou à l'infini. Spidr est conçu pour être rapide et facile à utiliser.

    836+0Évolution des étoiles sur les 7 derniers jours
  • jvppeteer@fanyong920

    API Java pour Chrome et Firefox

    805+0Évolution des étoiles sur les 7 derniers jours
  • opensanctions@opensanctions

    Une base de données ouverte de données sur les sanctions internationales, les personnes d'intérêt et les personnes politiquement exposées

    797+6Évolution des étoiles sur les 7 derniers jours
  • trawl@germondai

    Moteur de scraping auto-hébergé — contourne tous les défis JS et captchas : Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Alternative à FlareSolverr & Byparr et remplacement direct pour votre suite *arr.

    786+46Évolution des étoiles sur les 7 derniers jours
  • linkedin-profile-scraper-api@josephlimtech

    Scraper de profils LinkedIn retournant des données structurées au format JSON

    776+0Évolution des étoiles sur les 7 derniers jours
  • operative framework est un framework OSINT d'investigation écrit en Rust, permettant d'interagir avec plusieurs cibles, d'exécuter divers modules, de créer des liens avec des cibles, d'exporter des rapports en PDF, d'ajouter des notes, d'interagir avec une API RESTful et de créer ses propres modules.

    749-1Évolution des étoiles sur les 7 derniers jours
  • Discount-Bandit@Cybrarist

    Suivi de prix multi-utilisateurs auto-hébergé pour Amazon, Aliexpress, eBay et bien d'autres, incluant des boutiques personnalisées. Recevez des notifications lorsque le prix correspond à un ou plusieurs critères définis par l'utilisateur.

    740+3Évolution des étoiles sur les 7 derniers jours
  • HomeHarvest@ZacharyHampton

    Package Python pour le scraping de données immobilières.

    739+3Évolution des étoiles sur les 7 derniers jours
  • slash@theahmadov

    L'outil OSINT Slash

    738+1Évolution des étoiles sur les 7 derniers jours
  • scala-scraper@ruippeixotog

    Une bibliothèque Scala pour extraire du contenu à partir de pages HTML

    732+0Évolution des étoiles sur les 7 derniers jours
  • scrapers@cassidoo

    Une liste de scrapers collectés sur le Web.

    730+0Évolution des étoiles sur les 7 derniers jours
  • Documentation de l'API interne de Twitter

    711+2Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets