Aller au contenu principal
buildradar
Se connecter
Sujet · scraping

scraping

Dépôts open source suivis étiquetés scraping, triés par étoiles.

100 dépôts
  • OF-Scraper@datawhores

    Un fork entièrement remanié et redessiné, réimaginé à partir de zéro sur la base du onlyfans-scraper original

    1 153+0Évolution des étoiles sur les 7 derniers jours
  • newspaper4k@AndyTheFactory

    Newspaper4k, un fork du célèbre Newspaper3k. Extraction d'articles, de titres et de métadonnées depuis des sites d'actualités.

    1 141+0Évolution des étoiles sur les 7 derniers jours
  • reverse-api-engineer@nottelabs

    L'agent qui transforme les sites web en API !

    1 121+2Évolution des étoiles sur les 7 derniers jours
  • crawly@elixir-crawly

    Crawly, un framework de crawling et de scraping web de haut niveau pour Elixir.

    1 116+0Évolution des étoiles sur les 7 derniers jours
  • auto-archiver@bellingcat

    Archivage automatique des liens vers des vidéos, images et contenus de réseaux sociaux depuis Google Sheets (et plus encore).

    1 113+1Évolution des étoiles sur les 7 derniers jours
  • socid-extractor@soxoj

    Le moteur d'extraction derrière Maigret : transforme n'importe quelle URL de profil en un enregistrement OSINT structuré sur plus de 150 sites.

    1 082+5Évolution des étoiles sur les 7 derniers jours
  • scrapfly-scrapers@scrapfly

    Scripts de web scraping Python évolutifs pour plus de 40 domaines populaires

    1 078+5Évolution des étoiles sur les 7 derniers jours
  • clean-text@jfilter

    🧹 Package Python pour le nettoyage de texte.

    1 028+0Évolution des étoiles sur les 7 derniers jours
  • hrequests@daijro

    Web scraping pour les humains

    1 022+0Évolution des étoiles sur les 7 derniers jours
  • Collectez des réponses structurées à partir d'un scraper ChatGPT en envoyant un prompt avec des identifiants d'API de scraping ChatGPT valides. Permet la recherche en direct, l'injection de contexte HTML et l'automatisation de workflows de scraping ChatGPT intelligents en quelques paramètres.

    942+153Évolution des étoiles sur les 7 derniers jours
  • loconotion@leoncvlt

    Outil Python pour transformer des pages Notion.so en sites web statiques légers et personnalisables.

    857+0Évolution des étoiles sur les 7 derniers jours
  • pdf.tocgen@Krasjet

    Ensemble d'outils en ligne de commande pour générer automatiquement une table des matières pour les fichiers PDF.

    848+0Évolution des étoiles sur les 7 derniers jours
  • easy-scraping-tutorial@MorvanZhou

    Code de tutoriel simple mais utile pour le web scraping en Python.

    820+0Évolution des étoiles sur les 7 derniers jours
  • trawl@germondai

    Moteur de scraping auto-hébergé — contourne tous les défis JS et captchas : Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Alternative à FlareSolverr & Byparr et remplacement direct pour votre suite *arr.

    793+26Évolution des étoiles sur les 7 derniers jours
  • linkedin-profile-scraper-api@josephlimtech

    Scraper de profils LinkedIn retournant des données structurées au format JSON

    776+0Évolution des étoiles sur les 7 derniers jours
  • lookyloo@Lookyloo

    Lookyloo est une interface web permettant de capturer une page web et d'afficher l'arborescence des domaines appelés

    774+1Évolution des étoiles sur les 7 derniers jours
  • dark-knowledge@prescience-data

    😈📚 Une bibliothèque organisée d'articles de recherche et de présentations pour les passionnés de contre-détection et de confidentialité sur le web.

    771+2Évolution des étoiles sur les 7 derniers jours
  • Package Python pip pour les résultats de recherche Google via SERP API

    755+2Évolution des étoiles sur les 7 derniers jours
  • rota@alpkeskin

    Un moteur de rotation de proxys haute performance avec gestion automatisée des adresses IP et surveillance de l'état en temps réel

    748+5Évolution des étoiles sur les 7 derniers jours
  • HomeHarvest@ZacharyHampton

    Package Python pour le scraping de données immobilières.

    739+2Évolution des étoiles sur les 7 derniers jours
  • comic-dl@Xonshiz

    Comic-dl est un outil en ligne de commande pour télécharger des mangas et des comics depuis divers sites de comics et de mangas. Sites pris en charge : readcomiconline.to, mangafox.me, comic naver et bien d'autres.

    676+2Évolution des étoiles sur les 7 derniers jours
  • :card_index: Extraire les profils des réseaux sociaux et plus encore avec des expressions régulières

    656+0Évolution des étoiles sur les 7 derniers jours
  • pricewise@adrianhajdin

    Plongez dans le web scraping et créez un traqueur de prix e-commerce avec Next.js 13 en une seule vidéo pour apprendre l'extraction de données, les tâches cron, l'envoi d'e-mails, le déploiement et plus encore.

    636+1Évolution des étoiles sur les 7 derniers jours
  • h5i@h5i-dev

    Collaboration en bac à sable pour équipes multi-agents : un forum de discussion basé sur Git, où chaque agent est isolé dans son propre environnement éphémère. Transformez un dépôt Git en un forum sécurisé pour agents IA.

    633+22Évolution des étoiles sur les 7 derniers jours
  • juriscraper@freelawproject

    Une API pour scraper les sites web des tribunaux américains afin de récupérer des métadonnées.

    631+3Évolution des étoiles sur les 7 derniers jours
  • Kemono-Downloader@Yuvi9587

    Kemono pawchive Downloader est une application PyQt5 rapide pour archiver du contenu provenant d'un large éventail de sites, notamment Kemono, Coomer, Bunkr, Erome, Saint2.su, nhentai et Discord. Elle comprend un navigateur de créateurs, un vérificateur de mises à jour et prend en charge les téléchargements multi-thread et multi-parties. Les sessions peuvent être mises en pause, reprises ou récupérées, avec prise en charge des filtres.

    630+10Évolution des étoiles sur les 7 derniers jours
  • docker-selenium-lambda@umihico

    La démo la plus simple d'automatisation Chrome par Python et Selenium dans AWS Lambda

    618+0Évolution des étoiles sur les 7 derniers jours
  • Ominis-OSINT@AnonCatalyst

    Cette application Python est un outil OSINT (Open Source Intelligence) nommé « Ominis OSINT - Web Hunter ». Elle effectue une collecte d'informations en ligne en interrogeant Google pour obtenir des résultats de recherche liés à une requête saisie par l'utilisateur. L'outil extrait les informations pertinentes telles que les titres, les URL et les mentions potentielles de la requête dans les résultats.

    614+2Évolution des étoiles sur les 7 derniers jours
  • LinkedInDumper@l4rm4nd

    Script Python 3 pour extraire et récupérer les employés d'entreprise depuis l'API LinkedIn

    611+0Évolution des étoiles sur les 7 derniers jours
  • reddit-universal-scraper@ksanjeev284

    Universal Reddit Scraper - Fonctionne sur n'importe quel Subreddit ou utilisateur

    597+4Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets