scraping
Dépôts open source suivis étiquetés scraping, triés par étoiles.
- #61
Un fork entièrement remanié et redessiné, réimaginé à partir de zéro sur la base du onlyfans-scraper original
★ 1 153+0Évolution des étoiles sur les 7 derniers jours - #62
Newspaper4k, un fork du célèbre Newspaper3k. Extraction d'articles, de titres et de métadonnées depuis des sites d'actualités.
★ 1 141+0Évolution des étoiles sur les 7 derniers jours - #63
L'agent qui transforme les sites web en API !
★ 1 121+2Évolution des étoiles sur les 7 derniers jours - #64
Crawly, un framework de crawling et de scraping web de haut niveau pour Elixir.
★ 1 116+0Évolution des étoiles sur les 7 derniers jours - #65
Archivage automatique des liens vers des vidéos, images et contenus de réseaux sociaux depuis Google Sheets (et plus encore).
★ 1 113+1Évolution des étoiles sur les 7 derniers jours - #66
Le moteur d'extraction derrière Maigret : transforme n'importe quelle URL de profil en un enregistrement OSINT structuré sur plus de 150 sites.
★ 1 082+5Évolution des étoiles sur les 7 derniers jours - #67
Scripts de web scraping Python évolutifs pour plus de 40 domaines populaires
★ 1 078+5Évolution des étoiles sur les 7 derniers jours - #68
🧹 Package Python pour le nettoyage de texte.
★ 1 028+0Évolution des étoiles sur les 7 derniers jours - #69★ 1 022+0Évolution des étoiles sur les 7 derniers jours
- #70
Collectez des réponses structurées à partir d'un scraper ChatGPT en envoyant un prompt avec des identifiants d'API de scraping ChatGPT valides. Permet la recherche en direct, l'injection de contexte HTML et l'automatisation de workflows de scraping ChatGPT intelligents en quelques paramètres.
★ 942+153Évolution des étoiles sur les 7 derniers jours - #71
Outil Python pour transformer des pages Notion.so en sites web statiques légers et personnalisables.
★ 857+0Évolution des étoiles sur les 7 derniers jours - #72
Ensemble d'outils en ligne de commande pour générer automatiquement une table des matières pour les fichiers PDF.
★ 848+0Évolution des étoiles sur les 7 derniers jours - #73
Code de tutoriel simple mais utile pour le web scraping en Python.
★ 820+0Évolution des étoiles sur les 7 derniers jours - #74
Moteur de scraping auto-hébergé — contourne tous les défis JS et captchas : Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Alternative à FlareSolverr & Byparr et remplacement direct pour votre suite *arr.
★ 793+26Évolution des étoiles sur les 7 derniers jours - #75
Scraper de profils LinkedIn retournant des données structurées au format JSON
★ 776+0Évolution des étoiles sur les 7 derniers jours - #76
Lookyloo est une interface web permettant de capturer une page web et d'afficher l'arborescence des domaines appelés
★ 774+1Évolution des étoiles sur les 7 derniers jours - #77
😈📚 Une bibliothèque organisée d'articles de recherche et de présentations pour les passionnés de contre-détection et de confidentialité sur le web.
★ 771+2Évolution des étoiles sur les 7 derniers jours - #78
Package Python pip pour les résultats de recherche Google via SERP API
★ 755+2Évolution des étoiles sur les 7 derniers jours - #79
Un moteur de rotation de proxys haute performance avec gestion automatisée des adresses IP et surveillance de l'état en temps réel
★ 748+5Évolution des étoiles sur les 7 derniers jours - #80
Package Python pour le scraping de données immobilières.
★ 739+2Évolution des étoiles sur les 7 derniers jours - #81
Comic-dl est un outil en ligne de commande pour télécharger des mangas et des comics depuis divers sites de comics et de mangas. Sites pris en charge : readcomiconline.to, mangafox.me, comic naver et bien d'autres.
★ 676+2Évolution des étoiles sur les 7 derniers jours - #82
:card_index: Extraire les profils des réseaux sociaux et plus encore avec des expressions régulières
★ 656+0Évolution des étoiles sur les 7 derniers jours - #83
Plongez dans le web scraping et créez un traqueur de prix e-commerce avec Next.js 13 en une seule vidéo pour apprendre l'extraction de données, les tâches cron, l'envoi d'e-mails, le déploiement et plus encore.
★ 636+1Évolution des étoiles sur les 7 derniers jours - #84
Collaboration en bac à sable pour équipes multi-agents : un forum de discussion basé sur Git, où chaque agent est isolé dans son propre environnement éphémère. Transformez un dépôt Git en un forum sécurisé pour agents IA.
★ 633+22Évolution des étoiles sur les 7 derniers jours - #85
Une API pour scraper les sites web des tribunaux américains afin de récupérer des métadonnées.
★ 631+3Évolution des étoiles sur les 7 derniers jours - #86
Kemono pawchive Downloader est une application PyQt5 rapide pour archiver du contenu provenant d'un large éventail de sites, notamment Kemono, Coomer, Bunkr, Erome, Saint2.su, nhentai et Discord. Elle comprend un navigateur de créateurs, un vérificateur de mises à jour et prend en charge les téléchargements multi-thread et multi-parties. Les sessions peuvent être mises en pause, reprises ou récupérées, avec prise en charge des filtres.
★ 630+10Évolution des étoiles sur les 7 derniers jours - #87
La démo la plus simple d'automatisation Chrome par Python et Selenium dans AWS Lambda
★ 618+0Évolution des étoiles sur les 7 derniers jours - #88
Cette application Python est un outil OSINT (Open Source Intelligence) nommé « Ominis OSINT - Web Hunter ». Elle effectue une collecte d'informations en ligne en interrogeant Google pour obtenir des résultats de recherche liés à une requête saisie par l'utilisateur. L'outil extrait les informations pertinentes telles que les titres, les URL et les mentions potentielles de la requête dans les résultats.
★ 614+2Évolution des étoiles sur les 7 derniers jours - #89
Script Python 3 pour extraire et récupérer les employés d'entreprise depuis l'API LinkedIn
★ 611+0Évolution des étoiles sur les 7 derniers jours - #90
Universal Reddit Scraper - Fonctionne sur n'importe quel Subreddit ou utilisateur
★ 597+4Évolution des étoiles sur les 7 derniers jours