Aller au contenu principal
buildradar
Se connecter
Sujet · web-scraping

web-scraping

Dépôts open source suivis étiquetés web-scraping, triés par étoiles.

Dépôts
119
Total d'étoiles
843 479
Étoiles en moyenne
7 088
Part
0,04%

Sujets qui apparaissent souvent aux côtés de web-scraping sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés web-scraping.

  • moli@lexmount

    Le meilleur navigateur headless pour les agents IA. Léger, rapide, haute compatibilité. Construit en Rust.

    1 841
  • creatorhub@3441293738

    Surveillance, collecte et transfert de contenu multiplateforme via un panneau Web pour gérer Douyin, Xiaohongshu et Kuaishou.

    1 833
  • trawl@germondai

    Moteur de scraping auto-hébergé — contourne tous les défis JS et captchas : Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Alternative à FlareSolverr & Byparr et remplacement direct pour votre suite *arr.

    793
  • browser-search@Johell1NS

    A skill for AI agents: search the web with SearXNG, browse with Camofox, bypass protections with CloakBrowser. Anti-hallucination by design. Self-hosted, free, unlimited.

    515
  • oc@only-cli

    Turn any website into a compact CLI tailored for AI agents. Browse the web in hundreds of tokens, not tens of thousands.

    441
  • firecrawl@firecrawl

    L'API contextuelle pour rechercher, extraire et interagir avec le Web à grande échelle.

    175 781+0Évolution des étoiles sur les 7 derniers jours
  • Scrapling@D4Vinci

    🕷️ Un framework de web scraping adaptatif qui gère tout, d'une simple requête à un crawl à grande échelle !

    78 099+0Évolution des étoiles sur les 7 derniers jours
  • scrapy@scrapy

    Scrapy, un framework de crawling et de scraping web rapide et de haut niveau pour Python.

    64 179+0Évolution des étoiles sur les 7 derniers jours
  • ai-website-cloner-template@JCodesMore

    Clonez n'importe quel site web avec une seule commande en utilisant des agents de codage IA

    33 686+0Évolution des étoiles sur les 7 derniers jours
  • changedetection.io@dgtlmoon

    L'outil le plus simple et efficace pour la détection de changements, la surveillance de pages web et les alertes de modification de sites. Idéal pour suivre les changements de contenu, les baisses de prix, les alertes de réapprovisionnement et la surveillance de défiguration de sites, gratuitement ou via notre offre SaaS.

    33 494+0Évolution des étoiles sur les 7 derniers jours
  • CloakBrowser@CloakHQ

    Chromium furtif capable de réussir tous les tests de détection de bots. Remplacement direct de Playwright avec des correctifs d'empreinte numérique au niveau du code source. 30 tests sur 30 réussis.

    31 110+0Évolution des étoiles sur les 7 derniers jours
  • Scrapegraph-ai@ScrapeGraphAI

    Scraper Python basé sur l'IA.

    30 435+0Évolution des étoiles sur les 7 derniers jours
  • AIHawk@feder-cr

    Bot open source de candidature à des emplois en Python : automatisation de navigateur et web scraping pour lire les offres, puis candidature automatique avec un CV et une lettre de motivation personnalisés pour chaque poste.

    30 304+0Évolution des étoiles sur les 7 derniers jours
  • crawlee@apify

    Crawlee — Une bibliothèque de web scraping et d'automatisation de navigateur pour Node.js afin de créer des crawlers fiables. En JavaScript et TypeScript. Extrayez des données pour l'IA, les LLM, le RAG ou les GPT. Téléchargez des fichiers HTML, PDF, JPG, PNG et autres depuis des sites web. Fonctionne avec Puppeteer, Playwright, Cheerio, JSDOM et HTTP brut. Modes avec et sans interface graphique. Avec rotation de proxy.

    25 622+0Évolution des étoiles sur les 7 derniers jours
  • Douyin_TikTok_Download_API est un outil de scraping asynchrone haute performance prêt à l'emploi pour Douyin, Kuaishou, TikTok et Bilibili, prenant en charge les appels API, l'analyse par lots en ligne et le téléchargement.

    19 789+0Évolution des étoiles sur les 7 derniers jours
  • maxun@getmaxun

    La plateforme open-source no-code pour le web scraping, le crawling, la recherche et l'extraction de données par IA • Transformez des sites web en API structurées en quelques minutes

    17 349+0Évolution des étoiles sur les 7 derniers jours
  • SurfSense@MODSetter

    Alternative open-source à NotebookLM. Effectuez des recherches sur le Web avec des données en temps réel (Reddit, YT, IG, TikTok, Indeed, Google Search, Maps, etc.) via une plateforme unique, une API ou un serveur MCP.

    16 066+0Évolution des étoiles sur les 7 derniers jours
  • Skill_Seekers@yusufkaraaslan

    Convertissez des sites de documentation, des dépôts GitHub et des PDF en compétences pour Claude AI avec détection automatique des conflits.

    14 888+0Évolution des étoiles sur les 7 derniers jours
  • SeleniumBase@seleniumbase

    📊 API pour l'automatisation web, les tests et le contournement de la détection de bots.

    12 972+0Évolution des étoiles sur les 7 derniers jours
  • jsoup@jhy

    jsoup : le parseur HTML Java conçu pour l'édition, le nettoyage, le scraping et la sécurité XSS.

    11 385+0Évolution des étoiles sur les 7 derniers jours
  • pinchtab@pinchtab

    Pont d'automatisation de navigateur haute performance et orchestrateur multi-instances avec injection furtive avancée et tableau de bord en temps réel.

    10 219+0Évolution des étoiles sur les 7 derniers jours
  • crawlee-python@apify

    Crawlee : une bibliothèque de web scraping et d'automatisation de navigateur pour Python permettant de créer des crawlers fiables. Extrayez des données pour l'IA, les LLM, le RAG ou les GPT. Téléchargez des fichiers HTML, PDF, JPG, PNG et autres depuis des sites web. Compatible avec Parsel, BeautifulSoup, Playwright et HTTP brut. Modes avec ou sans interface graphique, avec rotation de proxy.

    9 481+0Évolution des étoiles sur les 7 derniers jours
  • camofox-browser@jo-inc

    Navigateur headless furtif pour agents IA — contourne Cloudflare, la détection de bots et l'anti-scraping. Remplacement direct pour Puppeteer/Playwright.

    9 039+0Évolution des étoiles sur les 7 derniers jours
  • helium@mherrmann

    Automatisation web légère avec Python.

    8 322+0Évolution des étoiles sur les 7 derniers jours
  • awesome-web-scraping@lorien

    Liste de bibliothèques, outils et API pour le web scraping et le traitement de données.

    8 139+0Évolution des étoiles sur les 7 derniers jours
  • autoscraper@alirezamika

    Un scraper web intelligent, automatique, rapide et léger pour Python

    7 932+0Évolution des étoiles sur les 7 derniers jours
  • API-mega-list@cporter202

    Ce dépôt GitHub est une collection puissante d'API que vous pouvez utiliser immédiatement pour créer tout type de projet, des automatisations simples aux applications à grande échelle. L'une des listes d'API les plus précieuses sur GitHub.

    7 585+0Évolution des étoiles sur les 7 derniers jours
  • firecrawl-mcp-server@firecrawl

    Serveur MCP officiel Firecrawl - Ajoute des capacités puissantes de web scraping et de recherche à Cursor, Claude et tout autre client LLM.

    7 381+0Évolution des étoiles sur les 7 derniers jours
  • rod@go-rod

    Un pilote du protocole Chrome DevTools pour l'automatisation et le scraping web.

    7 084+0Évolution des étoiles sur les 7 derniers jours
  • pydoll@autoscrape-labs

    Pydoll est une bibliothèque d'automatisation pour navigateurs basés sur Chromium sans WebDriver, offrant des interactions réalistes.

    7 060+0Évolution des étoiles sur les 7 derniers jours
  • trafilatura@adbar

    Outil Python et en ligne de commande pour collecter du texte et des métadonnées sur le Web : crawling, scraping, extraction, avec sortie en CSV, JSON, HTML, MD, TXT, XML.

    6 754+0Évolution des étoiles sur les 7 derniers jours
  • curl_cffi@lexiforest

    Binding Python pour le fork de curl-impersonate via cffi. Un client HTTP capable d'imiter les empreintes TLS/JA3/HTTP2 des navigateurs.

    6 432+0Évolution des étoiles sur les 7 derniers jours
  • ferret@MontFerret

    Langage déclaratif d'automatisation des données et runtime Go pour les flux d'extraction structurés

    6 009+0Évolution des étoiles sur les 7 derniers jours
  • Extraction de données depuis Google Maps. Récupère des informations telles que le nom, l'adresse, le numéro de téléphone, l'URL du site web, la note, le nombre d'avis, la latitude et la longitude, les avis, l'e-mail et plus encore pour chaque lieu.

    5 710+0Évolution des étoiles sur les 7 derniers jours
  • skills@browser-act

    CLI d'automatisation de navigateur conçue pour les agents IA. Contournez les protections anti-bot et transférez la main aux humains en cas de blocage. Exécution multitâche parallèle, fonctionnement multi-session indépendant et navigation multi-compte isolée.

    5 549+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets