Aller au contenu principal
buildradar
Sign in
Sujet · web-scraping

web-scraping

Dépôts open source suivis étiquetés web-scraping, triés par étoiles.

119 dépôts
  • finvizfinance@lit26

    Bibliothèque Python pour l'analyse Finviz

    1 624+0Évolution des étoiles sur les 7 derniers jours
  • DAT8@justmarkham

    Cours de science des données 2015 de General Assembly à Washington, DC

    1 620+0Évolution des étoiles sur les 7 derniers jours
  • Scweet@Altimis

    Scrapez des tweets, profils, abonnés et abonnements depuis Twitter/X, sans clé API nécessaire. Bibliothèque Python avec regroupement intelligent de comptes multiples, support de proxy et asynchrone.

    1 607+2Évolution des étoiles sur les 7 derniers jours
  • ai-map-py@oxylabs

    AI Map est un outil de cartographie de site web propulsé par l'IA d'Oxylabs AI Studio, utilisant des invites en langage naturel pour découvrir et extraire intelligemment des URL pertinentes depuis n'importe quel site web.

    1 598+41Évolution des étoiles sur les 7 derniers jours
  • single-file-cli@gildas-lormeau

    Outil CLI pour enregistrer une copie fidèle d'une page Web complète dans un seul fichier HTML (basé sur SingleFile)

    1 579+9Évolution des étoiles sur les 7 derniers jours
  • rvest@tidyverse

    Web scraping simple pour R.

    1 520+0Évolution des étoiles sur les 7 derniers jours
  • patchright-python@Kaliiiiiiiiii-Vinyzu

    Version Python indétectable de la bibliothèque de test et d'automatisation Playwright.

    1 492+5Évolution des étoiles sur les 7 derniers jours
  • fredy@orangecoding

    ❤️ Fredy - [F]ind [R]eal [E]state [D]amn Eas[y] - Fredy recherche en continu de nouveaux appartements et maisons en Europe sur des plateformes comme ImmoScout24, Immowelt, eBay Kleinanzeigen et vous transmet instantanément les résultats via Slack, Telegram, Email, Discord ou ntfy, pour que vous puissiez vous concentrer sur l'essentiel ;)

    1 462+11Évolution des étoiles sur les 7 derniers jours
  • core@roach-php

    La boîte à outils complète de web scraping pour PHP.

    1 455+0Évolution des étoiles sur les 7 derniers jours
  • agentql@tinyfish-io

    AgentQL est une suite d'outils pour connecter votre IA au web. Il propose un langage de requête et des intégrations Playwright pour interagir avec les éléments et extraire des données rapidement, précisément et à grande échelle. Inclut une API REST, des SDK Python et JavaScript, ainsi qu'un débogueur de navigateur.

    1 454+0Évolution des étoiles sur les 7 derniers jours
  • wreq-python@0x676e67

    Un client HTTP Python ergonomique et respectueux de la vie privée.

    1 438+1Évolution des étoiles sur les 7 derniers jours
  • rebrowser-patches@rebrowser

    Collection de correctifs pour puppeteer et playwright afin d'éviter la détection d'automatisation et les fuites. Aide à contourner les pages CAPTCHA de Cloudflare et DataDome. Facile à appliquer ou retirer, activable à la demande.

    1 422-1Évolution des étoiles sur les 7 derniers jours
  • Utilisez l'API Web Scraper pour extraire des données de Google Finance, y compris les titres d'actions, les prix et les variations en pourcentage.

    1 403+35Évolution des étoiles sur les 7 derniers jours
  • open-scouts@firecrawl

    Plateforme de surveillance web basée sur l'IA. Créez des agents automatisés qui parcourent le web et envoient des alertes par e-mail lorsqu'ils trouvent ce que vous recherchez.

    1 360+3Évolution des étoiles sur les 7 derniers jours
  • openserp@karust

    API SERP auto-hébergée pour l'IA, le SEO et l'automatisation. Recherche Google, Bing, Yandex, Baidu, DuckDuckGo et Ecosia rendue par navigateur avec extraction de page.

    1 335+16Évolution des étoiles sur les 7 derniers jours
  • WebAI2API@foxhui

    WebAI2API : outil de conversion d'IA web en API basé sur Camoufox, prenant en charge LMArena/Gemini, avec gestion de la concurrence multi-fenêtres et isolation des comptes.

    1 315+16Évolution des étoiles sur les 7 derniers jours
  • httpcloak@sardanioss

    Client HTTP Go avec empreinte TLS/HTTP2 identique à celle des navigateurs. Contourne la détection de bots en imitant parfaitement Chrome, Firefox et Safari au niveau cryptographique (JA3/JA4, empreinte Akamai, ordre des en-têtes). Prend en charge HTTP/1.1, HTTP/2, HTTP/3, les sessions, les cookies et les proxys.

    1 275+15Évolution des étoiles sur les 7 derniers jours
  • Decodo@Decodo

    Proxies résidentiels rotatifs HTTP(S)/SOCKS5 - exemples de code et informations générales.

    1 244+5Évolution des étoiles sur les 7 derniers jours
  • user-agents@intoli

    Une bibliothèque JavaScript pour générer des user agents aléatoires avec des données mises à jour quotidiennement.

    1 188-1Évolution des étoiles sur les 7 derniers jours
  • miasma@austin-weeks

    Piéger les scrapers web IA dans un puits sans fin de données corrompues.

    1 179+5Évolution des étoiles sur les 7 derniers jours
  • faster-than-requests@juancarlospaco

    Requêtes plus rapides sur Python 3.

    1 128-1Évolution des étoiles sur les 7 derniers jours
  • reverse-api-engineer@nottelabs

    L'agent qui transforme les sites web en API !

    1 121+17Évolution des étoiles sur les 7 derniers jours
  • kimuraframework@vifreefly

    Créez des web scrapers en Ruby en utilisant un DSL propre assisté par IA. Kimurai utilise l'IA pour localiser les données, met en cache les sélecteurs et effectue le scraping en Ruby pur. Bénéficiez de l'intelligence d'un LLM sans la latence par requête ni les coûts de jetons.

    1 102+0Évolution des étoiles sur les 7 derniers jours
  • scrapfly-scrapers@scrapfly

    Scripts de web scraping Python évolutifs pour plus de 40 domaines populaires

    1 078+6Évolution des étoiles sur les 7 derniers jours
  • awesome-agent-apis@Anil-matcha

    Une liste organisée de ressources, outils, compétences, tutoriels et articles sur OpenClaw. OpenClaw (anciennement Moltbot / Clawdbot) est un agent IA open-source auto-hébergé pour WhatsApp, Telegram, Discord et plus de 50 intégrations.

    1 005+8Évolution des étoiles sur les 7 derniers jours
  • ShardBrowser@ProxyShard

    Lanceur de navigateur anti-détection gratuit et open source pour le web scraping et la gestion multi-comptes. Par l'équipe ProxyShard. Falsification d'empreintes au niveau du moteur dans Chromium 148 (WebGL / WebGPU / Client Hints / polices / TLS), plus de 170 profils d'appareils intégrés, QUIC stable + WebRTC sur SOCKS5.

    1 002+176Évolution des étoiles sur les 7 derniers jours
  • crw@us

    Alternative rapide et légère de Firecrawl/Tavily en Rust. Web scraper, crawler & API de recherche avec serveur MCP pour agents IA. API compatible Firecrawl en drop-in (/scrape, /crawl, /search). 2,3 fois plus rapide que Tavily, 1,5 fois plus rapide que Firecrawl dans les benchmarks 1K-URL. 6 Mo de RAM, binaire unique. Héberger soi-même ou utiliser le cloud géré.

    965+94Évolution des étoiles sur les 7 derniers jours
  • x-reader@runesleo

    Serveur MCP de lecture de contenu universel pour plus de 10 plateformes

    961+4Évolution des étoiles sur les 7 derniers jours
  • Collectez des réponses structurées à partir d'un scraper ChatGPT en envoyant un prompt avec des identifiants d'API de scraping ChatGPT valides. Permet la recherche en direct, l'injection de contexte HTML et l'automatisation de workflows de scraping ChatGPT intelligents en quelques paramètres.

    942+181Évolution des étoiles sur les 7 derniers jours
  • Compétences d'agent officielles des produits Oxylabs

    871+104Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets