Saltar al contenido principal
buildradar
Tema · web-scraping

web-scraping

Repositorios de código abierto monitorizados etiquetados con web-scraping, ordenados por estrellas.

117 repositorios
  • wigolo@KnockOutEZ

    La web de referencia para tu agente de código de IA: búsqueda local, recuperación, rastreo e investigación mediante MCP. Sin claves de API, sin nube, $0 por consulta. Beta pública.

    4752+131Variación de estrellas de los últimos 7 días
  • patchright@Kaliiiiiiiiii-Vinyzu

    Versión indetectable de la librería de pruebas y automatización Playwright.

    4218+77Variación de estrellas de los últimos 7 días
  • snoop@snooppr

    Snoop — herramienta de inteligencia basada en datos abiertos (mundo OSINT)

    4011+1Variación de estrellas de los últimos 7 días
  • design-extract@Manavarya09

    Extrae el sistema de diseño completo de cualquier sitio web con un solo comando. Tokens DTCG, semántico+primitivo+compuesto, servidor MCP para Claude Code/Cursor/Windsurf, emisores multiplataforma (iOS SwiftUI, Android Compose, Flutter, WordPress), Tailwind v4, variables de Figma, shadcn/ui, auditoría de salud CSS, corrección WCAG, extensión de Chrome. MIT, Playwright, Node 20+.

    3974+622Variación de estrellas de los últimos 7 días
  • Recopilación de datos estructurados de cualquier sitio web mediante raspadores (scrapers), rastreadores (crawlers) y automatización de navegadores impulsados por IA. Raspado y rastreo con indicaciones en lenguaje natural. Equipa tus agentes de LLM con datos actualizados. SDK de Python de AI Studio para la recopilación inteligente de datos web.

    3381+86Variación de estrellas de los últimos 7 días
  • amazon-scraper@oxylabs

    API de raspado de Amazon de prueba gratuita para extraer datos de búsqueda, productos, ofertas, reseñas, preguntas y respuestas, más vendidos y vendedores.

    3355+49Variación de estrellas de los últimos 7 días
  • php-curl-class@php-curl-class

    PHP Curl Class facilita el envío de solicitudes HTTP y la integración con APIs web

    3297+0Variación de estrellas de los últimos 7 días
  • El proceso de extracción de datos de productos de Amazon usando Python, incluyendo títulos, calificaciones, precios, imágenes y descripciones.

    3234+63Variación de estrellas de los últimos 7 días
  • VirtualBrowser@Virtual-Browser

    Navegador anti-huellas gratuito, navegador de huellas dactilares, navegador de privacidad, navegador anti-reconocimiento, navegador anti-asociación, navegador anti-huellas dedicado a airdrops de web3 gratuito https://virtualbrowser.cc/?src=github

    3080+13Variación de estrellas de los últimos 7 días
  • pythoncode-tutorials@x4nth055

    Los tutoriales de código en Python

    3001+2Variación de estrellas de los últimos 7 días
  • Aprende paso a paso cómo extraer datos de Google Trends y realizar una comparación de resultados usando Python y la API SERP de Oxylabs. Extrae palabras clave, su popularidad, desglose por región, consultas relacionadas y más.

    2874+38Variación de estrellas de los últimos 7 días
  • twscrape@vladkens

    Biblioteca de Python y CLI para scraping de X/Twitter con rotación de múltiples cuentas y manejo integrado de límites de velocidad.

    2718+21Variación de estrellas de los últimos 7 días
  • spider@spider-rs

    Obtén datos web para agentes de IA y LLMs

    2681+14Variación de estrellas de los últimos 7 días
  • brightdata-mcp@brightdata

    Un potente servidor Model Context Protocol (MCP) que ofrece una solución integral para el acceso web público.

    2614+10Variación de estrellas de los últimos 7 días
  • 30-Days-of-Python@codingforentrepreneurs

    Aprende Python durante los próximos 30 días (más o menos).

    2507+3Variación de estrellas de los últimos 7 días
  • grab@lorien

    Framework de Web Scraping

    2463+0Variación de estrellas de los últimos 7 días
  • anakin@Anakin-Inc

    API de web scraping de código abierto. Convierte cualquier sitio web en markdown limpio o JSON estructurado. Navegador antidetección, selección automática de proxy, autoalojado. Un comando: make up

    2453+178Variación de estrellas de los últimos 7 días
  • webclaw@0xMassi

    Extracción rápida de contenido web local-first para LLM. Web scraping, rastreo y extracción de datos estructurados, todo desde Rust. CLI, API REST y servidor MCP.

    2313+15Variación de estrellas de los últimos 7 días
  • HeadlessX@saifyxpro

    Plataforma de automatización de navegador autoalojada e indetectable. Impulsada por Camoufox (Firefox) para tasas de detección del 0%. Diseñada para velocidad, privacidad y escalabilidad.

    2273+18Variación de estrellas de los últimos 7 días
  • Un código para extraer los productos más vendidos, resultados de búsqueda y ofertas disponibles actualmente de Amazon utilizando Python y la API Oxylabs E-Commerce Scraper.

    2068+51Variación de estrellas de los últimos 7 días
  • Guía para extraer títulos, autores y citas de Google Scholar utilizando Python y la API de Oxylabs SERP Scraper.

    2017+76Variación de estrellas de los últimos 7 días
  • RPA@A9T9

    Software RPA de código abierto Ui.Vision con Computer Vision, OCR, Anthropic Computer Use/LLM. Importación/exportación de Selenium IDE.

    1992+12Variación de estrellas de los últimos 7 días
  • Navegador antidetect sigiloso gratuito para Playwright: huella digital de Firefox sin cabeza indetectable. Scraping con Python, bypass de recaptcha y detección de bots. Código abierto.

    1952+28Variación de estrellas de los últimos 7 días
  • stealth-browser-mcp@vibheksoni

    La única automatización de navegador que evita los sistemas anti-bot. La IA escribe hooks de red y clona interfaces de usuario píxel por píxel mediante un chat simple.

    1882+277Variación de estrellas de los últimos 7 días
  • browserless@microlinkhq

    Driver de Chrome/Chromium headless basado en Puppeteer. Permite capturar pantallas, generar PDFs y extraer texto y HTML con una API lista para producción.

    1832+2Variación de estrellas de los últimos 7 días
  • creatorhub@3441293738

    Monitorización, recopilación y transferencia de contenido multiplataforma. Un panel web para gestionar Douyin, Xiaohongshu y Kuaishou.

    1781+568Variación de estrellas de los últimos 7 días
  • Aprende a crear tu propio scraper de Google Jobs que extrae datos simultáneamente para múltiples consultas y ubicaciones geográficas usando Python y la API de Google Jobs Scraper de Oxylabs. https://oxylabs.io/blog/how-to-scrape-google-jobs

    1741+45Variación de estrellas de los últimos 7 días
  • selectolax@rushter

    Enlace de Python para los motores Modest y Lexbor. Un analizador HTML5 rápido con selectores CSS para Python.

    1667+1Variación de estrellas de los últimos 7 días
  • En este tutorial, mostramos cómo extraer datos públicos de Google con Python y la API de Oxylabs.

    1662+45Variación de estrellas de los últimos 7 días
  • finvizfinance@lit26

    Librería de Python para análisis de Finviz.

    1624+5Variación de estrellas de los últimos 7 días
← Volver a temas