Saltar al contenido principal
buildradar
Iniciar sesión
Tema · scraping

scraping

Repositorios de código abierto monitorizados etiquetados con scraping, ordenados por estrellas.

100 repositorios
  • OF-Scraper@datawhores

    Un fork completamente renovado y rediseñado, reimaginado desde cero basado en el onlyfans-scraper original

    1153+0Variación de estrellas de los últimos 7 días
  • newspaper4k@AndyTheFactory

    Newspaper4k, un fork del popular Newspaper3k para la extracción de artículos, títulos y metadatos de sitios web de noticias.

    1141+0Variación de estrellas de los últimos 7 días
  • reverse-api-engineer@nottelabs

    ¡El agente que convierte sitios web en APIs!

    1121+2Variación de estrellas de los últimos 7 días
  • crawly@elixir-crawly

    Crawly, un framework de alto nivel para web crawling y scraping en Elixir.

    1116+0Variación de estrellas de los últimos 7 días
  • auto-archiver@bellingcat

    Archiva automáticamente enlaces a videos, imágenes y contenido de redes sociales desde Google Sheets (y más).

    1113+1Variación de estrellas de los últimos 7 días
  • socid-extractor@soxoj

    ⛏️ El motor de extracción detrás de Maigret: convierte cualquier URL de perfil en un registro OSINT estructurado en más de 150 sitios

    1082+5Variación de estrellas de los últimos 7 días
  • scrapfly-scrapers@scrapfly

    Scripts de web scraping en Python escalables para más de 40 dominios populares.

    1078+5Variación de estrellas de los últimos 7 días
  • clean-text@jfilter

    Paquete de Python para la limpieza de texto.

    1028+0Variación de estrellas de los últimos 7 días
  • hrequests@daijro

    🚀 Web scraping para humanos

    1022+0Variación de estrellas de los últimos 7 días
  • Recopile respuestas estructuradas de un scraper de ChatGPT enviando un prompt con credenciales de API válidas. Habilite la búsqueda en vivo, inyecte contexto HTML y automatice flujos de trabajo de scraping inteligente con ChatGPT mediante unos pocos parámetros.

    942+153Variación de estrellas de los últimos 7 días
  • loconotion@leoncvlt

    Herramienta de Python para convertir páginas de Notion.so en sitios web estáticos ligeros y personalizables

    857+0Variación de estrellas de los últimos 7 días
  • pdf.tocgen@Krasjet

    Conjunto de herramientas CLI para generar automáticamente tablas de contenido en archivos PDF.

    848+0Variación de estrellas de los últimos 7 días
  • easy-scraping-tutorial@MorvanZhou

    Código de tutorial de web scraping en Python, sencillo pero útil.

    820+0Variación de estrellas de los últimos 7 días
  • trawl@germondai

    Motor de scraping autohospedado: evita cualquier desafío de JS y captcha: Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Alternativa y reemplazo directo para FlareSolverr y Byparr en tu stack *arr.

    793+26Variación de estrellas de los últimos 7 días
  • linkedin-profile-scraper-api@josephlimtech

    Scraper de perfiles de LinkedIn que devuelve datos estructurados en formato JSON.

    776+0Variación de estrellas de los últimos 7 días
  • lookyloo@Lookyloo

    Lookyloo es una interfaz web que permite a los usuarios capturar una página web y mostrar un árbol de dominios que se llaman entre sí.

    774+1Variación de estrellas de los últimos 7 días
  • dark-knowledge@prescience-data

    😈📚 Una biblioteca curada de artículos de investigación y presentaciones para entusiastas de la contra-detección y la privacidad web.

    771+2Variación de estrellas de los últimos 7 días
  • Paquete de Python para obtener resultados de búsqueda de Google mediante la API de SERP

    755+2Variación de estrellas de los últimos 7 días
  • rota@alpkeskin

    Un motor de rotación de proxy de alto rendimiento con gestión automatizada de IP y monitoreo de salud en tiempo real

    748+5Variación de estrellas de los últimos 7 días
  • HomeHarvest@ZacharyHampton

    Paquete de Python para extraer datos de propiedades inmobiliarias.

    739+2Variación de estrellas de los últimos 7 días
  • comic-dl@Xonshiz

    Comic-dl es una herramienta de línea de comandos para descargar manga y cómics de varios sitios. Sitios soportados: readcomiconline.to, mangafox.me, comic naver y muchos más.

    676+2Variación de estrellas de los últimos 7 días
  • Extrae perfiles de redes sociales y más mediante expresiones regulares

    656+0Variación de estrellas de los últimos 7 días
  • pricewise@adrianhajdin

    Aprende web scraping y construye un rastreador de precios de comercio electrónico con Next.js 13 en un solo video que cubre extracción de datos, cron jobs, envío de correos, despliegue y más.

    636+1Variación de estrellas de los últimos 7 días
  • h5i@h5i-dev

    Colaboración en entorno aislado para equipos multi-agente: un foro de mensajes respaldado por Git donde cada agente está aislado en su propio sandbox desechable. Coordina entre máquinas sin compartir credenciales ni acceso al host.

    633+22Variación de estrellas de los últimos 7 días
  • juriscraper@freelawproject

    Una API para extraer metadatos de sitios web de tribunales estadounidenses.

    631+3Variación de estrellas de los últimos 7 días
  • Kemono-Downloader@Yuvi9587

    Kemono pawchive Downloader es una aplicación rápida en PyQt5 para archivar contenido de una amplia gama de sitios, incluyendo Kemono, Coomer, Bunkr, Erome, Saint2.su, nhentai y Discord. Incluye un navegador de creadores, verificador de actualizaciones y admite descargas multiproceso y de varias partes. Las sesiones pueden pausarse, reanudarse o recuperarse.

    630+10Variación de estrellas de los últimos 7 días
  • docker-selenium-lambda@umihico

    La demostración más sencilla de automatización de Chrome mediante Python y Selenium en AWS Lambda

    618+0Variación de estrellas de los últimos 7 días
  • Ominis-OSINT@AnonCatalyst

    Esta aplicación de Python es una herramienta de OSINT (Inteligencia de Fuentes Abiertas) llamada "Ominis OSINT - Web Hunter". Realiza la recopilación de información en línea consultando a Google para obtener resultados relacionados con la búsqueda del usuario. La herramienta extrae información relevante como títulos, URLs y posibles menciones de la consulta en los resultados.

    614+2Variación de estrellas de los últimos 7 días
  • LinkedInDumper@l4rm4nd

    Script de Python 3 para volcar/extraer empleados de empresas desde la API de LinkedIn

    611+0Variación de estrellas de los últimos 7 días
  • reddit-universal-scraper@ksanjeev284

    Universal Reddit Scraper: funciona en cualquier subreddit o usuario

    597+4Variación de estrellas de los últimos 7 días
← Volver a temas