scraping
Repositorios de código abierto monitorizados etiquetados con scraping, ordenados por estrellas.
- #61
Un fork completamente renovado y rediseñado, reimaginado desde cero basado en el onlyfans-scraper original
★ 1153+0Variación de estrellas de los últimos 7 días - #62
Newspaper4k, un fork del popular Newspaper3k para la extracción de artículos, títulos y metadatos de sitios web de noticias.
★ 1141+0Variación de estrellas de los últimos 7 días - #63
¡El agente que convierte sitios web en APIs!
★ 1121+2Variación de estrellas de los últimos 7 días - #64★ 1116+0Variación de estrellas de los últimos 7 días
- #65
Archiva automáticamente enlaces a videos, imágenes y contenido de redes sociales desde Google Sheets (y más).
★ 1113+1Variación de estrellas de los últimos 7 días - #66
⛏️ El motor de extracción detrás de Maigret: convierte cualquier URL de perfil en un registro OSINT estructurado en más de 150 sitios
★ 1082+5Variación de estrellas de los últimos 7 días - #67
Scripts de web scraping en Python escalables para más de 40 dominios populares.
★ 1078+5Variación de estrellas de los últimos 7 días - #68
Paquete de Python para la limpieza de texto.
★ 1028+0Variación de estrellas de los últimos 7 días - #69★ 1022+0Variación de estrellas de los últimos 7 días
- #70
Recopile respuestas estructuradas de un scraper de ChatGPT enviando un prompt con credenciales de API válidas. Habilite la búsqueda en vivo, inyecte contexto HTML y automatice flujos de trabajo de scraping inteligente con ChatGPT mediante unos pocos parámetros.
★ 942+153Variación de estrellas de los últimos 7 días - #71
Herramienta de Python para convertir páginas de Notion.so en sitios web estáticos ligeros y personalizables
★ 857+0Variación de estrellas de los últimos 7 días - #72
Conjunto de herramientas CLI para generar automáticamente tablas de contenido en archivos PDF.
★ 848+0Variación de estrellas de los últimos 7 días - #73
Código de tutorial de web scraping en Python, sencillo pero útil.
★ 820+0Variación de estrellas de los últimos 7 días - #74
Motor de scraping autohospedado: evita cualquier desafío de JS y captcha: Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Alternativa y reemplazo directo para FlareSolverr y Byparr en tu stack *arr.
★ 793+26Variación de estrellas de los últimos 7 días - #75
Scraper de perfiles de LinkedIn que devuelve datos estructurados en formato JSON.
★ 776+0Variación de estrellas de los últimos 7 días - #76
Lookyloo es una interfaz web que permite a los usuarios capturar una página web y mostrar un árbol de dominios que se llaman entre sí.
★ 774+1Variación de estrellas de los últimos 7 días - #77
😈📚 Una biblioteca curada de artículos de investigación y presentaciones para entusiastas de la contra-detección y la privacidad web.
★ 771+2Variación de estrellas de los últimos 7 días - #78
Paquete de Python para obtener resultados de búsqueda de Google mediante la API de SERP
★ 755+2Variación de estrellas de los últimos 7 días - #79
Un motor de rotación de proxy de alto rendimiento con gestión automatizada de IP y monitoreo de salud en tiempo real
★ 748+5Variación de estrellas de los últimos 7 días - #80
Paquete de Python para extraer datos de propiedades inmobiliarias.
★ 739+2Variación de estrellas de los últimos 7 días - #81
Comic-dl es una herramienta de línea de comandos para descargar manga y cómics de varios sitios. Sitios soportados: readcomiconline.to, mangafox.me, comic naver y muchos más.
★ 676+2Variación de estrellas de los últimos 7 días - #82
Extrae perfiles de redes sociales y más mediante expresiones regulares
★ 656+0Variación de estrellas de los últimos 7 días - #83
Aprende web scraping y construye un rastreador de precios de comercio electrónico con Next.js 13 en un solo video que cubre extracción de datos, cron jobs, envío de correos, despliegue y más.
★ 636+1Variación de estrellas de los últimos 7 días - #84
Colaboración en entorno aislado para equipos multi-agente: un foro de mensajes respaldado por Git donde cada agente está aislado en su propio sandbox desechable. Coordina entre máquinas sin compartir credenciales ni acceso al host.
★ 633+22Variación de estrellas de los últimos 7 días - #85
Una API para extraer metadatos de sitios web de tribunales estadounidenses.
★ 631+3Variación de estrellas de los últimos 7 días - #86
Kemono pawchive Downloader es una aplicación rápida en PyQt5 para archivar contenido de una amplia gama de sitios, incluyendo Kemono, Coomer, Bunkr, Erome, Saint2.su, nhentai y Discord. Incluye un navegador de creadores, verificador de actualizaciones y admite descargas multiproceso y de varias partes. Las sesiones pueden pausarse, reanudarse o recuperarse.
★ 630+10Variación de estrellas de los últimos 7 días - #87
La demostración más sencilla de automatización de Chrome mediante Python y Selenium en AWS Lambda
★ 618+0Variación de estrellas de los últimos 7 días - #88
Esta aplicación de Python es una herramienta de OSINT (Inteligencia de Fuentes Abiertas) llamada "Ominis OSINT - Web Hunter". Realiza la recopilación de información en línea consultando a Google para obtener resultados relacionados con la búsqueda del usuario. La herramienta extrae información relevante como títulos, URLs y posibles menciones de la consulta en los resultados.
★ 614+2Variación de estrellas de los últimos 7 días - #89
Script de Python 3 para volcar/extraer empleados de empresas desde la API de LinkedIn
★ 611+0Variación de estrellas de los últimos 7 días - #90
Universal Reddit Scraper: funciona en cualquier subreddit o usuario
★ 597+4Variación de estrellas de los últimos 7 días