scraper
Repositorios de código abierto monitorizados etiquetados con scraper, ordenados por estrellas.
- #31
Scraper de Node.js para obtener datos de Google Play
★ 2956+4Variación de estrellas de los últimos 7 días - #32
Aprende paso a paso cómo extraer datos de Google Trends y realizar una comparación de resultados usando Python y la API SERP de Oxylabs. Extrae palabras clave, su popularidad, desglose por región, consultas relacionadas y más.
★ 2909+35Variación de estrellas de los últimos 7 días - #33
Geziyor, un framework de rastreo y extracción web extremadamente rápido para Go. Compatible con renderizado JS.
★ 2776+0Variación de estrellas de los últimos 7 días - #34
Extrae metadatos de cualquier URL utilizando Open Graph, JSON-LD, etiquetas meta HTML y alternativas inteligentes.
★ 2734+2Variación de estrellas de los últimos 7 días - #35
Biblioteca de Python y CLI para scraping de X/Twitter con rotación de múltiples cuentas y manejo integrado de límites de velocidad.
★ 2732+14Variación de estrellas de los últimos 7 días - #36★ 2690-1Variación de estrellas de los últimos 7 días
- #37
Descarga y archiva contenido de Reddit
★ 2608+1Variación de estrellas de los últimos 7 días - #38
API de web scraping de código abierto. Convierte cualquier sitio web en markdown limpio o JSON estructurado. Navegador antidetección, selección automática de proxy, autoalojado. Un comando: make up
★ 2599+222Variación de estrellas de los últimos 7 días - #39
Transforma contenido web en datos listos para LLM.
★ 2158+32Variación de estrellas de los últimos 7 días - #40
Biblioteca de Node.js para recibir eventos de transmisión en vivo (comentarios, regalos, etc.) en tiempo real desde TikTok LIVE.
★ 2139+4Variación de estrellas de los últimos 7 días - #41
Servidor MCP de documentación técnica basado en interfaz de usuario, completamente gratuito y privado. Diseñado pensando en programadores y desarrolladores de software. Se integra fácilmente en Cursor, Windsurf, Cline, Roo Code y la aplicación de escritorio de Claude.
★ 2105-1Variación de estrellas de los últimos 7 días - #42
Biblioteca central de NewPipe para extraer datos de sitios de streaming.
★ 1960+3Variación de estrellas de los últimos 7 días - #43
Aprende a crear tu propio scraper de Google Jobs que extrae datos simultáneamente para múltiples consultas y ubicaciones geográficas usando Python y la API de Google Jobs Scraper de Oxylabs. https://oxylabs.io/blog/how-to-scrape-google-jobs
★ 1767+35Variación de estrellas de los últimos 7 días - #44
Scraper de Google Play para recopilar detalles públicos sobre aplicaciones, juegos, películas, programas de televisión, libros y más.
★ 1757+24Variación de estrellas de los últimos 7 días - #45
Descarga sitios web a un directorio local (incluyendo todos los archivos CSS, imágenes, JS, etc.)
★ 1751-1Variación de estrellas de los últimos 7 días - #46
Enlace de Python para los motores Modest y Lexbor. Un analizador HTML5 rápido con selectores CSS para Python.
★ 1671+4Variación de estrellas de los últimos 7 días - #47★ 1662+0Variación de estrellas de los últimos 7 días
- #48
Bot de Instagram de estilo humano, completamente gratuito y de código abierto. Impulsado por UIAutomator2 y compatible con prácticamente cualquier dispositivo Android 5.0+ que pueda ejecutar Instagram, ya sea real o emulado.
★ 1634+2Variación de estrellas de los últimos 7 días - #49
Extrae tweets, perfiles, seguidores y seguidos de Twitter/X, no se necesita clave API. Biblioteca de Python con agrupación inteligente de múltiples cuentas, soporte de proxy y asíncrono.
★ 1607+2Variación de estrellas de los últimos 7 días - #50★ 1554+0Variación de estrellas de los últimos 7 días
- #51
Un descargador y reproductor de anime altamente eficiente, rápido, potente y ligero para tu anime favorito.
★ 1522+0Variación de estrellas de los últimos 7 días - #52
Herramienta de renombrado automático para series de TV y anime, cambio de nombre masivo con un solo clic. Se puede usar junto con QBittorrent para renombrar automáticamente tras la descarga, facilitando el scraping automático de Emby. Compatible con entornos Windows, Linux, MacOS, Docker y paquetes de Synology.
★ 1491+0Variación de estrellas de los últimos 7 días - #53
Un cliente HTTP de Python ergonómico y respetuoso con la privacidad
★ 1438+1Variación de estrellas de los últimos 7 días - #54★ 1386+1Variación de estrellas de los últimos 7 días
- #55
Rastreador/scraper web ligero en Ruby con un DSL elegante para extraer datos estructurados de páginas.
★ 1360+0Variación de estrellas de los últimos 7 días - #56
Obtén datos de publicaciones, perfiles o hashtags de Instagram sin usar la API de Instagram.
★ 1352+1Variación de estrellas de los últimos 7 días - #57★ 1332+1Variación de estrellas de los últimos 7 días
- #58
Cinemagoer es un paquete de Python útil para recuperar y gestionar datos de la base de datos de películas IMDb (con la cual no tenemos ninguna afiliación) sobre películas, personas y personajes.
★ 1323+0Variación de estrellas de los últimos 7 días - #59
Espejo de Anime Garden | Agregador de recursos BT de anime | API abierta de recursos BT de anime
★ 1301+4Variación de estrellas de los últimos 7 días - #60
Herramienta de scraping para ofertas de empleo en BOSS Zhipin, basada en el protocolo Chrome CDP para reutilizar estados de inicio de sesión, eludir protecciones de fuentes y exportar datos en JSON/CSV con análisis de habilidades salariales.
★ 1282+33Variación de estrellas de los últimos 7 días