Saltar al contenido principal
buildradar
Sign in
Tema · scraper

scraper

Repositorios de código abierto monitorizados etiquetados con scraper, ordenados por estrellas.

114 repositorios
  • newspaper4k@AndyTheFactory

    Newspaper4k, un fork del popular Newspaper3k para la extracción de artículos, títulos y metadatos de sitios web de noticias.

    1141+1Variación de estrellas de los últimos 7 días
  • crawly@elixir-crawly

    Crawly, un framework de alto nivel para web crawling y scraping en Elixir.

    1116+2Variación de estrellas de los últimos 7 días
  • kimuraframework@vifreefly

    Desarrollo de scrapers web en Ruby mediante un DSL limpio asistido por IA. Kimurai utiliza IA para identificar la ubicación de los datos, almacena selectores en caché y realiza el scraping con Ruby puro, obteniendo la inteligencia de un LLM sin la latencia ni los costos por token de cada solicitud.

    1102+0Variación de estrellas de los últimos 7 días
  • scrapfly-scrapers@scrapfly

    Scripts de web scraping en Python escalables para más de 40 dominios populares.

    1076+4Variación de estrellas de los últimos 7 días
  • jikan@jikan-me

    API PHP+REST no oficial de MyAnimeList que ofrece funciones adicionales a la API oficial

    1072+6Variación de estrellas de los últimos 7 días
  • URS@JosephLai241

    Universal Reddit Scraper: una herramienta de línea de comandos integral para extraer y archivar datos de Reddit.

    1022+1Variación de estrellas de los últimos 7 días
  • GreenResourcesManager@klsdf

    Un gestor integral para organizar recursos en la computadora, con elementos de gamificación.

    1019+6Variación de estrellas de los últimos 7 días
  • wreq@0x676e67

    Un cliente HTTP en Rust ergonómico y consciente de la privacidad

    1017+12Variación de estrellas de los últimos 7 días
  • google-play-scraper@JoMingyu

    Scraper de Google Play para Python inspirado en <facundoolano/google-play-scraper>

    1010+2Variación de estrellas de los últimos 7 días
  • La primera herramienta para ver publicaciones privadas de Instagram de forma anónima

    994+13Variación de estrellas de los últimos 7 días
  • crawler@fredwu

    Un rastreador/scraper web de alto rendimiento en Elixir

    956+0Variación de estrellas de los últimos 7 días
  • x-tweet-fetcher@ythx-101

    Obtén tweets, respuestas, líneas de tiempo y artículos de X/Twitter sin inicio de sesión ni claves API; herramienta de campo para agentes de IA.

    955+6Variación de estrellas de los últimos 7 días
  • scrapyrt@scrapinghub

    API HTTP para spiders de Scrapy

    884+1Variación de estrellas de los últimos 7 días
  • skrape.it@skrapeit

    Una biblioteca basada en Kotlin para pruebas, scraping y análisis, que permite extraer datos de HTML (renderizado en servidor y cliente). Pone especial énfasis en la facilidad de uso y alta legibilidad mediante un DSL intuitivo. Aunque está diseñada como biblioteca de pruebas, también puede usarse para hacer scraping de sitios web de forma conveniente.

    875-1Variación de estrellas de los últimos 7 días
  • xidel@benibela

    Herramienta de línea de comandos para descargar y extraer datos de páginas HTML/XML o API JSON, utilizando CSS, XPath 3.0, XQuery 3.0, JSONiq o coincidencia de patrones. También puede crear documentos XML/HTML/JSON nuevos o transformados.

    844+1Variación de estrellas de los últimos 7 días
  • zimit@openzim

    Crea un archivo ZIM desde cualquier sitio web y navega sin conexión

    842+5Variación de estrellas de los últimos 7 días
  • HDoujinDownloader@HDoujinDownloader

    Un descargador de galerías de imágenes y doujinshi de propósito general

    841+0Variación de estrellas de los últimos 7 días
  • epublifier@maoserr

    Convierte algunas novelas web al formato epub

    840+1Variación de estrellas de los últimos 7 días
  • spidr@postmodern

    Una versátil librería de web spidering para Ruby capaz de rastrear un sitio, múltiples dominios, enlaces específicos o de forma infinita. Spidr está diseñado para ser rápido y fácil de usar.

    836+0Variación de estrellas de los últimos 7 días
  • jvppeteer@fanyong920

    API de Java para Chrome y Firefox

    805+0Variación de estrellas de los últimos 7 días
  • opensanctions@opensanctions

    Una base de datos abierta de datos de sanciones internacionales, personas de interés y personas expuestas políticamente

    797+6Variación de estrellas de los últimos 7 días
  • trawl@germondai

    Motor de scraping autohospedado: evita cualquier desafío de JS y captcha: Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Alternativa y reemplazo directo para FlareSolverr y Byparr en tu stack *arr.

    782+46Variación de estrellas de los últimos 7 días
  • linkedin-profile-scraper-api@josephlimtech

    Scraper de perfiles de LinkedIn que devuelve datos estructurados en formato JSON.

    776+0Variación de estrellas de los últimos 7 días
  • operative framework es un framework de OSINT basado en Rust; permite interactuar con múltiples objetivos, ejecutar diversos módulos, crear enlaces con objetivos, exportar informes a PDF, añadir notas a objetivos o resultados, interactuar con API RESTful y escribir tus propios módulos.

    749-1Variación de estrellas de los últimos 7 días
  • HomeHarvest@ZacharyHampton

    Paquete de Python para extraer datos de propiedades inmobiliarias.

    739+3Variación de estrellas de los últimos 7 días
  • Discount-Bandit@Cybrarist

    Un rastreador de precios multiusuario autohospedado para Amazon, Aliexpress, ebay y muchas otras tiendas personalizadas. Reciba notificaciones cuando el precio cumpla con uno o más criterios establecidos por el usuario.

    738+2Variación de estrellas de los últimos 7 días
  • slash@theahmadov

    La herramienta de OSINT Slash.

    737+1Variación de estrellas de los últimos 7 días
  • scala-scraper@ruippeixotog

    Una biblioteca de Scala para extraer contenido de páginas HTML

    732+0Variación de estrellas de los últimos 7 días
  • scrapers@cassidoo

    Una lista de scrapers de toda la web.

    730+0Variación de estrellas de los últimos 7 días
  • Documentación de la API interna de Twitter

    711+1Variación de estrellas de los últimos 7 días
← Volver a temas