Saltar al contenido principal
buildradar
Sign in
Tema · crawler

crawler

Repositorios de código abierto monitorizados etiquetados con crawler, ordenados por estrellas.

153 repositorios
  • sperm@darbra

    Recopilación de artículos destacados sobre ingeniería inversa, vale la pena leerlos

    1410+0Variación de estrellas de los últimos 7 días
  • mlscraper@lorey

    🤖 Extrae datos de sitios web HTML automáticamente con solo proporcionar ejemplos

    1386+1Variación de estrellas de los últimos 7 días
  • crawler@kgspider

    Compartición de código de scraping del hermano K, ingeniería inversa de JS, scraping avanzado. Sigue la cuenta oficial: K哥爬虫

    1379+0Variación de estrellas de los últimos 7 días
  • wombat@felipecsl

    Rastreador/scraper web ligero en Ruby con un DSL elegante para extraer datos estructurados de páginas.

    1360+0Variación de estrellas de los últimos 7 días
  • XSRFProbe@0xInfection

    El kit de herramientas principal para la auditoría y explotación de falsificación de peticiones en sitios cruzados (CSRF).

    1303+1Variación de estrellas de los últimos 7 días
  • 📝 Rastrea rápidamente la información (por ejemplo, seguidores, etiquetas, etc.) de un perfil de Instagram.

    1302+1Variación de estrellas de los últimos 7 días
  • go-dork@dwisiswant0

    El escáner de dorks más rápido escrito en Go.

    1302+0Variación de estrellas de los últimos 7 días
  • boss-zhipin-scraper@eatmoreduck

    Herramienta de scraping para ofertas de empleo en BOSS Zhipin, basada en el protocolo Chrome CDP para reutilizar estados de inicio de sesión, eludir protecciones de fuentes y exportar datos en JSON/CSV con análisis de habilidades salariales.

    1282+33Variación de estrellas de los últimos 7 días
  • Beanbun@kiddyuchina

    Beanbun es un framework de web scraping multiproceso escrito en PHP, altamente abierto y escalable, basado en Workerman.

    1258-1Variación de estrellas de los últimos 7 días
  • Un descargador de cómics de Bilibili con interfaz gráfica, soporte para búsqueda por palabras clave, inicio de sesión con código QR, descarga de capítulos bloqueados, descarga multihilo, múltiples formatos de guardado, gestión local y actualización con un clic

    1243+1Variación de estrellas de los últimos 7 días
  • AppCrawler@seveniruby

    Herramienta de recorrido automático de aplicaciones basada en Appium

    1237+0Variación de estrellas de los últimos 7 días
  • tumblr-crawler@dixudx

    Descarga fácilmente todas las fotos y videos de los blogs de Tumblr.

    1157+0Variación de estrellas de los últimos 7 días
  • newspaper4k@AndyTheFactory

    Newspaper4k, un fork del popular Newspaper3k para la extracción de artículos, títulos y metadatos de sitios web de noticias.

    1141+1Variación de estrellas de los últimos 7 días
  • fess@codelibs

    Servidor de búsqueda empresarial y de sitios de código abierto y autohospedado basado en OpenSearch. Rastrea fuentes web, archivos, bases de datos y la nube, con soporte para más de 20 idiomas, API REST, IA/RAG y búsqueda semántica. Licencia Apache-2.0.

    1128+1Variación de estrellas de los últimos 7 días
  • browsertrix-crawler@webrecorder

    Ejecuta un crawler de archivo web de alta fidelidad basado en navegador dentro de un único contenedor Docker.

    1127+5Variación de estrellas de los últimos 7 días
  • crawly@elixir-crawly

    Crawly, un framework de alto nivel para web crawling y scraping en Elixir.

    1116+2Variación de estrellas de los últimos 7 días
  • kimuraframework@vifreefly

    Desarrollo de scrapers web en Ruby mediante un DSL limpio asistido por IA. Kimurai utiliza IA para identificar la ubicación de los datos, almacena selectores en caché y realiza el scraping con Ruby puro, obteniendo la inteligencia de un LLM sin la latencia ni los costos por token de cada solicitud.

    1102+0Variación de estrellas de los últimos 7 días
  • scrapfly-scrapers@scrapfly

    Scripts de web scraping en Python escalables para más de 40 dominios populares.

    1076+4Variación de estrellas de los últimos 7 días
  • parse-video@wujunwei928

    Eliminación de marcas de agua de videos cortos en Golang: Douyin, Pipixia, Huoshan, Weishi, Zuiyou, Kuaishou, Quanmin, Pipigaoxiao, Xigua, Huya, Pear Video, AcFun, Haokan, etc.

    1032+10Variación de estrellas de los últimos 7 días
  • Descarga y extracción de novelas, soporte para Qidian y Biquge, exportación a Markdown y txt, conversión a epub, filtrado de anuncios y corrección automática

    1017+8Variación de estrellas de los últimos 7 días
  • wreq@0x676e67

    Un cliente HTTP en Rust ergonómico y consciente de la privacidad

    1017+12Variación de estrellas de los últimos 7 días
  • google-play-scraper@JoMingyu

    Scraper de Google Play para Python inspirado en <facundoolano/google-play-scraper>

    1010+2Variación de estrellas de los últimos 7 días
  • Pxer@pea3nut

    Una herramienta para pixiv.net. Un scraper de Pixiv accesible para todos.

    1009-1Variación de estrellas de los últimos 7 días
  • stormcrawler@apache

    Un rastreador web escalable, maduro y versátil basado en Apache Storm

    994+1Variación de estrellas de los últimos 7 días
  • SpiderSuite@spidersuite

    Lanzamientos, wiki y hoja de ruta de SpiderSuite (rastreador de seguridad web)

    974+1Variación de estrellas de los últimos 7 días
  • crawler@fredwu

    Un rastreador/scraper web de alto rendimiento en Elixir

    956+0Variación de estrellas de los últimos 7 días
  • crw@us

    Alternativa rápida y ligera a Firecrawl/Tavily escrita en Rust. Web scraper, crawler y API de búsqueda con servidor MCP para agentes de IA. API compatible con Firecrawl (/scrape, /crawl, /search). 2.3 veces más rápido que Tavily y 1.5 veces más rápido que Firecrawl en benchmarks de 1000 URLs. 6 MB de RAM, binario único. Autohospedable o mediante nube gestionada.

    955+87Variación de estrellas de los últimos 7 días
  • x-kit@xiaoxiunique

    Herramientas de protocolo en Python puro y notas de investigación para X.com, con conjuntos de datos de la cuenta de Twitter de VibeLoft.

    940-1Variación de estrellas de los últimos 7 días
  • icrawler@hellock

    Un framework de rastreo multihilo con muchos rastreadores de imágenes integrados.

    933+1Variación de estrellas de los últimos 7 días
  • chatWeb@SkywalkerDarren

    ChatWeb puede rastrear páginas web, leer archivos PDF, DOCX y TXT, extraer el contenido principal y responder preguntas basadas en dicho contenido o resumir los puntos clave.

    916+0Variación de estrellas de los últimos 7 días
← Volver a temas