Pular para o conteúdo principal
buildradar
Sign in
Tópico · crawler

crawler

Repositórios de código aberto acompanhados marcados com crawler, ordenados por estrelas.

153 repositórios
  • spider_reverse@0xAllenChen

    Casos de engenharia reversa de web scrapers, incluindo: impressão digital TLS, Rueshu, Zhenkunhang, NetEase Yidun, descompilação de mini-programas WeChat, Tonghuashun, descriptografia RPC, Jiasule, CAPTCHA de deslizamento Geetest, Juliansuan, Boss Zhipin, Qichacha, China Minmetals, QQ Music, plataforma de big data de políticas industriais, Qizhidao, Xueqiu (acw_sc__v2), 1688, Qimai Data, whggzy, Qiming Technology, mohurd, EntGroup, OKLink.

    914+4Variação de estrelas nos últimos 7 dias
  • siteone-crawler@janreges

    SiteOne Crawler é um rastreador e analisador de sites multiplataforma para SEO, segurança, acessibilidade e otimização de desempenho — ideal para desenvolvedores, engenheiros DevOps, QA e consultores. Suporta Windows, macOS e Linux (x64 e arm64).

    896+13Variação de estrelas nos últimos 7 dias
  • scrapyrt@scrapinghub

    API HTTP para spiders do Scrapy

    884+1Variação de estrelas nos últimos 7 dias
  • API de alto desempenho assíncrona para Douyin, TikTok, Xiaohongshu, Kuaishou, Weibo, Instagram, YouTube, Twitter (X), resolvedor de CAPTCHA e e-mail temporário.

    876+10Variação de estrelas nos últimos 7 dias
  • skrape.it@skrapeit

    Uma biblioteca de testes/scraping/parsing baseada em Kotlin que oferece a capacidade de analisar e extrair dados de HTML (renderizado no servidor e no cliente). Enfatiza a facilidade de uso e a legibilidade ao fornecer uma DSL intuitiva. Seu objetivo é ser uma biblioteca de testes, mas também pode ser usada para fazer scraping de sites de forma conveniente.

    875-1Variação de estrelas nos últimos 7 dias
  • ArrowDL@setvisible

    ArrowDL (Arrow Downloader) é um gerenciador de downloads para Windows, MacOS e Linux

    848+4Variação de estrelas nos últimos 7 dias
  • spidr@postmodern

    Uma biblioteca versátil de web spidering em Ruby capaz de rastrear um site, múltiplos domínios, links específicos ou de forma infinita. O Spidr foi projetado para ser rápido e fácil de usar.

    836+0Variação de estrelas nos últimos 7 dias
  • Engenharia reversa de IA simplificada.

    824+35Variação de estrelas nos últimos 7 dias
  • easy-scraping-tutorial@MorvanZhou

    Código de tutorial de web scraping em Python simples, porém útil.

    820+0Variação de estrelas nos últimos 7 dias
  • jvppeteer@fanyong920

    API Java para Chrome e Firefox

    805+0Variação de estrelas nos últimos 7 dias
  • xeHentai@fffonion

    Baixador de doujinshi, 绅士漫画下载

    803+1Variação de estrelas nos últimos 7 dias
  • Ferramenta poderosa para engenharia reversa de cookies JS: ferramenta de visualização de monitoramento de alterações de cookies JS e hook de cookies JS para pontos de interrupção condicionais.

    785-1Variação de estrelas nos últimos 7 dias
  • seonaut@StJudeWasHere

    Ferramenta de auditoria de SEO de código aberto.

    780+7Variação de estrelas nos últimos 7 dias
  • linkedin-profile-scraper-api@josephlimtech

    Scraper de perfil do LinkedIn que retorna dados estruturados do perfil em JSON.

    776+0Variação de estrelas nos últimos 7 dias
  • lxBook@lixi5338619

    Repositório de código para o livro "《爬虫逆向进阶实战》"

    769+0Variação de estrelas nos últimos 7 dias
  • xxl-crawler@xuxueli

    Um framework de web crawler leve.

    760-1Variação de estrelas nos últimos 7 dias
  • TheBigBrother@chadi0x

    O Big Brother V6.0 é uma plataforma OSINT armada que inclui enumeração de nomes de usuário (mais de 473 plataformas), inteligência visual de vetor quádruplo, rastreamento Sky Radar, análise de carteiras criptográficas, inteligência SSL, reconstrução de pegada digital, extração EXIF, dorking avançado e reconhecimento de rede.

    758+8Variação de estrelas nos últimos 7 dias
  • hacker-news-digest@polyrabbit

    :newspaper: Deixe o ChatGPT resumir o Hacker News para você

    756+0Variação de estrelas nos últimos 7 dias
  • TumblThree@TumblThreeApp

    Um aplicativo de backup de blogs do Tumblr e Twitter

    733+0Variação de estrelas nos últimos 7 dias
  • PyPtt@PyPtt

    A melhor biblioteca PTT

    732+0Variação de estrelas nos últimos 7 dias
  • wscan@chushuai

    Wscan é um scanner de segurança web focado em tornar a segurança na web acessível a todos.

    713+2Variação de estrelas nos últimos 7 dias
  • Pesquise no google, bing, yahoo e outros mecanismos de busca com python

    671+2Variação de estrelas nos últimos 7 dias
  • Craw4LLM@cxcscmu

    Repositório oficial para "Craw4LLM: Efficient Web Crawling for LLM Pretraining"

    664+1Variação de estrelas nos últimos 7 dias
  • NetDiscovery@fengzhizi715

    NetDiscovery é um framework/middleware de crawler genérico implementado com base em frameworks como Vert.x e RxJava 2.

    646+0Variação de estrelas nos últimos 7 dias
  • Krawl@BlessedRebuS

    Krawl é um servidor de engano web nativo em nuvem, leve e personalizável, além de um anti-crawler que cria aplicativos web falsos com vulnerabilidades fáceis de explorar, usando dados de engodo realistas gerados aleatoriamente e templates HTML gerados por IA.

    646+4Variação de estrelas nos últimos 7 dias
  • pywebcopy@rajatomar788

    Salva páginas da web localmente no seu disco rígido com imagens, CSS, JS e links tal como estão.

    639+1Variação de estrelas nos últimos 7 dias
  • Moodle-DL@C0D3D3V

    O Moodle-DL baixa o conteúdo de cursos rapidamente do Moodle (ex: PDFs de aulas)

    634+2Variação de estrelas nos últimos 7 dias
  • Jie@yhy0

    Jie destaca-se como uma ferramenta abrangente de avaliação de segurança e exploração, meticulosamente elaborada para aplicações web. Seu robusto conjunto de recursos abrange escaneamento de vulnerabilidades, coleta de informações e exploração, tornando-o um kit de ferramentas indispensável tanto para profissionais de segurança quanto para testadores de penetração.

    608-1Variação de estrelas nos últimos 7 dias
  • webster@zhuyingda

    Um framework de alto nível confiável para web crawling e scraping para Node.js.

    560+1Variação de estrelas nos últimos 7 dias
  • reader@vakra-dev

    Infraestrutura web de código aberto para IA. Faça raspagem, rastreamento e automatize a web, limpe markdown, sessões de navegador, pronto para seus agentes.

    559+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos