spider
Repositórios de código aberto acompanhados marcados com spider, ordenados por estrelas.
- #61★ 956+0Variação de estrelas nos últimos 7 dias
- #62★ 933+1Variação de estrelas nos últimos 7 dias
- #63
Casos de engenharia reversa de web scrapers, incluindo: impressão digital TLS, Rueshu, Zhenkunhang, NetEase Yidun, descompilação de mini-programas WeChat, Tonghuashun, descriptografia RPC, Jiasule, CAPTCHA de deslizamento Geetest, Juliansuan, Boss Zhipin, Qichacha, China Minmetals, QQ Music, plataforma de big data de políticas industriais, Qizhidao, Xueqiu (acw_sc__v2), 1688, Qimai Data, whggzy, Qiming Technology, mohurd, EntGroup, OKLink.
★ 914+4Variação de estrelas nos últimos 7 dias - #64
Um crawler de ações em Java baseado em Spring Boot (suporta apenas ações A), se você gosta, por favor, dê uma estrela. A versão V2 está em desenvolvimento!
★ 846-1Variação de estrelas nos últimos 7 dias - #65
Uma biblioteca versátil de web spidering em Ruby capaz de rastrear um site, múltiplos domínios, links específicos ou de forma infinita. O Spidr foi projetado para ser rápido e fácil de usar.
★ 836+0Variação de estrelas nos últimos 7 dias - #66
Um conjunto de spiders e scrapers para extrair informações de localização de estabelecimentos que publicam sua localização na internet.
★ 822+6Variação de estrelas nos últimos 7 dias - #67
Plugin de origem/metadados para o calibre baseado na busca de ISBN da Biblioteca Nacional da China.
★ 793+2Variação de estrelas nos últimos 7 dias - #68
Um framework de Teste de Intrusão (Penetration Testing), ferramenta de coleta de informações e Scanner de Vulnerabilidades de Sites
★ 782+2Variação de estrelas nos últimos 7 dias - #69
Scraper de perfil do LinkedIn que retorna dados estruturados do perfil em JSON.
★ 776+0Variação de estrelas nos últimos 7 dias - #70
Um framework de web crawler leve.
★ 760-1Variação de estrelas nos últimos 7 dias - #71
:newspaper: Deixe o ChatGPT resumir o Hacker News para você
★ 756+0Variação de estrelas nos últimos 7 dias - #72
Signal 18 repman - Gerenciador de replicação para MySQL / MariaDB / Percona Server
★ 739+0Variação de estrelas nos últimos 7 dias - #73
Empacotador de light novels, coleta conteúdo dos sites bilinovel.com e linovelib.com, compacta em formato EPUB, suporta capa, ilustrações, sumário e mesclagem de volumes.
★ 735+6Variação de estrelas nos últimos 7 dias - #74
Crawler em Python para remoção de marca d'água de vídeos curtos: Douyin, Pipixia, Huoshan, Weishi, Zuiyou, Kuaishou, Quanmin Xiaoshipin, Pipigaoxiao, Xigua Video, Huya, Pear Video, Acfun, Haokan Video...
★ 692+7Variação de estrelas nos últimos 7 dias - #75
Projeto de crawler de notícias de opinião pública de nível empresarial: suporta execução com um clique de qualquer número de crawlers, tarefas agendadas, exclusão em lote, implantação com um clique, monitoramento visualizado e configuração de estratégias de alocação de cluster
★ 686+1Variação de estrelas nos últimos 7 dias - #76★ 676+3Variação de estrelas nos últimos 7 dias
- #77
Ideias e experiência em engenharia reversa de parâmetros de aplicativos, engenharia reversa Android
★ 669+1Variação de estrelas nos últimos 7 dias - #78
Krawl é um servidor de engano web nativo em nuvem, leve e personalizável, além de um anti-crawler que cria aplicativos web falsos com vulnerabilidades fáceis de explorar, usando dados de engodo realistas gerados aleatoriamente e templates HTML gerados por IA.
★ 646+4Variação de estrelas nos últimos 7 dias - #79
NetDiscovery é um framework/middleware de crawler genérico implementado com base em frameworks como Vert.x e RxJava 2.
★ 646+0Variação de estrelas nos últimos 7 dias - #80
Projeto de questionário, recomendação de servidores em nuvem, projeto de idle, proxy gratuito, coleta de diversos scripts. Clique no sininho no canto superior direito para receber atualizações em tempo real. (Não dê fork, mantenha discrição)
★ 643+1Variação de estrelas nos últimos 7 dias - #81
spider-admin-pro é uma ferramenta de gerenciamento visual para projetos de web scraping com Scrapy e Scrapyd, além de agendamento de tarefas, sendo uma versão atualizada do SpiderAdmin.
★ 613+0Variação de estrelas nos últimos 7 dias - #82
Script em Python 3 para extrair/coletar funcionários de empresas da API do LinkedIn
★ 611+2Variação de estrelas nos últimos 7 dias - #83★ 560+1Variação de estrelas nos últimos 7 dias
- #84
FreeProxy: Coleta de proxies gratuitos da internet. (Enorme quantidade de proxies gratuitos e de alta qualidade do mundo todo, suporte para rastreamento de dezenas de fontes de compartilhamento de proxies gratuitos, suporte para filtragem de proxies com regras personalizadas, essencial para web scraping e análise de dados, com atualização diária de uma enorme quantidade de proxies gratuitos.)
★ 535+7Variação de estrelas nos últimos 7 dias - #85
🎯 Software de análise de visualização de dados da seção de comentários do Bilibili -- criadores podem usar para orientar a escolha de temas e esclarecer seu público.
★ 528+2Variação de estrelas nos últimos 7 dias