spider
Repositórios de código aberto acompanhados marcados com spider, ordenados por estrelas.
- #31★ 2.463+0Variação de estrelas nos últimos 7 dias
- #32
CrawlerDetect é uma classe PHP para detectar bots/crawlers/spiders através do user agent
★ 2.403+2Variação de estrelas nos últimos 7 dias - #33
Baixe imagens do Google, Bing e Baidu.
★ 2.360-2Variação de estrelas nos últimos 7 dias - #34
Framework de web crawler em C# multiplataforma, construído para velocidade e flexibilidade.
★ 2.310+0Variação de estrelas nos últimos 7 dias - #35
LanTian Collector é um sistema de web scraping open source gratuito. Permite coletar dados apenas clicando e editando regras, podendo ser executado localmente, em hospedagem virtual ou servidores em nuvem. Suporta quase todos os tipos de páginas, integra-se perfeitamente a diversos CMS, publica dados em tempo real sem necessidade de login e opera de forma totalmente automática.
★ 2.088-1Variação de estrelas nos últimos 7 dias - #36★ 2.019+0Variação de estrelas nos últimos 7 dias
- #37★ 1.891+3Variação de estrelas nos últimos 7 dias
- #38★ 1.879+2Variação de estrelas nos últimos 7 dias
- #39
Scanner de aplicações web baseado em Python para coletar OSINT e realizar fuzzing de vulnerabilidades OWASP em um site alvo.
★ 1.820-1Variação de estrelas nos últimos 7 dias - #40
QQ空间导出助手,用于备份QQ空间的说说、日志、私密日记、相册、视频、留言板、QQ好友、收藏夹、分享、最近访客为文件,便于迁移与保存
★ 1.815+13Variação de estrelas nos últimos 7 dias - #41
Web scrapers em Python: músicas do NetEase Cloud Music, vídeos do Bilibili, perguntas e respostas do Zhihu, papéis de parede, vídeos do xvideos, audiolivros, Weibo, dados do Anjuke com visualização, extrator de capas de vídeo do Bilibili, pool de proxies IP, análise de dados de usuários do Zhihu e scrapers de usuários do GitHub.
★ 1.649+4Variação de estrelas nos últimos 7 dias - #42
Web crawler para arquivistas: saída em formato WARC, painel para todos os crawls e padrões de ignorar dinâmicos
★ 1.609+2Variação de estrelas nos últimos 7 dias - #43
Web scraper para Douyin: coleta dados públicos como perfis, curtidas, favoritos, áudios originais, tópicos, buscas, coleções, publicações, seguidores e seguidos.
★ 1.605+1Variação de estrelas nos últimos 7 dias - #44★ 1.410+0Variação de estrelas nos últimos 7 dias
- #45
Compartilhamento de código de web scraping do K-Ge, engenharia reversa de JS e técnicas avançadas de scraping. Siga a conta oficial: K哥爬虫
★ 1.379+0Variação de estrelas nos últimos 7 dias - #46
Diários oficiais brasileiros acessíveis a todos.
★ 1.375+1Variação de estrelas nos últimos 7 dias - #47
O kit de ferramentas principal para auditoria e exploração de Cross Site Request Forgery (CSRF).
★ 1.303+1Variação de estrelas nos últimos 7 dias - #48
Uma ferramenta de download para capturar e-books da internet.
★ 1.294+0Variação de estrelas nos últimos 7 dias - #49
Web scraper para BOSS Zhipin / Ferramenta de extração de dados de vagas, baseada no protocolo Chrome CDP para reutilizar o estado de login real, contornar anti-scraping de fontes e exportar salários em texto simples JSON/CSV + análise de habilidades salariais.
★ 1.282+33Variação de estrelas nos últimos 7 dias - #50
Beanbun é um framework de web crawler multiprocesso escrito em PHP, com alta abertura e escalabilidade, baseado no Workerman.
★ 1.258-1Variação de estrelas nos últimos 7 dias - #51
50 notas sobre LLMs. Este repositório contém projetos práticos nas áreas de aprendizado de máquina, aprendizado profundo, visão computacional, processamento de linguagem natural, grandes modelos de linguagem e web scraping.
★ 1.118+3Variação de estrelas nos últimos 7 dias - #52★ 1.116+2Variação de estrelas nos últimos 7 dias
- #53★ 1.104+2Variação de estrelas nos últimos 7 dias
- #54
Web crawler para artigos de contas oficiais do WeChat
★ 1.079+4Variação de estrelas nos últimos 7 dias - #55
Scripts de web scraping em Python escaláveis para mais de 40 domínios populares
★ 1.077+5Variação de estrelas nos últimos 7 dias - #56
Engenharia reversa e descriptografia de parâmetros JS anti-crawler, incluindo Geetest, QQ Music, Pinduoduo, Boss Zhipin, Zhihu, KuGou, Vipshop, China Judgements Online, Taobao, Tianan Insurance, Bilibili, Fang, WPS, Weibo, Youdao, NetEase, WeChat, Kongzhong, Jingongzuo, sistemas de gestão escolar, entre outros.
★ 1.035+0Variação de estrelas nos últimos 7 dias - #57
Remoção de marca d'água de vídeos curtos em Golang: Douyin, Pipixia, Huoshan, Weishi, Zuiyou, Kuaishou, Quanmin Xiaoshipin, Pipigaoxiao, Xigua Video, Huya, Pear Video, AcFun, Haokan Video...
★ 1.032+11Variação de estrelas nos últimos 7 dias - #58
Download de romances, web scraping, Qidian, Biquge, exportação para Markdown, exportação para txt, conversão para epub, filtragem de anúncios e correção automática
★ 1.018+9Variação de estrelas nos últimos 7 dias - #59★ 998+0Variação de estrelas nos últimos 7 dias
- #60
Lançamentos, wiki e roadmap do SpiderSuite (crawler de segurança web)
★ 975+1Variação de estrelas nos últimos 7 dias