crawler
Repositórios de código aberto acompanhados marcados com crawler, ordenados por estrelas.
- #91★ 1.410+0Variação de estrelas nos últimos 7 dias
- #92★ 1.386+1Variação de estrelas nos últimos 7 dias
- #93
Compartilhamento de código de web scraping do K-Ge, engenharia reversa de JS e técnicas avançadas de scraping. Siga a conta oficial: K哥爬虫
★ 1.379+0Variação de estrelas nos últimos 7 dias - #94
Web crawler/scraper leve em Ruby com uma DSL elegante que extrai dados estruturados de páginas.
★ 1.360+0Variação de estrelas nos últimos 7 dias - #95
O kit de ferramentas principal para auditoria e exploração de Cross Site Request Forgery (CSRF).
★ 1.303+1Variação de estrelas nos últimos 7 dias - #96
📝 Obtenha rapidamente informações (como seguidores, tags, etc.) de um perfil do Instagram.
★ 1.302+1Variação de estrelas nos últimos 7 dias - #97★ 1.302+0Variação de estrelas nos últimos 7 dias
- #98
Web scraper para BOSS Zhipin / Ferramenta de extração de dados de vagas, baseada no protocolo Chrome CDP para reutilizar o estado de login real, contornar anti-scraping de fontes e exportar salários em texto simples JSON/CSV + análise de habilidades salariais.
★ 1.282+33Variação de estrelas nos últimos 7 dias - #99
Beanbun é um framework de web crawler multiprocesso escrito em PHP, com alta abertura e escalabilidade, baseado no Workerman.
★ 1.258-1Variação de estrelas nos últimos 7 dias - #100
Um downloader de mangás do Bilibili com interface gráfica, suporte a busca por palavras-chave, login via QR code, download de capítulos bloqueados, multithreading, múltiplos formatos de salvamento e gerenciamento local.
★ 1.243+1Variação de estrelas nos últimos 7 dias - #101
Ferramenta de exploração automática de aplicativos baseada em Appium
★ 1.237+0Variação de estrelas nos últimos 7 dias - #102
Baixe facilmente todas as fotos e vídeos de blogs do Tumblr.
★ 1.157+0Variação de estrelas nos últimos 7 dias - #103
Newspaper4k, um fork do popular Newspaper3k. Extração de artigos, títulos e metadados de sites de notícias.
★ 1.141+1Variação de estrelas nos últimos 7 dias - #104
Servidor de busca empresarial e de sites de código aberto e auto-hospedado, construído sobre o OpenSearch. Indexa fontes da web, arquivos, bancos de dados e nuvem, suporta mais de 20 idiomas, API REST, IA/RAG e busca semântica. Licença Apache-2.0.
★ 1.128+1Variação de estrelas nos últimos 7 dias - #105
Execute um crawler de arquivamento web baseado em navegador de alta fidelidade em um único container Docker
★ 1.127+5Variação de estrelas nos últimos 7 dias - #106★ 1.116+2Variação de estrelas nos últimos 7 dias
- #107
Escreva web scrapers em Ruby usando um DSL limpo e assistido por IA. O Kimurai usa IA para identificar onde os dados estão, faz cache dos seletores e faz o scraping com Ruby puro. Tenha a inteligência de um LLM sem a latência por requisição ou custos de tokens.
★ 1.102+0Variação de estrelas nos últimos 7 dias - #108
Scripts de web scraping em Python escaláveis para mais de 40 domínios populares
★ 1.076+4Variação de estrelas nos últimos 7 dias - #109
Remoção de marca d'água de vídeos curtos em Golang: Douyin, Pipixia, Huoshan, Weishi, Zuiyou, Kuaishou, Quanmin Xiaoshipin, Pipigaoxiao, Xigua Video, Huya, Pear Video, AcFun, Haokan Video...
★ 1.032+10Variação de estrelas nos últimos 7 dias - #110
Download de romances, web scraping, Qidian, Biquge, exportação para Markdown, exportação para txt, conversão para epub, filtragem de anúncios e correção automática
★ 1.017+8Variação de estrelas nos últimos 7 dias - #111★ 1.017+12Variação de estrelas nos últimos 7 dias
- #112
Scraper do Google Play para Python inspirado em <facundoolano/google-play-scraper>.
★ 1.010+2Variação de estrelas nos últimos 7 dias - #113★ 1.009-1Variação de estrelas nos últimos 7 dias
- #114
Um web crawler escalável, maduro e versátil baseado no Apache Storm
★ 994+1Variação de estrelas nos últimos 7 dias - #115
Lançamentos, wiki e roadmap do SpiderSuite (crawler de segurança web)
★ 974+1Variação de estrelas nos últimos 7 dias - #116★ 956+0Variação de estrelas nos últimos 7 dias
- #117
Alternativa rápida e leve ao Firecrawl/Tavily em Rust. Web scraper, crawler e API de pesquisa com servidor MCP para agentes de IA. API compatível com Firecrawl nativa (/scrape, /crawl, /search). 2,3x mais rápido que o Tavily e 1,5x mais rápido que o Firecrawl em benchmarks de 1K URLs. 6 MB de RAM, binário único. Auto-hospedado ou em nuvem gerenciada.
★ 955+87Variação de estrelas nos últimos 7 dias - #118
Ferramentas de protocolo em Python puro e notas de pesquisa para o X.com, com conjuntos de dados da conta VibeLoft no Twitter
★ 940-1Variação de estrelas nos últimos 7 dias - #119★ 933+1Variação de estrelas nos últimos 7 dias
- #120
ChatWeb pode rastrear páginas da web, ler PDF, DOCX, TXT e extrair o conteúdo principal, respondendo às suas perguntas com base nele ou resumindo os pontos-chave.
★ 916+0Variação de estrelas nos últimos 7 dias