crawler
Repositórios de código aberto acompanhados marcados com crawler, ordenados por estrelas.
- #61
Prompts de GPTs vazados para contornar o limite de 25 mensagens ou experimentar GPTs sem uma assinatura Plus.
★ 2.469+2Variação de estrelas nos últimos 7 dias - #62★ 2.463+0Variação de estrelas nos últimos 7 dias
- #63
CrawlerDetect é uma classe PHP para detectar bots/crawlers/spiders através do user agent
★ 2.403+3Variação de estrelas nos últimos 7 dias - #64
Framework de web crawler em C# multiplataforma, construído para velocidade e flexibilidade.
★ 2.310+0Variação de estrelas nos últimos 7 dias - #65
Clonador de sites - Utiliza poderosas Go routines para clonar sites para o seu computador em segundos.
★ 2.239+7Variação de estrelas nos últimos 7 dias - #66
🏳️🌈 Downloader de mídia para diversos sites, incluindo Twitter, Reddit, Instagram, BlueSky, TikTok, Threads, Facebook, OnlyFans, YouTube, Pinterest, PornHub, XHamster, XVIDEOS, ThisVid, entre outros.
★ 2.161+7Variação de estrelas nos últimos 7 dias - #67
Transforme conteúdo da web em dados prontos para LLM
★ 2.158+148Variação de estrelas nos últimos 7 dias - #68
LanTian Collector é um sistema de web scraping open source gratuito. Permite coletar dados apenas clicando e editando regras, podendo ser executado localmente, em hospedagem virtual ou servidores em nuvem. Suporta quase todos os tipos de páginas, integra-se perfeitamente a diversos CMS, publica dados em tempo real sem necessidade de login e opera de forma totalmente automática.
★ 2.088-1Variação de estrelas nos últimos 7 dias - #69★ 2.019+0Variação de estrelas nos últimos 7 dias
- #70
Coleção de casos de web scraping. Inclui, mas não se limita a Taobao, JD.com, Tmall, Douban, Douyin, Kuaishou, Weibo, WeChat, Alibaba, Toutiao, PDD, Youku, iQiyi, Ctrip, 12306, 58, Sohu, vários índices, VIP, Wanfang, Z-Library, Oalib, romances, sites de licitação, sites de compras, Xiaohongshu, Dianping, Twitter, Maimai, Zhihu.
★ 1.967+0Variação de estrelas nos últimos 7 dias - #71
Navegador antidetect gratuito para Playwright: Firefox headless indetectável com fingerprint. Web scraping em Python, bypass de recaptcha e detecção de bots. Código aberto.
★ 1.962+21Variação de estrelas nos últimos 7 dias - #72
Biblioteca principal do NewPipe para extração de dados de sites de streaming
★ 1.960+5Variação de estrelas nos últimos 7 dias - #73
Solução de exploração de memória do navegador (em fase de exploração...)
★ 1.912+0Variação de estrelas nos últimos 7 dias - #74★ 1.891+4Variação de estrelas nos últimos 7 dias
- #75★ 1.879+2Variação de estrelas nos últimos 7 dias
- #76
Monitoramento, coleta e transferência de conteúdo multiplataforma. Um painel web para gerenciar Douyin / Xiaohongshu / Kuaishou.
★ 1.833+115Variação de estrelas nos últimos 7 dias - #77
Diskover Community Edition - Indexador de arquivos, motor de busca, gerenciamento de dados e análise de código aberto alimentado pelo Elasticsearch.
★ 1.816-2Variação de estrelas nos últimos 7 dias - #78
Web crawler de imagens multiprocessado para Google e Naver (Selenium)
★ 1.692+1Variação de estrelas nos últimos 7 dias - #79
Binding em Python para as engines Modest e Lexbor. Um parser de HTML5 rápido com seletores CSS para Python.
★ 1.671+6Variação de estrelas nos últimos 7 dias - #80
Web scrapers em Python: músicas do NetEase Cloud Music, vídeos do Bilibili, perguntas e respostas do Zhihu, papéis de parede, vídeos do xvideos, audiolivros, Weibo, dados do Anjuke com visualização, extrator de capas de vídeo do Bilibili, pool de proxies IP, análise de dados de usuários do Zhihu e scrapers de usuários do GitHub.
★ 1.649+3Variação de estrelas nos últimos 7 dias - #81
Web crawler para arquivistas: saída em formato WARC, painel para todos os crawls e padrões de ignorar dinâmicos
★ 1.609+2Variação de estrelas nos últimos 7 dias - #82
Web scraper para Douyin: coleta dados públicos como perfis, curtidas, favoritos, áudios originais, tópicos, buscas, coleções, publicações, seguidores e seguidos.
★ 1.605+3Variação de estrelas nos últimos 7 dias - #83
ScopeSentry: mapeamento de ciberespaço, enumeração de subdomínios, varredura de portas, descoberta de informações sensíveis, varredura de vulnerabilidades e nós distribuídos
★ 1.601+14Variação de estrelas nos últimos 7 dias - #84
Ferramenta CLI para salvar uma cópia fiel de uma página da web completa em um único arquivo HTML (com base no SingleFile)
★ 1.579+14Variação de estrelas nos últimos 7 dias - #85
❤️ Fredy - [F]ind [R]eal [E]state [D]amn Eas[y] - O Fredy continua procurando novos apartamentos e casas na Europa em plataformas como ImmoScout24, Immowelt, eBay Kleinanzeigen e entrega os resultados instantaneamente para você via Slack, Telegram, E-mail, Discord ou ntfy, para que você possa se concentrar nas coisas mais importantes da vida ;)
★ 1.462+18Variação de estrelas nos últimos 7 dias - #86★ 1.451+1Variação de estrelas nos últimos 7 dias
- #87
Um cliente HTTP Python ergonômico e focado em privacidade.
★ 1.438+6Variação de estrelas nos últimos 7 dias - #88
Ferramenta de coleta de dados do Xiaohongshu e download em lote de imagens e vídeos de sites, com interface visual atraente (download em lote, extração de vídeo, imagens)
★ 1.436+2Variação de estrelas nos últimos 7 dias - #89
Coleção de patches para puppeteer e playwright para evitar detecção de automação e vazamentos. Ajuda a evitar páginas de CAPTCHA do Cloudflare e DataDome. Fácil de aplicar/remover, pode ser ativado/desativado sob demanda.
★ 1.422-2Variação de estrelas nos últimos 7 dias - #90★ 1.417+0Variação de estrelas nos últimos 7 dias