Pular para o conteúdo principal
buildradar
Sign in
Tópico · crawler

crawler

Repositórios de código aberto acompanhados marcados com crawler, ordenados por estrelas.

153 repositórios
  • Leaked-GPTs@friuns2

    Prompts de GPTs vazados para contornar o limite de 25 mensagens ou experimentar GPTs sem uma assinatura Plus.

    2.469+2Variação de estrelas nos últimos 7 dias
  • grab@lorien

    Framework de Web Scraping

    2.463+0Variação de estrelas nos últimos 7 dias
  • Crawler-Detect@JayBizzle

    CrawlerDetect é uma classe PHP para detectar bots/crawlers/spiders através do user agent

    2.403+3Variação de estrelas nos últimos 7 dias
  • abot@sjdirect

    Framework de web crawler em C# multiplataforma, construído para velocidade e flexibilidade.

    2.310+0Variação de estrelas nos últimos 7 dias
  • goclone@goclone-dev

    Clonador de sites - Utiliza poderosas Go routines para clonar sites para o seu computador em segundos.

    2.239+7Variação de estrelas nos últimos 7 dias
  • SCrawler@AAndyProgram

    🏳️‍🌈 Downloader de mídia para diversos sites, incluindo Twitter, Reddit, Instagram, BlueSky, TikTok, Threads, Facebook, OnlyFans, YouTube, Pinterest, PornHub, XHamster, XVIDEOS, ThisVid, entre outros.

    2.161+7Variação de estrelas nos últimos 7 dias
  • WaterCrawl@watercrawl

    Transforme conteúdo da web em dados prontos para LLM

    2.158+148Variação de estrelas nos últimos 7 dias
  • skycaiji@zorlan

    LanTian Collector é um sistema de web scraping open source gratuito. Permite coletar dados apenas clicando e editando regras, podendo ser executado localmente, em hospedagem virtual ou servidores em nuvem. Suporta quase todos os tipos de páginas, integra-se perfeitamente a diversos CMS, publica dados em tempo real sem necessidade de login e opera de forma totalmente automática.

    2.088-1Variação de estrelas nos últimos 7 dias
  • gain@elliotgao2

    Framework de web crawling baseado em asyncio.

    2.019+0Variação de estrelas nos últimos 7 dias
  • lxSpider@lixi5338619

    Coleção de casos de web scraping. Inclui, mas não se limita a Taobao, JD.com, Tmall, Douban, Douyin, Kuaishou, Weibo, WeChat, Alibaba, Toutiao, PDD, Youku, iQiyi, Ctrip, 12306, 58, Sohu, vários índices, VIP, Wanfang, Z-Library, Oalib, romances, sites de licitação, sites de compras, Xiaohongshu, Dianping, Twitter, Maimai, Zhihu.

    1.967+0Variação de estrelas nos últimos 7 dias
  • Navegador antidetect gratuito para Playwright: Firefox headless indetectável com fingerprint. Web scraping em Python, bypass de recaptcha e detecção de bots. Código aberto.

    1.962+21Variação de estrelas nos últimos 7 dias
  • NewPipeExtractor@TeamNewPipe

    Biblioteca principal do NewPipe para extração de dados de sites de streaming

    1.960+5Variação de estrelas nos últimos 7 dias
  • ast-hook-for-js-RE@JSREI

    Solução de exploração de memória do navegador (em fase de exploração...)

    1.912+0Variação de estrelas nos últimos 7 dias
  • Introdução ao site de links magnéticos U3C3 e atualização de domínio

    1.891+4Variação de estrelas nos últimos 7 dias
  • x-crawl@coder-hxl

    Biblioteca flexível de crawler assistido por IA em Node.js

    1.879+2Variação de estrelas nos últimos 7 dias
  • creatorhub@3441293738

    Monitoramento, coleta e transferência de conteúdo multiplataforma. Um painel web para gerenciar Douyin / Xiaohongshu / Kuaishou.

    1.833+115Variação de estrelas nos últimos 7 dias
  • diskover-community@diskoverdata

    Diskover Community Edition - Indexador de arquivos, motor de busca, gerenciamento de dados e análise de código aberto alimentado pelo Elasticsearch.

    1.816-2Variação de estrelas nos últimos 7 dias
  • AutoCrawler@YoongiKim

    Web crawler de imagens multiprocessado para Google e Naver (Selenium)

    1.692+1Variação de estrelas nos últimos 7 dias
  • selectolax@rushter

    Binding em Python para as engines Modest e Lexbor. Um parser de HTML5 rápido com seletores CSS para Python.

    1.671+6Variação de estrelas nos últimos 7 dias
  • spider_collection@srx-2000

    Web scrapers em Python: músicas do NetEase Cloud Music, vídeos do Bilibili, perguntas e respostas do Zhihu, papéis de parede, vídeos do xvideos, audiolivros, Weibo, dados do Anjuke com visualização, extrator de capas de vídeo do Bilibili, pool de proxies IP, análise de dados de usuários do Zhihu e scrapers de usuários do GitHub.

    1.649+3Variação de estrelas nos últimos 7 dias
  • grab-site@ArchiveTeam

    Web crawler para arquivistas: saída em formato WARC, painel para todos os crawls e padrões de ignorar dinâmicos

    1.609+2Variação de estrelas nos últimos 7 dias
  • douyin@erma0

    Web scraper para Douyin: coleta dados públicos como perfis, curtidas, favoritos, áudios originais, tópicos, buscas, coleções, publicações, seguidores e seguidos.

    1.605+3Variação de estrelas nos últimos 7 dias
  • ScopeSentry@Autumn-27

    ScopeSentry: mapeamento de ciberespaço, enumeração de subdomínios, varredura de portas, descoberta de informações sensíveis, varredura de vulnerabilidades e nós distribuídos

    1.601+14Variação de estrelas nos últimos 7 dias
  • single-file-cli@gildas-lormeau

    Ferramenta CLI para salvar uma cópia fiel de uma página da web completa em um único arquivo HTML (com base no SingleFile)

    1.579+14Variação de estrelas nos últimos 7 dias
  • fredy@orangecoding

    ❤️ Fredy - [F]ind [R]eal [E]state [D]amn Eas[y] - O Fredy continua procurando novos apartamentos e casas na Europa em plataformas como ImmoScout24, Immowelt, eBay Kleinanzeigen e entrega os resultados instantaneamente para você via Slack, Telegram, E-mail, Discord ou ntfy, para que você possa se concentrar nas coisas mais importantes da vida ;)

    1.462+18Variação de estrelas nos últimos 7 dias
  • fscrawler@dadoonet

    Elasticsearch File System Crawler (FS Crawler)

    1.451+1Variação de estrelas nos últimos 7 dias
  • wreq-python@0x676e67

    Um cliente HTTP Python ergonômico e focado em privacidade.

    1.438+6Variação de estrelas nos últimos 7 dias
  • Ferramenta de coleta de dados do Xiaohongshu e download em lote de imagens e vídeos de sites, com interface visual atraente (download em lote, extração de vídeo, imagens)

    1.436+2Variação de estrelas nos últimos 7 dias
  • rebrowser-patches@rebrowser

    Coleção de patches para puppeteer e playwright para evitar detecção de automação e vazamentos. Ajuda a evitar páginas de CAPTCHA do Cloudflare e DataDome. Fácil de aplicar/remover, pode ser ativado/desativado sob demanda.

    1.422-2Variação de estrelas nos últimos 7 dias
  • OpenWPM@openwpm

    Uma estrutura de medição de privacidade na web.

    1.417+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos