Pular para o conteúdo principal
buildradar
Sign in
Tópico · crawler

crawler

Repositórios de código aberto acompanhados marcados com crawler, ordenados por estrelas.

153 repositórios
  • ECommerceCrawlers@DropsDevopsOrg

    Coleção prática de web scrapers para diversos sites e e-commerce, incluindo Taobao, WeChat, Dazhong Dianping, Qichacha, sites de emprego, Xianyu, Alibaba, CnBlogs, Weibo, Baidu Tieba, Douban, Baotu, Panorama, música do Douban, órgãos reguladores de medicamentos, Sohu News, coleta de texto para machine learning, ativos fofa, Autohome, NBS, contagem de palavras-chave do Baidu, diretórios de busca, Toutiao, críticas de filmes do Douban, Trip.com, Xiaomi App Store, Anjuke e Tujia.

    5.670+6Variação de estrelas nos últimos 7 dias
  • scrapy-redis@rmax

    Componentes baseados em Redis para Scrapy.

    5.643+1Variação de estrelas nos últimos 7 dias
  • browser-fingerprinting@niespodd

    Análise de sistemas de proteção contra bots com contramedidas disponíveis 🚿. Como derrotar sistemas anti-bot 👻 e contornar scripts de fingerprinting de navegador 🕵️‍♂️ ao realizar web scraping?

    5.131+5Variação de estrelas nos últimos 7 dias
  • TorBot@DedSecInside

    Ferramenta de OSINT para a Dark Web.

    4.767+47Variação de estrelas nos últimos 7 dias
  • Coleção de casos ilegais na China sobre web crawlers. Este projeto organiza notícias, dados e regulamentações legais sobre processos e violações de desenvolvedores de crawlers na China continental, visando ajudar profissionais da área a entender as leis locais e evitar riscos de conformidade de dados.

    4.724+7Variação de estrelas nos últimos 7 dias
  • weibo-crawler@dataabc

    Web crawler para o Sina Weibo, desenvolvido em Python para coletar dados, imagens e vídeos da plataforma.

    4.632+8Variação de estrelas nos últimos 7 dias
  • myGPTReader@myreader-io

    Uma forma comunitária de ler e conversar com bots de IA, utilizando o chatGPT.

    4.417-2Variação de estrelas nos últimos 7 dias
  • work_crawler@kanasimi

    Ferramenta de download de quadrinhos e romances para diversas plataformas, incluindo Tencent, U17, Migu, SF, webtoons, Niconico, ComicWalker, pixiv, Qidian, Biquge e muitas outras, com conversão para epub.

    4.203+10Variação de estrelas nos últimos 7 dias
  • ProxyBroker@constverum

    Proxy [Finder | Checker | Server]. HTTP(S) & SOCKS.

    4.156-3Variação de estrelas nos últimos 7 dias
  • DotnetSpider@dotnetcore

    DotnetSpider, uma biblioteca de web crawling padrão .NET. É um framework de web crawling e scraping de alto nível, leve, eficiente e rápido

    4.138+0Variação de estrelas nos últimos 7 dias
  • scylla@MikeChongCan

    Pool de proxies inteligente para Humanos™ extraírem conteúdo da internet e construírem seus próprios Modelos de Linguagem Grande nesta nova era de IA.

    4.020+0Variação de estrelas nos últimos 7 dias
  • puppeteer-sharp@hardkoded

    API .NET para Headless Chrome

    3.917+1Variação de estrelas nos últimos 7 dias
  • cariddi@edoardottt

    Recebe uma lista de domínios, rastreia URLs e verifica endpoints, segredos, chaves de API, extensões de arquivo, tokens e muito mais.

    3.758+5Variação de estrelas nos últimos 7 dias
  • RED_HAWK@Tuhinshubhra

    Ferramenta completa para coleta de informações, verificação de vulnerabilidades e rastreamento. Uma ferramenta indispensável para todos os testadores de penetração

    3.749+1Variação de estrelas nos últimos 7 dias
  • feapder@Boris-code

    feapder é um framework de crawler em Python fácil de usar e poderoso. Inclui quatro tipos de crawlers (AirSpider, Spider, TaskSpider, BatchSpider) para diferentes cenários, suportando retomada de pontos de interrupção, monitoramento, renderização de navegador e desduplicação de dados em massa, além do sistema de gerenciamento feaplat.

    3.732-3Variação de estrelas nos últimos 7 dias
  • mdcx@sqzw-x

    Scraper de metadados de filmes

    3.724+0Variação de estrelas nos últimos 7 dias
  • toapi@elliotgao2

    Todo site fornece APIs.

    3.555+0Variação de estrelas nos últimos 7 dias
  • crawlergo@Qianlitp

    Um poderoso crawler de navegador para scanners de vulnerabilidade web

    3.036+2Variação de estrelas nos últimos 7 dias
  • gospider@jaeles-project

    Gospider - Web spider rápido escrito em Go

    2.995+1Variação de estrelas nos últimos 7 dias
  • FinalRecon@thewhiteh4t

    Reconhecimento web tudo em um.

    2.957+4Variação de estrelas nos últimos 7 dias
  • google-play-scraper@facundoolano

    Scraper em Node.js para obter dados do Google Play.

    2.956+7Variação de estrelas nos últimos 7 dias
  • owllook@howie6879

    owllook - Motor de busca de romances

    2.875+3Variação de estrelas nos últimos 7 dias
  • DecryptLogin@CharlesPikachu

    DecryptLogin: APIs para realizar login em diversos sites usando requests.

    2.852-3Variação de estrelas nos últimos 7 dias
  • crawler@spatie

    https://spatie.be/docs/crawler

    2.829+0Variação de estrelas nos últimos 7 dias
  • geziyor@geziyor

    Geziyor, um framework de web crawling e scraping extremamente rápido para Go. Suporta renderização JS.

    2.776+1Variação de estrelas nos últimos 7 dias
  • videodl@CharlesPikachu

    Videodl: um downloader de vídeo leve escrito em Python puro, com suporte a diversas plataformas de streaming como TikTok, YouTube, Bilibili, entre outras.

    2.713+35Variação de estrelas nos últimos 7 dias
  • QueryList@jae-jae

    O framework de crawler PHP progressivo e elegante.

    2.690+0Variação de estrelas nos últimos 7 dias
  • spider@spider-rs

    Obtenha dados da web para agentes de IA e LLMs

    2.687+15Variação de estrelas nos últimos 7 dias
  • gecco@xtuhcy

    Web crawler leve e fácil de usar

    2.510+0Variação de estrelas nos últimos 7 dias
  • news-please@fhamborg

    news-please - um crawler web integrado e extrator de informações para notícias que simplesmente funciona

    2.485+2Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos