Pular para o conteúdo principal
buildradar
Sign in
Tópico · scraper

scraper

Repositórios de código aberto acompanhados marcados com scraper, ordenados por estrelas.

114 repositórios
  • newspaper4k@AndyTheFactory

    Newspaper4k, um fork do popular Newspaper3k. Extração de artigos, títulos e metadados de sites de notícias.

    1.141+1Variação de estrelas nos últimos 7 dias
  • crawly@elixir-crawly

    Crawly, um framework de alto nível para web crawling e scraping em Elixir.

    1.116+2Variação de estrelas nos últimos 7 dias
  • kimuraframework@vifreefly

    Escreva web scrapers em Ruby usando um DSL limpo e assistido por IA. O Kimurai usa IA para identificar onde os dados estão, faz cache dos seletores e faz o scraping com Ruby puro. Tenha a inteligência de um LLM sem a latência por requisição ou custos de tokens.

    1.102+0Variação de estrelas nos últimos 7 dias
  • scrapfly-scrapers@scrapfly

    Scripts de web scraping em Python escaláveis para mais de 40 domínios populares

    1.077+5Variação de estrelas nos últimos 7 dias
  • jikan@jikan-me

    API REST PHP não oficial do MyAnimeList que fornece funções além da API oficial

    1.073+6Variação de estrelas nos últimos 7 dias
  • URS@JosephLai241

    Universal Reddit Scraper - Uma ferramenta de linha de comando abrangente para scraping e arquivamento do Reddit.

    1.022+1Variação de estrelas nos últimos 7 dias
  • GreenResourcesManager@klsdf

    Um gerenciador abrangente que gerencia recursos de computadores e oferece gamificação

    1.020+9Variação de estrelas nos últimos 7 dias
  • wreq@0x676e67

    Um cliente HTTP em Rust ergonômico e com foco em privacidade

    1.018+13Variação de estrelas nos últimos 7 dias
  • google-play-scraper@JoMingyu

    Scraper do Google Play para Python inspirado em <facundoolano/google-play-scraper>.

    1.010+3Variação de estrelas nos últimos 7 dias
  • A primeira ferramenta para visualizar "posts privados do Instagram" anonimamente

    995+14Variação de estrelas nos últimos 7 dias
  • crawler@fredwu

    Um web crawler / scraper de alto desempenho em Elixir.

    956+0Variação de estrelas nos últimos 7 dias
  • x-tweet-fetcher@ythx-101

    Busque tweets, respostas, cronogramas e artigos do X/Twitter sem login ou chaves de API — ferramenta de campo para agentes de IA.

    955+7Variação de estrelas nos últimos 7 dias
  • scrapyrt@scrapinghub

    API HTTP para spiders do Scrapy

    884+2Variação de estrelas nos últimos 7 dias
  • skrape.it@skrapeit

    Uma biblioteca de testes/scraping/parsing baseada em Kotlin que oferece a capacidade de analisar e extrair dados de HTML (renderizado no servidor e no cliente). Enfatiza a facilidade de uso e a legibilidade ao fornecer uma DSL intuitiva. Seu objetivo é ser uma biblioteca de testes, mas também pode ser usada para fazer scraping de sites de forma conveniente.

    875+0Variação de estrelas nos últimos 7 dias
  • xidel@benibela

    Ferramenta de linha de comando para baixar e extrair dados de páginas HTML/XML ou APIs JSON, usando CSS, XPath 3.0, XQuery 3.0, JSONiq ou correspondência de padrões. Também pode criar documentos XML/HTML/JSON novos ou transformados.

    844+1Variação de estrelas nos últimos 7 dias
  • zimit@openzim

    Crie um arquivo ZIM a partir de qualquer site e navegue offline!

    842+5Variação de estrelas nos últimos 7 dias
  • HDoujinDownloader@HDoujinDownloader

    Um downloader de galerias de imagens e doujinshi de uso geral.

    841+0Variação de estrelas nos últimos 7 dias
  • epublifier@maoserr

    Converte alguns webnovels para o formato epub

    840+2Variação de estrelas nos últimos 7 dias
  • spidr@postmodern

    Uma biblioteca versátil de web spidering em Ruby capaz de rastrear um site, múltiplos domínios, links específicos ou de forma infinita. O Spidr foi projetado para ser rápido e fácil de usar.

    836+0Variação de estrelas nos últimos 7 dias
  • jvppeteer@fanyong920

    API Java para Chrome e Firefox

    805+0Variação de estrelas nos últimos 7 dias
  • opensanctions@opensanctions

    Um banco de dados aberto de dados de sanções internacionais, pessoas de interesse e pessoas politicamente expostas

    797+6Variação de estrelas nos últimos 7 dias
  • trawl@germondai

    Motor de scraping auto-hospedado — contorna qualquer desafio de JS e captcha: Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Alternativa ao FlareSolverr e Byparr, e substituto direto para sua stack *arr.

    786+46Variação de estrelas nos últimos 7 dias
  • linkedin-profile-scraper-api@josephlimtech

    Scraper de perfil do LinkedIn que retorna dados estruturados do perfil em JSON.

    776+0Variação de estrelas nos últimos 7 dias
  • operative framework é um framework OSINT de investigação em Rust, você pode interagir com vários alvos, executar vários módulos, criar links com o alvo, exportar relatório para arquivo PDF, adicionar notas ao alvo ou resultados, interagir com API RESTful, escrever seus próprios módulos.

    749-1Variação de estrelas nos últimos 7 dias
  • Discount-Bandit@Cybrarist

    Um rastreador de preços multiusuário auto-hospedado para Amazon, Aliexpress, eBay e muitos outros, juntamente com lojas personalizadas. Receba notificações quando o preço corresponder a um ou mais critérios definidos pelo usuário

    740+3Variação de estrelas nos últimos 7 dias
  • HomeHarvest@ZacharyHampton

    Pacote Python para extração de dados de propriedades imobiliárias

    739+3Variação de estrelas nos últimos 7 dias
  • slash@theahmadov

    A ferramenta Slash OSINT

    738+1Variação de estrelas nos últimos 7 dias
  • scala-scraper@ruippeixotog

    Uma biblioteca Scala para extração de conteúdo de páginas HTML

    732+0Variação de estrelas nos últimos 7 dias
  • scrapers@cassidoo

    Uma lista de scrapers da web.

    730+0Variação de estrelas nos últimos 7 dias
  • Documentação da API interna do Twitter

    711+2Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos