scraper
Repositórios de código aberto acompanhados marcados com scraper, ordenados por estrelas.
- #61
Newspaper4k, um fork do popular Newspaper3k. Extração de artigos, títulos e metadados de sites de notícias.
★ 1.141+1Variação de estrelas nos últimos 7 dias - #62★ 1.116+2Variação de estrelas nos últimos 7 dias
- #63
Escreva web scrapers em Ruby usando um DSL limpo e assistido por IA. O Kimurai usa IA para identificar onde os dados estão, faz cache dos seletores e faz o scraping com Ruby puro. Tenha a inteligência de um LLM sem a latência por requisição ou custos de tokens.
★ 1.102+0Variação de estrelas nos últimos 7 dias - #64
Scripts de web scraping em Python escaláveis para mais de 40 domínios populares
★ 1.077+5Variação de estrelas nos últimos 7 dias - #65★ 1.073+6Variação de estrelas nos últimos 7 dias
- #66
Universal Reddit Scraper - Uma ferramenta de linha de comando abrangente para scraping e arquivamento do Reddit.
★ 1.022+1Variação de estrelas nos últimos 7 dias - #67
Um gerenciador abrangente que gerencia recursos de computadores e oferece gamificação
★ 1.020+9Variação de estrelas nos últimos 7 dias - #68★ 1.018+13Variação de estrelas nos últimos 7 dias
- #69
Scraper do Google Play para Python inspirado em <facundoolano/google-play-scraper>.
★ 1.010+3Variação de estrelas nos últimos 7 dias - #70
A primeira ferramenta para visualizar "posts privados do Instagram" anonimamente
★ 995+14Variação de estrelas nos últimos 7 dias - #71★ 956+0Variação de estrelas nos últimos 7 dias
- #72
Busque tweets, respostas, cronogramas e artigos do X/Twitter sem login ou chaves de API — ferramenta de campo para agentes de IA.
★ 955+7Variação de estrelas nos últimos 7 dias - #73★ 884+2Variação de estrelas nos últimos 7 dias
- #74
Uma biblioteca de testes/scraping/parsing baseada em Kotlin que oferece a capacidade de analisar e extrair dados de HTML (renderizado no servidor e no cliente). Enfatiza a facilidade de uso e a legibilidade ao fornecer uma DSL intuitiva. Seu objetivo é ser uma biblioteca de testes, mas também pode ser usada para fazer scraping de sites de forma conveniente.
★ 875+0Variação de estrelas nos últimos 7 dias - #75
Ferramenta de linha de comando para baixar e extrair dados de páginas HTML/XML ou APIs JSON, usando CSS, XPath 3.0, XQuery 3.0, JSONiq ou correspondência de padrões. Também pode criar documentos XML/HTML/JSON novos ou transformados.
★ 844+1Variação de estrelas nos últimos 7 dias - #76★ 842+5Variação de estrelas nos últimos 7 dias
- #77
Um downloader de galerias de imagens e doujinshi de uso geral.
★ 841+0Variação de estrelas nos últimos 7 dias - #78
Converte alguns webnovels para o formato epub
★ 840+2Variação de estrelas nos últimos 7 dias - #79
Uma biblioteca versátil de web spidering em Ruby capaz de rastrear um site, múltiplos domínios, links específicos ou de forma infinita. O Spidr foi projetado para ser rápido e fácil de usar.
★ 836+0Variação de estrelas nos últimos 7 dias - #80★ 805+0Variação de estrelas nos últimos 7 dias
- #81
Um banco de dados aberto de dados de sanções internacionais, pessoas de interesse e pessoas politicamente expostas
★ 797+6Variação de estrelas nos últimos 7 dias - #82
Motor de scraping auto-hospedado — contorna qualquer desafio de JS e captcha: Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Alternativa ao FlareSolverr e Byparr, e substituto direto para sua stack *arr.
★ 786+46Variação de estrelas nos últimos 7 dias - #83
Scraper de perfil do LinkedIn que retorna dados estruturados do perfil em JSON.
★ 776+0Variação de estrelas nos últimos 7 dias - #84
operative framework é um framework OSINT de investigação em Rust, você pode interagir com vários alvos, executar vários módulos, criar links com o alvo, exportar relatório para arquivo PDF, adicionar notas ao alvo ou resultados, interagir com API RESTful, escrever seus próprios módulos.
★ 749-1Variação de estrelas nos últimos 7 dias - #85
Um rastreador de preços multiusuário auto-hospedado para Amazon, Aliexpress, eBay e muitos outros, juntamente com lojas personalizadas. Receba notificações quando o preço corresponder a um ou mais critérios definidos pelo usuário
★ 740+3Variação de estrelas nos últimos 7 dias - #86
Pacote Python para extração de dados de propriedades imobiliárias
★ 739+3Variação de estrelas nos últimos 7 dias - #87★ 738+1Variação de estrelas nos últimos 7 dias
- #88
Uma biblioteca Scala para extração de conteúdo de páginas HTML
★ 732+0Variação de estrelas nos últimos 7 dias - #89★ 730+0Variação de estrelas nos últimos 7 dias
- #90
Documentação da API interna do Twitter
★ 711+2Variação de estrelas nos últimos 7 dias