Pular para o conteúdo principal
buildradar
Entrar
Tópico · scraping

scraping

Repositórios de código aberto acompanhados marcados com scraping, ordenados por estrelas.

100 repositórios
  • geziyor@geziyor

    Geziyor, um framework de web crawling e scraping extremamente rápido para Go. Suporta renderização JS.

    2.776+0Variação de estrelas nos últimos 7 dias
  • twscrape@vladkens

    Biblioteca Python e CLI para scraping do X/Twitter com rotação de múltiplas contas e tratamento de limite de taxa integrado.

    2.732+0Variação de estrelas nos últimos 7 dias
  • spider@spider-rs

    Obtenha dados da web para agentes de IA e LLMs

    2.687+0Variação de estrelas nos últimos 7 dias
  • brightdata-mcp@brightdata

    Um servidor poderoso de Model Context Protocol (MCP) que fornece uma solução completa para acesso público à web.

    2.624+0Variação de estrelas nos últimos 7 dias
  • BotBrowser@botswin

    Núcleo de navegador de privacidade avançado com defesa unificada contra fingerprinting: Cloudflare, Akamai, Kasada, Shape, DataDome, PerimeterX, hCaptcha, FunCaptcha, Imperva, reCAPTCHA, ThreatMetrix, Adscore

    2.601+0Variação de estrelas nos últimos 7 dias
  • fingerprint-suite@apify

    Ferramentas de impressão digital do navegador para anonimizar seus web scrapers. Desenvolvido por Apify.

    2.588+0Variação de estrelas nos últimos 7 dias
  • awesome-puppeteer@transitive-bullshit

    Uma lista curada de recursos incríveis sobre Puppeteer.

    2.575+0Variação de estrelas nos últimos 7 dias
  • shot-scraper@simonw

    Um utilitário CLI para capturar screenshots de sites, gravar demonstrações em vídeo e realizar scraping usando JavaScript.

    2.559+0Variação de estrelas nos últimos 7 dias
  • grab@lorien

    Framework de Web Scraping

    2.463+0Variação de estrelas nos últimos 7 dias
  • Cheat sheet de OSINT, lista de ferramentas, wiki, conjuntos de dados, artigos, livros, OSINT para red team e dicas de OSINT. Este repositório crescerá conforme novas pesquisas, ciência, tecnologia e tutoriais forem adicionados. Por favor, use com responsabilidade.

    2.196+0Variação de estrelas nos últimos 7 dias
  • Embed@php-embed

    Obtenha informações de qualquer serviço ou página web

    2.140+0Variação de estrelas nos últimos 7 dias
  • Navegador antidetect gratuito para Playwright: Firefox headless indetectável com fingerprint. Web scraping em Python, bypass de recaptcha e detecção de bots. Código aberto.

    1.962+0Variação de estrelas nos últimos 7 dias
  • iiab@iiab

    Internet-in-a-Box - Construa sua própria BIBLIOTECA DE ALEXANDRIA com um Raspberry Pi!

    1.948+0Variação de estrelas nos últimos 7 dias
  • Lista de ferramentas e navegadores anti-detecção e humanizadores, incluindo resolvedores de captcha e ativação de SMS.

    1.909+0Variação de estrelas nos últimos 7 dias
  • cloudproxy@claffin

    Esconda o IP dos seus scrapers atrás da nuvem. Provisione servidores proxy em diferentes provedores de nuvem para melhorar o sucesso do seu scraping.

    1.720+0Variação de estrelas nos últimos 7 dias
  • Neste tutorial, demonstramos como extrair dados públicos do Google usando Python e a API da Oxylabs.

    1.692+0Variação de estrelas nos últimos 7 dias
  • thepipe@emcf

    Obtenha dados limpos de documentos complexos, com tecnologia de modelos de visão e linguagem ⚡.

    1.524+0Variação de estrelas nos últimos 7 dias
  • agentql@tinyfish-io

    AgentQL é um conjunto de ferramentas para conectar sua IA à web. Apresenta uma linguagem de consulta e integrações com Playwright para interagir com elementos e extrair dados de forma rápida, precisa e em escala. Inclui API REST, SDKs para Python e JavaScript e depurador de navegador.

    1.454+0Variação de estrelas nos últimos 7 dias
  • rebrowser-patches@rebrowser

    Coleção de patches para puppeteer e playwright para evitar detecção de automação e vazamentos. Ajuda a evitar páginas de CAPTCHA do Cloudflare e DataDome. Fácil de aplicar/remover, pode ser ativado/desativado sob demanda.

    1.422+0Variação de estrelas nos últimos 7 dias
  • mlscraper@lorey

    🤖 Extraia dados de sites HTML automaticamente apenas fornecendo exemplos

    1.386+0Variação de estrelas nos últimos 7 dias
  • querido-diario@okfn-brasil

    Diários oficiais brasileiros acessíveis a todos.

    1.375+0Variação de estrelas nos últimos 7 dias
  • Auto-Gmail-Creator@ai-to-ai

    Bot de criação automática de contas Gmail em massa de código aberto com Selenium e Seleniumwire (Python). Sinta-se à vontade para entrar em contato comigo para Django/Flask, ML, IA, GPT, automação e scraping.

    1.371+0Variação de estrelas nos últimos 7 dias
  • parsera@raznem

    Biblioteca leve para web scraping utilizando LLMs

    1.353+0Variação de estrelas nos últimos 7 dias
  • parsel@scrapy

    O Parsel permite extrair dados de documentos XML/HTML usando XPath ou seletores CSS

    1.353+0Variação de estrelas nos últimos 7 dias
  • mov-cli@mov-cli

    Monitore tudo a partir do seu terminal.

    1.294+0Variação de estrelas nos últimos 7 dias
  • Decodo@Decodo

    Proxies residenciais rotativos HTTP(S)/SOCKS5 - exemplos de código e informações gerais.

    1.244+0Variação de estrelas nos últimos 7 dias
  • browserforge@daijro

    🎭 Gerador inteligente de cabeçalhos e impressões digitais de navegador

    1.237+0Variação de estrelas nos últimos 7 dias
  • websurfx@neon-mmd

    Uma alternativa de código aberto ao searx que oferece um meta motor de busca moderno, extremamente rápido, que respeita a privacidade e é seguro.

    1.189+0Variação de estrelas nos últimos 7 dias
  • rama@plabayo

    framework de serviço modular para mover e transformar pacotes de rede

    1.181+0Variação de estrelas nos últimos 7 dias
  • oj@online-judge-tools

    Ferramentas para diversos juízes online. Download de casos de exemplo, geração de casos de teste adicionais, teste de código e submissão.

    1.169+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos