Pular para o conteúdo principal
buildradar
Entrar
Tópico · web-scraping

web-scraping

Repositórios de código aberto acompanhados marcados com web-scraping, ordenados por estrelas.

119 repositórios
  • wigolo@KnockOutEZ

    A web essencial para seu agente de codificação de IA — busca local-first, fetch, crawl e pesquisa via MCP. Sem chaves de API, sem nuvem, $0 por consulta. Beta público.

    4.865+0Variação de estrelas nos últimos 7 dias
  • patchright@Kaliiiiiiiiii-Vinyzu

    Versão indetectável da biblioteca de testes e automação Playwright.

    4.255+0Variação de estrelas nos últimos 7 dias
  • snoop@snooppr

    Snoop — ferramenta de reconhecimento baseada em dados abertos (mundo OSINT).

    4.015+0Variação de estrelas nos últimos 7 dias
  • design-extract@Manavarya09

    Extraia o sistema de design completo de qualquer site com um comando. Tokens DTCG, semânticos+primitivos+compostos, servidor MCP para Claude Code/Cursor/Windsurf, emissores multiplataforma (iOS SwiftUI, Android Compose, Flutter, WordPress), Tailwind v4, variáveis Figma, shadcn/ui, auditoria de saúde CSS, remediação WCAG, extensão Chrome. MIT, Playwright, Node 20+.

    4.008+0Variação de estrelas nos últimos 7 dias
  • amazon-scraper@oxylabs

    API de teste gratuito para extração de dados de busca, produtos, ofertas, avaliações, perguntas e respostas, mais vendidos e vendedores da Amazon.

    3.388+0Variação de estrelas nos últimos 7 dias
  • Coleta de dados estruturados de qualquer site usando raspador, rastreador e automação de navegador baseados em IA. Realize scraping e crawling com prompts em linguagem natural. Equipe seus agentes de LLM com dados atualizados. SDK Python do AI Studio para coleta inteligente de dados web.

    3.387+0Variação de estrelas nos últimos 7 dias
  • php-curl-class@php-curl-class

    PHP Curl Class facilita o envio de solicitações HTTP e a integração com APIs web.

    3.296+0Variação de estrelas nos últimos 7 dias
  • O processo de extração de dados de produtos da Amazon usando Python, incluindo títulos, avaliações, preços, imagens e descrições.

    3.257+0Variação de estrelas nos últimos 7 dias
  • VirtualBrowser@Virtual-Browser

    Navegador anti-impressão digital gratuito, navegador de privacidade, navegador anti-identificação, navegador anti-correlação, navegador anti-impressão digital gratuito dedicado para airdrops de Web3 https://virtualbrowser.cc/?src=github

    3.086+0Variação de estrelas nos últimos 7 dias
  • pythoncode-tutorials@x4nth055

    Tutoriais de código em Python.

    3.000+0Variação de estrelas nos últimos 7 dias
  • Aprenda passo a passo como extrair dados do Google Trends e comparar resultados usando Python e a SERP API da Oxylabs. Extraia palavras-chave, popularidade, detalhamento por região, consultas relacionadas e muito mais.

    2.909+0Variação de estrelas nos últimos 7 dias
  • twscrape@vladkens

    Biblioteca Python e CLI para scraping do X/Twitter com rotação de múltiplas contas e tratamento de limite de taxa integrado.

    2.732+0Variação de estrelas nos últimos 7 dias
  • spider@spider-rs

    Obtenha dados da web para agentes de IA e LLMs

    2.687+0Variação de estrelas nos últimos 7 dias
  • brightdata-mcp@brightdata

    Um servidor poderoso de Model Context Protocol (MCP) que fornece uma solução completa para acesso público à web.

    2.624+0Variação de estrelas nos últimos 7 dias
  • anakin@Anakin-Inc

    API de web scraping de código aberto. Transforme qualquer site em markdown limpo ou JSON estruturado. Inclui navegador anti-detecção, seleção automática de proxy e auto-hospedagem. Um comando: make up

    2.599+0Variação de estrelas nos últimos 7 dias
  • 30-Days-of-Python@codingforentrepreneurs

    Aprenda Python nos próximos 30 (ou mais) dias.

    2.511+0Variação de estrelas nos últimos 7 dias
  • grab@lorien

    Framework de Web Scraping

    2.463+0Variação de estrelas nos últimos 7 dias
  • webclaw@0xMassi

    Extração de conteúdo web rápida e local para LLMs. Faça scraping, crawl e extração de dados estruturados — tudo em Rust. CLI, API REST e servidor MCP.

    2.318+0Variação de estrelas nos últimos 7 dias
  • HeadlessX@saifyxpro

    Plataforma de automação de navegador auto-hospedada e indetectável. Alimentada pelo Camoufox (Firefox) para taxas de detecção de 0%. Construída para velocidade, privacidade e escalabilidade.

    2.279+0Variação de estrelas nos últimos 7 dias
  • Código para extrair itens mais vendidos, resultados de busca e ofertas disponíveis na Amazon usando Python e a API de E-Commerce Scraper da Oxylabs.

    2.091+0Variação de estrelas nos últimos 7 dias
  • Um guia para extrair títulos, autores e citações do Google Scholar usando Python e a API SERP Scraper da Oxylabs.

    2.059+0Variação de estrelas nos últimos 7 dias
  • RPA@A9T9

    Software de RPA de código aberto Ui.Vision com visão computacional, OCR, Anthropic Computer Use/LLM. Importação/exportação do Selenium IDE.

    2.000+0Variação de estrelas nos últimos 7 dias
  • Navegador antidetect gratuito para Playwright: Firefox headless indetectável com fingerprint. Web scraping em Python, bypass de recaptcha e detecção de bots. Código aberto.

    1.962+0Variação de estrelas nos últimos 7 dias
  • stealth-browser-mcp@vibheksoni

    A única automação de navegador que contorna sistemas anti-bot. A IA escreve hooks de rede e clona UIs com precisão de pixel via chat simples.

    1.888+0Variação de estrelas nos últimos 7 dias
  • moli@lexmount

    O melhor navegador headless para agentes de IA. Leve, rápido e de alta compatibilidade. Construído em Rust.

    1.841+204Variação de estrelas nos últimos 7 dias
  • browserless@microlinkhq

    O driver headless Chrome/Chromium sobre o Puppeteer. Tire capturas de tela, gere PDFs, extraia texto e HTML com uma API pronta para produção.

    1.833+0Variação de estrelas nos últimos 7 dias
  • creatorhub@3441293738

    Monitoramento, coleta e transferência de conteúdo multiplataforma. Um painel web para gerenciar Douyin / Xiaohongshu / Kuaishou.

    1.833+0Variação de estrelas nos últimos 7 dias
  • Aprenda a construir seu próprio scraper do Google Jobs que extrai simultaneamente resultados para múltiplas consultas e localizações geográficas usando Python e a API Google Jobs Scraper da Oxylabs.

    1.767+0Variação de estrelas nos últimos 7 dias
  • Neste tutorial, demonstramos como extrair dados públicos do Google usando Python e a API da Oxylabs.

    1.692+0Variação de estrelas nos últimos 7 dias
  • selectolax@rushter

    Binding em Python para as engines Modest e Lexbor. Um parser de HTML5 rápido com seletores CSS para Python.

    1.671+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos