web-scraping
Repositórios de código aberto acompanhados marcados com web-scraping, ordenados por estrelas.
- #31
A web essencial para seu agente de codificação de IA — busca local-first, fetch, crawl e pesquisa via MCP. Sem chaves de API, sem nuvem, $0 por consulta. Beta público.
★ 4.865+0Variação de estrelas nos últimos 7 dias - #32
Versão indetectável da biblioteca de testes e automação Playwright.
★ 4.255+0Variação de estrelas nos últimos 7 dias - #33★ 4.015+0Variação de estrelas nos últimos 7 dias
- #34
Extraia o sistema de design completo de qualquer site com um comando. Tokens DTCG, semânticos+primitivos+compostos, servidor MCP para Claude Code/Cursor/Windsurf, emissores multiplataforma (iOS SwiftUI, Android Compose, Flutter, WordPress), Tailwind v4, variáveis Figma, shadcn/ui, auditoria de saúde CSS, remediação WCAG, extensão Chrome. MIT, Playwright, Node 20+.
★ 4.008+0Variação de estrelas nos últimos 7 dias - #35
API de teste gratuito para extração de dados de busca, produtos, ofertas, avaliações, perguntas e respostas, mais vendidos e vendedores da Amazon.
★ 3.388+0Variação de estrelas nos últimos 7 dias - #36
Coleta de dados estruturados de qualquer site usando raspador, rastreador e automação de navegador baseados em IA. Realize scraping e crawling com prompts em linguagem natural. Equipe seus agentes de LLM com dados atualizados. SDK Python do AI Studio para coleta inteligente de dados web.
★ 3.387+0Variação de estrelas nos últimos 7 dias - #37
PHP Curl Class facilita o envio de solicitações HTTP e a integração com APIs web.
★ 3.296+0Variação de estrelas nos últimos 7 dias - #38
O processo de extração de dados de produtos da Amazon usando Python, incluindo títulos, avaliações, preços, imagens e descrições.
★ 3.257+0Variação de estrelas nos últimos 7 dias - #39
Navegador anti-impressão digital gratuito, navegador de privacidade, navegador anti-identificação, navegador anti-correlação, navegador anti-impressão digital gratuito dedicado para airdrops de Web3 https://virtualbrowser.cc/?src=github
★ 3.086+0Variação de estrelas nos últimos 7 dias - #40
Tutoriais de código em Python.
★ 3.000+0Variação de estrelas nos últimos 7 dias - #41
Aprenda passo a passo como extrair dados do Google Trends e comparar resultados usando Python e a SERP API da Oxylabs. Extraia palavras-chave, popularidade, detalhamento por região, consultas relacionadas e muito mais.
★ 2.909+0Variação de estrelas nos últimos 7 dias - #42
Biblioteca Python e CLI para scraping do X/Twitter com rotação de múltiplas contas e tratamento de limite de taxa integrado.
★ 2.732+0Variação de estrelas nos últimos 7 dias - #43★ 2.687+0Variação de estrelas nos últimos 7 dias
- #44
Um servidor poderoso de Model Context Protocol (MCP) que fornece uma solução completa para acesso público à web.
★ 2.624+0Variação de estrelas nos últimos 7 dias - #45
API de web scraping de código aberto. Transforme qualquer site em markdown limpo ou JSON estruturado. Inclui navegador anti-detecção, seleção automática de proxy e auto-hospedagem. Um comando: make up
★ 2.599+0Variação de estrelas nos últimos 7 dias - #46
Aprenda Python nos próximos 30 (ou mais) dias.
★ 2.511+0Variação de estrelas nos últimos 7 dias - #47★ 2.463+0Variação de estrelas nos últimos 7 dias
- #48
Extração de conteúdo web rápida e local para LLMs. Faça scraping, crawl e extração de dados estruturados — tudo em Rust. CLI, API REST e servidor MCP.
★ 2.318+0Variação de estrelas nos últimos 7 dias - #49
Plataforma de automação de navegador auto-hospedada e indetectável. Alimentada pelo Camoufox (Firefox) para taxas de detecção de 0%. Construída para velocidade, privacidade e escalabilidade.
★ 2.279+0Variação de estrelas nos últimos 7 dias - #50
Código para extrair itens mais vendidos, resultados de busca e ofertas disponíveis na Amazon usando Python e a API de E-Commerce Scraper da Oxylabs.
★ 2.091+0Variação de estrelas nos últimos 7 dias - #51
Um guia para extrair títulos, autores e citações do Google Scholar usando Python e a API SERP Scraper da Oxylabs.
★ 2.059+0Variação de estrelas nos últimos 7 dias - #52
Software de RPA de código aberto Ui.Vision com visão computacional, OCR, Anthropic Computer Use/LLM. Importação/exportação do Selenium IDE.
★ 2.000+0Variação de estrelas nos últimos 7 dias - #53
Navegador antidetect gratuito para Playwright: Firefox headless indetectável com fingerprint. Web scraping em Python, bypass de recaptcha e detecção de bots. Código aberto.
★ 1.962+0Variação de estrelas nos últimos 7 dias - #54
A única automação de navegador que contorna sistemas anti-bot. A IA escreve hooks de rede e clona UIs com precisão de pixel via chat simples.
★ 1.888+0Variação de estrelas nos últimos 7 dias - #55
O melhor navegador headless para agentes de IA. Leve, rápido e de alta compatibilidade. Construído em Rust.
★ 1.841+204Variação de estrelas nos últimos 7 dias - #56
O driver headless Chrome/Chromium sobre o Puppeteer. Tire capturas de tela, gere PDFs, extraia texto e HTML com uma API pronta para produção.
★ 1.833+0Variação de estrelas nos últimos 7 dias - #57
Monitoramento, coleta e transferência de conteúdo multiplataforma. Um painel web para gerenciar Douyin / Xiaohongshu / Kuaishou.
★ 1.833+0Variação de estrelas nos últimos 7 dias - #58
Aprenda a construir seu próprio scraper do Google Jobs que extrai simultaneamente resultados para múltiplas consultas e localizações geográficas usando Python e a API Google Jobs Scraper da Oxylabs.
★ 1.767+0Variação de estrelas nos últimos 7 dias - #59
Neste tutorial, demonstramos como extrair dados públicos do Google usando Python e a API da Oxylabs.
★ 1.692+0Variação de estrelas nos últimos 7 dias - #60
Binding em Python para as engines Modest e Lexbor. Um parser de HTML5 rápido com seletores CSS para Python.
★ 1.671+0Variação de estrelas nos últimos 7 dias