scraping
Repositórios de código aberto acompanhados marcados com scraping, ordenados por estrelas.
- #61
Um fork totalmente reformulado e redesignado, reimaginado do zero com base no onlyfans-scraper original
★ 1.153+0Variação de estrelas nos últimos 7 dias - #62
Newspaper4k, um fork do popular Newspaper3k. Extração de artigos, títulos e metadados de sites de notícias.
★ 1.141+0Variação de estrelas nos últimos 7 dias - #63
O agente que transforma sites em APIs!
★ 1.121+2Variação de estrelas nos últimos 7 dias - #64★ 1.116+0Variação de estrelas nos últimos 7 dias
- #65
Arquive automaticamente links de vídeos, imagens e conteúdo de redes sociais a partir do Google Sheets (e mais).
★ 1.113+1Variação de estrelas nos últimos 7 dias - #66
⛏️ O motor de extração por trás do Maigret: transforme qualquer URL de perfil em um registro OSINT estruturado em mais de 150 sites
★ 1.082+5Variação de estrelas nos últimos 7 dias - #67
Scripts de web scraping em Python escaláveis para mais de 40 domínios populares
★ 1.078+5Variação de estrelas nos últimos 7 dias - #68
🧹 Pacote Python para limpeza de texto
★ 1.028+0Variação de estrelas nos últimos 7 dias - #69★ 1.022+0Variação de estrelas nos últimos 7 dias
- #70
Colete respostas estruturadas de um raspador do ChatGPT enviando um prompt com credenciais válidas da API de raspagem do ChatGPT. Ative pesquisa ao vivo, injete contexto HTML e automatize fluxos de trabalho inteligentes de raspagem do ChatGPT em poucos parâmetros.
★ 942+153Variação de estrelas nos últimos 7 dias - #71
Ferramenta em Python para transformar páginas do Notion.so em sites estáticos leves e personalizáveis
★ 857+0Variação de estrelas nos últimos 7 dias - #72
Um conjunto de ferramentas CLI para gerar automaticamente o sumário para arquivos PDF.
★ 848+0Variação de estrelas nos últimos 7 dias - #73
Código de tutorial de web scraping em Python simples, porém útil.
★ 820+0Variação de estrelas nos últimos 7 dias - #74
Motor de scraping auto-hospedado — contorna qualquer desafio de JS e captcha: Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Alternativa ao FlareSolverr e Byparr, e substituto direto para sua stack *arr.
★ 793+26Variação de estrelas nos últimos 7 dias - #75
Scraper de perfil do LinkedIn que retorna dados estruturados do perfil em JSON.
★ 776+0Variação de estrelas nos últimos 7 dias - #76
Lookyloo é uma interface web que permite aos usuários capturar uma página da web e exibir uma árvore de domínios que chamam uns aos outros.
★ 774+1Variação de estrelas nos últimos 7 dias - #77
😈📚 Uma biblioteca com curadoria de artigos de pesquisa e apresentações para entusiastas de contra-detecção e privacidade na web.
★ 771+2Variação de estrelas nos últimos 7 dias - #78
Pacote Python pip para resultados de pesquisa do Google via SERP API
★ 755+2Variação de estrelas nos últimos 7 dias - #79
Um mecanismo de rotação de proxy de alto desempenho com gerenciamento automatizado de IP e monitoramento de integridade em tempo real.
★ 748+5Variação de estrelas nos últimos 7 dias - #80
Pacote Python para extração de dados de propriedades imobiliárias
★ 739+2Variação de estrelas nos últimos 7 dias - #81
Comic-dl é uma ferramenta de linha de comando para baixar mangás e quadrinhos de vários sites. Sites suportados: readcomiconline.to, mangafox.me, comic naver e muitos outros.
★ 676+2Variação de estrelas nos últimos 7 dias - #82
:card_index: Extraia perfis de redes sociais e mais com expressões regulares
★ 656+0Variação de estrelas nos últimos 7 dias - #83
Mergulhe no web scraping e construa um rastreador de preços de e-commerce com Next.js 13 em um único vídeo que ensina extração de dados, cron jobs, envio de e-mails, implantação e muito mais.
★ 636+1Variação de estrelas nos últimos 7 dias - #84
Colaboração em sandbox para equipes multiagentes: um fórum de mensagens baseado em Git, onde cada agente é isolado em sua própria sandbox descartável. Transforme um repositório Git em um fórum de mensagens seguro para agentes de IA.
★ 633+22Variação de estrelas nos últimos 7 dias - #85
Uma API para extrair metadados de sites de tribunais americanos.
★ 631+3Variação de estrelas nos últimos 7 dias - #86
Kemono Pawchive Downloader é um aplicativo rápido em PyQt5 para arquivar conteúdo de diversos sites, incluindo Kemono, Coomer, Bunkr, Erome, Saint2.su, nhentai e Discord. Possui navegador de criadores, verificador de atualizações e suporte a downloads multi-thread e multi-parte, com recursos de pausa, retomada e recuperação de sessões.
★ 630+10Variação de estrelas nos últimos 7 dias - #87
A demo mais simples de automação do Chrome usando Python e Selenium no AWS Lambda
★ 618+0Variação de estrelas nos últimos 7 dias - #88
Esta aplicação em Python é uma ferramenta de OSINT (Inteligência de Fontes Abertas) chamada "Ominis OSINT - Web Hunter". Ela realiza coleta de informações online consultando o Google por resultados de pesquisa relacionados a uma consulta inserida pelo usuário. A ferramenta extrai informações relevantes, como títulos, URLs e menções potenciais da consulta nos resultados.
★ 614+2Variação de estrelas nos últimos 7 dias - #89
Script em Python 3 para extrair/coletar funcionários de empresas da API do LinkedIn
★ 611+0Variação de estrelas nos últimos 7 dias - #90
Scraper universal do Reddit - Funciona em qualquer Subreddit ou Usuário
★ 597+4Variação de estrelas nos últimos 7 dias