Pular para o conteúdo principal
buildradar
Entrar
Tópico · scraping

scraping

Repositórios de código aberto acompanhados marcados com scraping, ordenados por estrelas.

100 repositórios
  • OF-Scraper@datawhores

    Um fork totalmente reformulado e redesignado, reimaginado do zero com base no onlyfans-scraper original

    1.153+0Variação de estrelas nos últimos 7 dias
  • newspaper4k@AndyTheFactory

    Newspaper4k, um fork do popular Newspaper3k. Extração de artigos, títulos e metadados de sites de notícias.

    1.141+0Variação de estrelas nos últimos 7 dias
  • reverse-api-engineer@nottelabs

    O agente que transforma sites em APIs!

    1.121+2Variação de estrelas nos últimos 7 dias
  • crawly@elixir-crawly

    Crawly, um framework de alto nível para web crawling e scraping em Elixir.

    1.116+0Variação de estrelas nos últimos 7 dias
  • auto-archiver@bellingcat

    Arquive automaticamente links de vídeos, imagens e conteúdo de redes sociais a partir do Google Sheets (e mais).

    1.113+1Variação de estrelas nos últimos 7 dias
  • socid-extractor@soxoj

    ⛏️ O motor de extração por trás do Maigret: transforme qualquer URL de perfil em um registro OSINT estruturado em mais de 150 sites

    1.082+5Variação de estrelas nos últimos 7 dias
  • scrapfly-scrapers@scrapfly

    Scripts de web scraping em Python escaláveis para mais de 40 domínios populares

    1.078+5Variação de estrelas nos últimos 7 dias
  • clean-text@jfilter

    🧹 Pacote Python para limpeza de texto

    1.028+0Variação de estrelas nos últimos 7 dias
  • hrequests@daijro

    🚀 Web scraping para humanos

    1.022+0Variação de estrelas nos últimos 7 dias
  • Colete respostas estruturadas de um raspador do ChatGPT enviando um prompt com credenciais válidas da API de raspagem do ChatGPT. Ative pesquisa ao vivo, injete contexto HTML e automatize fluxos de trabalho inteligentes de raspagem do ChatGPT em poucos parâmetros.

    942+153Variação de estrelas nos últimos 7 dias
  • loconotion@leoncvlt

    Ferramenta em Python para transformar páginas do Notion.so em sites estáticos leves e personalizáveis

    857+0Variação de estrelas nos últimos 7 dias
  • pdf.tocgen@Krasjet

    Um conjunto de ferramentas CLI para gerar automaticamente o sumário para arquivos PDF.

    848+0Variação de estrelas nos últimos 7 dias
  • easy-scraping-tutorial@MorvanZhou

    Código de tutorial de web scraping em Python simples, porém útil.

    820+0Variação de estrelas nos últimos 7 dias
  • trawl@germondai

    Motor de scraping auto-hospedado — contorna qualquer desafio de JS e captcha: Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Alternativa ao FlareSolverr e Byparr, e substituto direto para sua stack *arr.

    793+26Variação de estrelas nos últimos 7 dias
  • linkedin-profile-scraper-api@josephlimtech

    Scraper de perfil do LinkedIn que retorna dados estruturados do perfil em JSON.

    776+0Variação de estrelas nos últimos 7 dias
  • lookyloo@Lookyloo

    Lookyloo é uma interface web que permite aos usuários capturar uma página da web e exibir uma árvore de domínios que chamam uns aos outros.

    774+1Variação de estrelas nos últimos 7 dias
  • dark-knowledge@prescience-data

    😈📚 Uma biblioteca com curadoria de artigos de pesquisa e apresentações para entusiastas de contra-detecção e privacidade na web.

    771+2Variação de estrelas nos últimos 7 dias
  • Pacote Python pip para resultados de pesquisa do Google via SERP API

    755+2Variação de estrelas nos últimos 7 dias
  • rota@alpkeskin

    Um mecanismo de rotação de proxy de alto desempenho com gerenciamento automatizado de IP e monitoramento de integridade em tempo real.

    748+5Variação de estrelas nos últimos 7 dias
  • HomeHarvest@ZacharyHampton

    Pacote Python para extração de dados de propriedades imobiliárias

    739+2Variação de estrelas nos últimos 7 dias
  • comic-dl@Xonshiz

    Comic-dl é uma ferramenta de linha de comando para baixar mangás e quadrinhos de vários sites. Sites suportados: readcomiconline.to, mangafox.me, comic naver e muitos outros.

    676+2Variação de estrelas nos últimos 7 dias
  • :card_index: Extraia perfis de redes sociais e mais com expressões regulares

    656+0Variação de estrelas nos últimos 7 dias
  • pricewise@adrianhajdin

    Mergulhe no web scraping e construa um rastreador de preços de e-commerce com Next.js 13 em um único vídeo que ensina extração de dados, cron jobs, envio de e-mails, implantação e muito mais.

    636+1Variação de estrelas nos últimos 7 dias
  • h5i@h5i-dev

    Colaboração em sandbox para equipes multiagentes: um fórum de mensagens baseado em Git, onde cada agente é isolado em sua própria sandbox descartável. Transforme um repositório Git em um fórum de mensagens seguro para agentes de IA.

    633+22Variação de estrelas nos últimos 7 dias
  • juriscraper@freelawproject

    Uma API para extrair metadados de sites de tribunais americanos.

    631+3Variação de estrelas nos últimos 7 dias
  • Kemono-Downloader@Yuvi9587

    Kemono Pawchive Downloader é um aplicativo rápido em PyQt5 para arquivar conteúdo de diversos sites, incluindo Kemono, Coomer, Bunkr, Erome, Saint2.su, nhentai e Discord. Possui navegador de criadores, verificador de atualizações e suporte a downloads multi-thread e multi-parte, com recursos de pausa, retomada e recuperação de sessões.

    630+10Variação de estrelas nos últimos 7 dias
  • docker-selenium-lambda@umihico

    A demo mais simples de automação do Chrome usando Python e Selenium no AWS Lambda

    618+0Variação de estrelas nos últimos 7 dias
  • Ominis-OSINT@AnonCatalyst

    Esta aplicação em Python é uma ferramenta de OSINT (Inteligência de Fontes Abertas) chamada "Ominis OSINT - Web Hunter". Ela realiza coleta de informações online consultando o Google por resultados de pesquisa relacionados a uma consulta inserida pelo usuário. A ferramenta extrai informações relevantes, como títulos, URLs e menções potenciais da consulta nos resultados.

    614+2Variação de estrelas nos últimos 7 dias
  • LinkedInDumper@l4rm4nd

    Script em Python 3 para extrair/coletar funcionários de empresas da API do LinkedIn

    611+0Variação de estrelas nos últimos 7 dias
  • reddit-universal-scraper@ksanjeev284

    Scraper universal do Reddit - Funciona em qualquer Subreddit ou Usuário

    597+4Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos