본문으로 건너뛰기
buildradar
토픽 · web-scraping

web-scraping

web-scraping 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
117
총 스타
837,510
평균 스타
7,158
비중
0.04%

같은 리포지토리에 web-scraping 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 web-scraping 태그가 달린 리포지토리예요.

  • creatorhub@3441293738

    멀티 플랫폼 콘텐츠 모니터링·수집·배포. 하나의 Web 패널로 Douyin / Xiaohongshu / Kuaishou 관리

    1,781
  • moli@lexmount

    AI 에이전트를 위한 최고의 헤드리스 브라우저. 가볍고 빠르며 호환성이 높음. Rust로 제작됨

    1,481
  • trawl@germondai

    셀프 호스팅 스크래핑 엔진 — Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest 등 모든 JS 챌린지 및 캡차 우회. FlareSolverr 및 Byparr의 대안이자 *arr 스택의 드롭인 대체품.

    742
  • browser-search@Johell1NS

    A skill for AI agents: search the web with SearXNG, browse with Camofox, bypass protections with CloakBrowser. Anti-hallucination by design. Self-hosted, free, unlimited.

    506
  • oc@only-cli

    Turn any website into a compact CLI tailored for AI agents. Browse the web in hundreds of tokens, not tens of thousands.

    412
  • firecrawl@firecrawl

    대규모 웹 검색, 스크래핑, 상호작용을 위한 컨텍스트 API. 🔥

    174,034+3,406최근 7일 스타 변화
  • Scrapling@D4Vinci

    🕷️ 단일 요청부터 대규모 크롤링까지 모두 처리하는 적응형 웹 스크래핑 프레임워크!

    77,158+1,432최근 7일 스타 변화
  • scrapy@scrapy

    Python을 위한 빠르고 고수준의 웹 크롤링 및 스크래핑 framework Scrapy.

    64,098+106최근 7일 스타 변화
  • changedetection.io@dgtlmoon

    웹사이트 변경 감지, 웹페이지 모니터링, 웹사이트 변경 알림을 위한 가장 좋고 간단한 도구. 콘텐츠 변경, 가격 하락, 재입고 알림, 웹사이트 변조 모니터링 추적에 완벽합니다. 무료로 이용하거나 SaaS 플랜을 즐겨보세요!

    33,414+132최근 7일 스타 변화
  • ai-website-cloner-template@JCodesMore

    AI 코딩 에이전트를 사용하여 단 한 번의 명령어로 모든 웹사이트 복제

    33,352+683최근 7일 스타 변화
  • CloakBrowser@CloakHQ

    모든 봇 탐지 테스트를 통과하는 스텔스 Chromium. 소스 수준의 핑거프린트 패치가 적용된 드롭인 방식의 Playwright 대체재. 30/30 테스트 통과.

    30,947+439최근 7일 스타 변화
  • Python으로 구현된 오픈소스 AI 구직 지원 봇: 브라우저 자동화와 웹 스크래핑으로 채용 공고를 읽고, 각 공고에 맞춤형 이력서와 자기소개서로 자동 지원합니다.

    30,278+58최근 7일 스타 변화
  • Scrapegraph-ai@ScrapeGraphAI

    AI 기반 Python 스크래퍼

    30,047+244최근 7일 스타 변화
  • crawlee@apify

    안정적인 크롤러를 구축하기 위한 Node.js용 웹 스크래핑 및 브라우저 자동화 라이브러리인 Crawlee. JavaScript 및 TypeScript 지원. AI, LLM, RAG 또는 GPT용 데이터를 추출합니다. 웹사이트에서 HTML, PDF, JPG, PNG 및 기타 파일을 다운로드하세요. Puppeteer, Playwright, Cheerio, JSDOM 및 원시 HTTP와 함께 작동합니다. 헤드풀 및 헤드리스 모드 모두 지원. 프록시 로테이션 기능 포함.

    25,556+98최근 7일 스타 변화
  • 🚀「Douyin_TikTok_Download_API」는 즉시 사용 가능한 고성능 비동기 Douyin, Kuaishou, TikTok, Bilibili 데이터 크롤링 도구로, API 호출, 온라인 일괄 파싱 및 다운로드를 지원합니다.

    19,727+192최근 7일 스타 변화
  • maxun@getmaxun

    🔥 웹 스크래핑, 크롤링, 검색 및 AI 데이터 추출을 위한 오픈소스 노코드 플랫폼 • 몇 분 만에 웹사이트를 구조화된 API로 변환 🔥

    17,322+70최근 7일 스타 변화
  • SurfSense@MODSetter

    오픈소스 NotebookLM 대안. 단일 플랫폼, API 또는 MCP 서버를 통해 실시간 데이터(Reddit, YT, IG, TikTok, Indeed, Google Search, Maps 등)로 오픈 웹을 리서치하세요. 디스코드 참여하기: https://discord.gg/ejRNvftDp9

    16,029+46최근 7일 스타 변화
  • Skill_Seekers@yusufkaraaslan

    자동 충돌 감지 기능을 통해 문서 웹사이트, GitHub 저장소, PDF를 Claude AI 스킬로 변환

    14,858+64최근 7일 스타 변화
  • SeleniumBase@seleniumbase

    📊 웹 자동화, 테스트, 봇 탐지 우회를 위한 API.

    12,971+30최근 7일 스타 변화
  • jsoup@jhy

    jsoup: HTML 편집, 정리, 스크래핑 및 XSS 보안을 위해 제작된 Java HTML 파서

    11,384+0최근 7일 스타 변화
  • pinchtab@pinchtab

    고급 스텔스 인젝션 및 실시간 대시보드를 갖춘 고성능 브라우저 자동화 브리지 및 멀티 인스턴스 오케스트레이터

    10,173+57최근 7일 스타 변화
  • crawlee-python@apify

    안정적인 크롤러를 구축하기 위한 Python용 웹 스크래핑 및 브라우저 자동화 라이브러리 Crawlee. AI, LLM, RAG 또는 GPT용 데이터를 추출하세요. 웹사이트에서 HTML, PDF, JPG, PNG 및 기타 파일을 다운로드하세요. Parsel, BeautifulSoup, Playwright 및 원시 HTTP와 호환됩니다. 헤드풀 및 헤드리스 모드를 모두 지원하며 프록시 로테이션 기능을 제공합니다.

    9,477+19최근 7일 스타 변화
  • camofox-browser@jo-inc

    AI 에이전트를 위한 스텔스 헤드리스 브라우저 — Cloudflare, 봇 탐지 및 안티 스크래핑 우회. Puppeteer/Playwright 드롭인 대체재.

    8,960+195최근 7일 스타 변화
  • helium@mherrmann

    Python을 이용한 더 가벼운 웹 자동화

    8,324-1최근 7일 스타 변화
  • awesome-web-scraping@lorien

    웹 스크래핑 및 데이터 처리를 위한 라이브러리, 도구, API 목록.

    8,138+10최근 7일 스타 변화
  • autoscraper@alirezamika

    Python을 위한 스마트하고 자동화된 빠르고 가벼운 웹 스크래퍼

    7,915+25최근 7일 스타 변화
  • API-mega-list@cporter202

    간단한 자동화부터 대규모 애플리케이션까지 구축하는 데 즉시 사용할 수 있는 강력한 API 모음 저장소입니다. GitHub에서 가장 가치 있는 API 목록 중 하나입니다. 💪

    7,556+47최근 7일 스타 변화
  • firecrawl-mcp-server@firecrawl

    🔥 공식 Firecrawl MCP Server - Cursor, Claude 및 기타 LLM 클라이언트에 강력한 웹 스크래핑 및 검색 기능을 추가합니다.

    7,347+58최근 7일 스타 변화
  • rod@go-rod

    웹 자동화 및 스크래핑을 위한 Chrome DevTools Protocol 드라이버입니다.

    7,082+14최근 7일 스타 변화
  • pydoll@autoscrape-labs

    Pydoll은 WebDriver 없이 Chromium 기반 브라우저를 자동화하고 현실적인 상호 작용을 제공하는 라이브러리입니다.

    7,053+16최근 7일 스타 변화
  • trafilatura@adbar

    웹의 텍스트 및 메타데이터 수집을 위한 Python 및 명령줄 도구: 크롤링, 스크래핑, 추출, CSV, JSON, HTML, MD, TXT, XML 출력 지원

    6,728+50최근 7일 스타 변화
  • curl_cffi@lexiforest

    cffi를 통한 curl-impersonate 포크용 Python 바인딩. 브라우저 tls/ja3/http2 지문(fingerprint)을 위장할 수 있는 HTTP 클라이언트.

    6,416+56최근 7일 스타 변화
  • ferret@MontFerret

    구조화된 추출 워크플로우를 위한 선언형 데이터 자동화 언어 및 Go 런타임.

    6,008-1최근 7일 스타 변화
  • Google Maps에서 데이터를 스크래핑합니다. 각 장소의 이름, 주소, 전화번호, 웹사이트 URL, 평점, 리뷰 수, 위도 및 경도, 리뷰, 이메일 등의 데이터를 추출합니다.

    5,662+84최근 7일 스타 변화
  • skills@browser-act

    AI agent를 위해 구축된 브라우저 자동화 CLI. 봇 방어벽을 우회하고, 막히면 여러 플랫폼에서 사람에게 전환합니다. 병렬 멀티태스킹 실행, 독립된 멀티 세션 작업, 격리된 멀티 계정 브라우징.

    5,522+129최근 7일 스타 변화
← 토픽 목록으로