본문으로 건너뛰기
buildradar
로그인
토픽 · web-scraping

web-scraping

web-scraping 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 119개
  • wigolo@KnockOutEZ

    AI 코딩 에이전트를 위한 최고의 웹 — MCP 기반의 로컬 퍼스트 검색, 페치, 크롤링 및 리서치. API 키 없음, 클라우드 없음, 쿼리당 $0. 퍼블릭 베타.

    4,865+0최근 7일 스타 변화
  • patchright@Kaliiiiiiiiii-Vinyzu

    감지되지 않는 Playwright 테스트 및 자동화 라이브러리 버전입니다.

    4,255+0최근 7일 스타 변화
  • snoop@snooppr

    Snoop — 공개 출처 정보(OSINT) 기반 정찰 도구

    4,015+0최근 7일 스타 변화
  • design-extract@Manavarya09

    단 하나의 명령어로 모든 웹사이트의 완전한 디자인 시스템 추출. DTCG 토큰, semantic+primitive+composite, Claude Code/Cursor/Windsurf용 MCP 서버, 멀티 플랫폼 내보내기(iOS SwiftUI, Android Compose, Flutter, WordPress), Tailwind v4, Figma 변수, shadcn/ui, CSS 상태 감사, WCAG 개선, Chrome 확장 프로그램. MIT, Playwright, Node 20+.

    4,008+0최근 7일 스타 변화
  • amazon-scraper@oxylabs

    검색, 상품, 제안 목록, 리뷰, 질문과 답변, 베스트셀러 및 판매자 데이터를 추출하기 위한 무료 평가판 Amazon 스크레이퍼 API.

    3,388+0최근 7일 스타 변화
  • AI 기반 스크래퍼, 크롤러, 브라우저 자동화를 통한 웹사이트 구조화 데이터 수집. 자연어 프롬프트를 이용한 스크래핑 및 크롤링. LLM 에이전트에 최신 데이터 제공. 지능형 웹 데이터 수집을 위한 AI Studio 파이썬 SDK.

    3,387+0최근 7일 스타 변화
  • php-curl-class@php-curl-class

    PHP Curl Class를 사용하면 HTTP 요청을 쉽게 전송하고 웹 API와 통합할 수 있습니다.

    3,296+0최근 7일 스타 변화
  • Python을 사용하여 Amazon에서 제목, 평점, 가격, 이미지, 설명 등 제품 데이터를 추출하는 프로세스입니다.

    3,257+0최근 7일 스타 변화
  • VirtualBrowser@Virtual-Browser

    무료 안티핑거프린트 브라우저, 지문 브라우저, 개인정보 보호 브라우저, 웹3 에어드랍 전용 무료 브라우저 https://virtualbrowser.cc/?src=github

    3,086+0최근 7일 스타 변화
  • pythoncode-tutorials@x4nth055

    Python 코드 튜토리얼

    3,000+0최근 7일 스타 변화
  • Python과 Oxylabs SERP API를 사용하여 Google Trends 데이터를 스크래핑하고 결과 비교를 수행하는 방법을 단계별로 학습합니다. 키워드, 인기 도, 지역별 분석, 관련 쿼리 등을 추출합니다.

    2,909+0최근 7일 스타 변화
  • twscrape@vladkens

    다중 계정 로테이션 및 내장 레이트 리밋 처리를 지원하는 X/Twitter 스크래핑용 Python 라이브러리 및 CLI

    2,732+0최근 7일 스타 변화
  • spider@spider-rs

    AI 에이전트와 LLM을 위한 웹 데이터 가져오기

    2,687+0최근 7일 스타 변화
  • brightdata-mcp@brightdata

    공개 웹 액세스를 위한 올인원 솔루션을 제공하는 강력한 Model Context Protocol (MCP) 서버

    2,624+0최근 7일 스타 변화
  • anakin@Anakin-Inc

    오픈소스 웹 스크래핑 API. 웹사이트를 깔끔한 마크다운이나 구조화된 JSON으로 변환합니다. 안티 디텍트 브라우저, 프록시 자동 선택, 자체 호스팅 지원. 명령어 하나로 실행: make up

    2,599+0최근 7일 스타 변화
  • 30-Days-of-Python@codingforentrepreneurs

    30일(또는 그 정도) 동안 Python 배우기

    2,511+0최근 7일 스타 변화
  • grab@lorien

    웹 스크래핑 프레임워크

    2,463+0최근 7일 스타 변화
  • webclaw@0xMassi

    LLM을 위한 빠르고 로컬 우선인 웹 콘텐츠 추출 도구. 스크랩, 크롤링, 구조화된 데이터 추출을 모두 Rust로 수행합니다. CLI, REST API 및 MCP 서버를 제공합니다.

    2,318+0최근 7일 스타 변화
  • HeadlessX@saifyxpro

    탐지되지 않는 셀프 호스팅 브라우저 자동화 플랫폼. 0% 탐지율을 위해 Camoufox (Firefox) 기반으로 작동하며, 속도, 프라이버시 및 확장성을 고려하여 구축되었습니다.

    2,279+0최근 7일 스타 변화
  • Python과 Oxylabs E-Commerce Scraper API를 사용하여 Amazon에서 베스트셀러 상품, 검색 결과, 현재 진행 중인 할인 상품을 추출하는 코드입니다.

    2,091+0최근 7일 스타 변화
  • Python과 Oxylabs SERP Scraper API를 사용하여 Google Scholar에서 제목, 저자, 인용 횟수를 추출하는 가이드

    2,059+0최근 7일 스타 변화
  • RPA@A9T9

    컴퓨터 비전, OCR, Anthropic Computer Use/LLM을 지원하는 Ui.Vision 오픈소스 RPA 소프트웨어. Selenium IDE 가져오기/내보내기 지원.

    2,000+0최근 7일 스타 변화
  • Playwright용 무료 안티디텍트 브라우저 스텔스: 감지되지 않는 헤드리스 Firefox 지문. Python 스크래핑, reCAPTCHA 및 봇 탐지 우회. 오픈 소스

    1,962+0최근 7일 스타 변화
  • stealth-browser-mcp@vibheksoni

    안티봇 시스템을 우회하는 유일한 브라우저 자동화. AI가 네트워크 훅을 작성하고 간단한 채팅을 통해 픽셀 단위로 UI를 복제합니다.

    1,888+0최근 7일 스타 변화
  • moli@lexmount

    AI 에이전트를 위한 최고의 헤드리스 브라우저. 가볍고 빠르며 호환성이 높음. Rust로 제작됨

    1,841+204최근 7일 스타 변화
  • browserless@microlinkhq

    Puppeteer 기반의 헤드리스 Chrome/Chromium 드라이버. 프로덕션 수준의 API로 스크린샷 촬영, PDF 생성, 텍스트 및 HTML 추출을 수행합니다.

    1,833+0최근 7일 스타 변화
  • creatorhub@3441293738

    멀티 플랫폼 콘텐츠 모니터링·수집·배포. 하나의 Web 패널로 Douyin / Xiaohongshu / Kuaishou 관리

    1,833+0최근 7일 스타 변화
  • Python과 Oxylabs의 Google Jobs Scraper API를 사용하여 여러 검색어와 지역에 대한 Google Jobs를 동시에 수집하는 자체 스크래퍼 구축 방법을 배워보세요. https://oxylabs.io/blog/how-to-scrape-google-jobs

    1,767+0최근 7일 스타 변화
  • 이 튜토리얼에서는 Python과 Oxylabs API를 사용하여 공개된 Google 데이터를 스크래핑하는 방법을 소개합니다.

    1,692+0최근 7일 스타 변화
  • selectolax@rushter

    Modest 및 Lexbor 엔진용 Python 바인딩. CSS 셀렉터를 지원하는 빠른 Python용 HTML5 파서

    1,671+0최근 7일 스타 변화
← 토픽 목록으로