web-scraping
web-scraping 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #31
AI 코딩 에이전트를 위한 최고의 웹 — MCP 기반의 로컬 퍼스트 검색, 페치, 크롤링 및 리서치. API 키 없음, 클라우드 없음, 쿼리당 $0. 퍼블릭 베타.
★ 4,865+0최근 7일 스타 변화 - #32
감지되지 않는 Playwright 테스트 및 자동화 라이브러리 버전입니다.
★ 4,255+0최근 7일 스타 변화 - #33★ 4,015+0최근 7일 스타 변화
- #34
단 하나의 명령어로 모든 웹사이트의 완전한 디자인 시스템 추출. DTCG 토큰, semantic+primitive+composite, Claude Code/Cursor/Windsurf용 MCP 서버, 멀티 플랫폼 내보내기(iOS SwiftUI, Android Compose, Flutter, WordPress), Tailwind v4, Figma 변수, shadcn/ui, CSS 상태 감사, WCAG 개선, Chrome 확장 프로그램. MIT, Playwright, Node 20+.
★ 4,008+0최근 7일 스타 변화 - #35
검색, 상품, 제안 목록, 리뷰, 질문과 답변, 베스트셀러 및 판매자 데이터를 추출하기 위한 무료 평가판 Amazon 스크레이퍼 API.
★ 3,388+0최근 7일 스타 변화 - #36
AI 기반 스크래퍼, 크롤러, 브라우저 자동화를 통한 웹사이트 구조화 데이터 수집. 자연어 프롬프트를 이용한 스크래핑 및 크롤링. LLM 에이전트에 최신 데이터 제공. 지능형 웹 데이터 수집을 위한 AI Studio 파이썬 SDK.
★ 3,387+0최근 7일 스타 변화 - #37
PHP Curl Class를 사용하면 HTTP 요청을 쉽게 전송하고 웹 API와 통합할 수 있습니다.
★ 3,296+0최근 7일 스타 변화 - #38
Python을 사용하여 Amazon에서 제목, 평점, 가격, 이미지, 설명 등 제품 데이터를 추출하는 프로세스입니다.
★ 3,257+0최근 7일 스타 변화 - #39
무료 안티핑거프린트 브라우저, 지문 브라우저, 개인정보 보호 브라우저, 웹3 에어드랍 전용 무료 브라우저 https://virtualbrowser.cc/?src=github
★ 3,086+0최근 7일 스타 변화 - #40
Python 코드 튜토리얼
★ 3,000+0최근 7일 스타 변화 - #41
Python과 Oxylabs SERP API를 사용하여 Google Trends 데이터를 스크래핑하고 결과 비교를 수행하는 방법을 단계별로 학습합니다. 키워드, 인기 도, 지역별 분석, 관련 쿼리 등을 추출합니다.
★ 2,909+0최근 7일 스타 변화 - #42★ 2,732+0최근 7일 스타 변화
- #43★ 2,687+0최근 7일 스타 변화
- #44
공개 웹 액세스를 위한 올인원 솔루션을 제공하는 강력한 Model Context Protocol (MCP) 서버
★ 2,624+0최근 7일 스타 변화 - #45
오픈소스 웹 스크래핑 API. 웹사이트를 깔끔한 마크다운이나 구조화된 JSON으로 변환합니다. 안티 디텍트 브라우저, 프록시 자동 선택, 자체 호스팅 지원. 명령어 하나로 실행: make up
★ 2,599+0최근 7일 스타 변화 - #46
30일(또는 그 정도) 동안 Python 배우기
★ 2,511+0최근 7일 스타 변화 - #47★ 2,463+0최근 7일 스타 변화
- #48
LLM을 위한 빠르고 로컬 우선인 웹 콘텐츠 추출 도구. 스크랩, 크롤링, 구조화된 데이터 추출을 모두 Rust로 수행합니다. CLI, REST API 및 MCP 서버를 제공합니다.
★ 2,318+0최근 7일 스타 변화 - #49
탐지되지 않는 셀프 호스팅 브라우저 자동화 플랫폼. 0% 탐지율을 위해 Camoufox (Firefox) 기반으로 작동하며, 속도, 프라이버시 및 확장성을 고려하여 구축되었습니다.
★ 2,279+0최근 7일 스타 변화 - #50
Python과 Oxylabs E-Commerce Scraper API를 사용하여 Amazon에서 베스트셀러 상품, 검색 결과, 현재 진행 중인 할인 상품을 추출하는 코드입니다.
★ 2,091+0최근 7일 스타 변화 - #51
Python과 Oxylabs SERP Scraper API를 사용하여 Google Scholar에서 제목, 저자, 인용 횟수를 추출하는 가이드
★ 2,059+0최근 7일 스타 변화 - #52
컴퓨터 비전, OCR, Anthropic Computer Use/LLM을 지원하는 Ui.Vision 오픈소스 RPA 소프트웨어. Selenium IDE 가져오기/내보내기 지원.
★ 2,000+0최근 7일 스타 변화 - #53
Playwright용 무료 안티디텍트 브라우저 스텔스: 감지되지 않는 헤드리스 Firefox 지문. Python 스크래핑, reCAPTCHA 및 봇 탐지 우회. 오픈 소스
★ 1,962+0최근 7일 스타 변화 - #54
안티봇 시스템을 우회하는 유일한 브라우저 자동화. AI가 네트워크 훅을 작성하고 간단한 채팅을 통해 픽셀 단위로 UI를 복제합니다.
★ 1,888+0최근 7일 스타 변화 - #55★ 1,841+204최근 7일 스타 변화
- #56
Puppeteer 기반의 헤드리스 Chrome/Chromium 드라이버. 프로덕션 수준의 API로 스크린샷 촬영, PDF 생성, 텍스트 및 HTML 추출을 수행합니다.
★ 1,833+0최근 7일 스타 변화 - #57
멀티 플랫폼 콘텐츠 모니터링·수집·배포. 하나의 Web 패널로 Douyin / Xiaohongshu / Kuaishou 관리
★ 1,833+0최근 7일 스타 변화 - #58
Python과 Oxylabs의 Google Jobs Scraper API를 사용하여 여러 검색어와 지역에 대한 Google Jobs를 동시에 수집하는 자체 스크래퍼 구축 방법을 배워보세요. https://oxylabs.io/blog/how-to-scrape-google-jobs
★ 1,767+0최근 7일 스타 변화 - #59
이 튜토리얼에서는 Python과 Oxylabs API를 사용하여 공개된 Google 데이터를 스크래핑하는 방법을 소개합니다.
★ 1,692+0최근 7일 스타 변화 - #60
Modest 및 Lexbor 엔진용 Python 바인딩. CSS 셀렉터를 지원하는 빠른 Python용 HTML5 파서
★ 1,671+0최근 7일 스타 변화