본문으로 건너뛰기
buildradar
Sign in
토픽 · data-extraction

data-extraction

data-extraction 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
28
총 스타
340,458
평균 스타
12,159
비중
0.02%

같은 리포지토리에 data-extraction 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 data-extraction 태그가 달린 리포지토리예요.

  • ai-data-extractor@bawadou

    AI 코딩 어시스턴트 채팅 기록을 위한 무료 오픈 소스 추출기입니다. Claude Code, Cursor, Windsurf, Aider, Cline/Roo Code 등을 지원합니다.

    550
  • firecrawl@firecrawl

    대규모 웹 검색, 스크래핑, 상호작용을 위한 컨텍스트 API. 🔥

    174,034+3,406최근 7일 스타 변화
  • Scrapling@D4Vinci

    🕷️ 단일 요청부터 대규모 크롤링까지 모두 처리하는 적응형 웹 스크래핑 프레임워크!

    77,158+1,432최근 7일 스타 변화
  • Scrapegraph-ai@ScrapeGraphAI

    AI 기반 Python 스크래퍼

    30,047+244최근 7일 스타 변화
  • maxun@getmaxun

    🔥 웹 스크래핑, 크롤링, 검색 및 AI 데이터 추출을 위한 오픈소스 노코드 플랫폼 • 몇 분 만에 웹사이트를 구조화된 API로 변환 🔥

    17,322+70최근 7일 스타 변화
  • ferret@MontFerret

    구조화된 추출 워크플로우를 위한 선언형 데이터 자동화 언어 및 Go 런타임.

    6,008-1최근 7일 스타 변화
  • flashtext@vi3k6i5

    문장에서 키워드를 추출하거나 문장의 키워드를 대체합니다.

    5,712+0최근 7일 스타 변화
  • skills@browser-act

    AI agent를 위해 구축된 브라우저 자동화 CLI. 봇 방어벽을 우회하고, 막히면 여러 플랫폼에서 사람에게 전환합니다. 병렬 멀티태스킹 실행, 독립된 멀티 세션 작업, 격리된 멀티 계정 브라우징.

    5,522+129최근 7일 스타 변화
  • brightdata-mcp@brightdata

    공개 웹 액세스를 위한 올인원 솔루션을 제공하는 강력한 Model Context Protocol (MCP) 서버

    2,614+10최근 7일 스타 변화
  • HeadlessX@saifyxpro

    탐지되지 않는 셀프 호스팅 브라우저 자동화 플랫폼. 0% 탐지율을 위해 Camoufox (Firefox) 기반으로 작동하며, 속도, 프라이버시 및 확장성을 고려하여 구축되었습니다.

    2,273+18최근 7일 스타 변화
  • recipe-scrapers@hhursev

    레시피 데이터 스크래핑을 위한 Python 패키지

    2,215+3최근 7일 스타 변화
  • contextgem@shcherbak-ai

    ContextGem: 문서에서 손쉬운 LLM 추출

    1,994+8최근 7일 스타 변화
  • article-extractor@extractus

    주어진 URL에서 기사 추출

    1,910+2최근 7일 스타 변화
  • optimus@hi-primus

    Pandas, Dask, cuDF, Dask-cuDF, Vaex, PySpark를 활용한 간편한 애자일 데이터 준비 워크플로

    1,536+0최근 7일 스타 변화
  • vnstock@thinh-vu

    누구나 쉽게 현대적인 투자를 할 수 있도록 만들어진, 초보자 친화적이면서도 강력한 금융 분석 및 자동화 Python 툴킷

    1,389+10최근 7일 스타 변화
  • parsera@raznem

    LLM을 사용하여 웹사이트를 스크래핑하기 위한 경량 라이브러리

    1,352+0최근 7일 스타 변화
  • socid-extractor@soxoj

    ⛏️ Maigret의 추출 엔진: 150개 이상의 사이트에서 프로필 URL을 구조화된 OSINT 레코드로 변환

    1,076+9최근 7일 스타 변화
  • pdf_oxide@yfedoseev

    Python 및 Rust를 위한 가장 빠른 PDF 라이브러리. 텍스트 추출, 이미지 추출, 마크다운 변환, PDF 생성 및 편집 지원. 평균 0.8ms, 업계 선두 대비 5배 빠름, 3,830개 PDF 테스트 100% 통과. MIT/Apache-2.0 라이선스.

    1,006+37최근 7일 스타 변화
  • eclaire@eclaire-labs

    데이터를 위한 로컬 퍼스트, 오픈소스 AI 어시스턴트. 작업, 메모, 문서, 사진, 북마크를 통합합니다. 프라이빗하며, 자체 호스팅이 가능하고 API를 통해 확장할 수 있습니다.

    916+15최근 7일 스타 변화
  • crw@us

    Rust로 작성된 빠르고 가벼운 Firecrawl/Tavily 대안. AI 에이전트를 위한 MCP 서버를 포함한 웹 스크레이퍼, 크롤러 및 검색 API. Firecrawl 호환 API 제공, 1K-URL 벤치마크 기준 Tavily 대비 2.3배, Firecrawl 대비 1.5배 빠름. 6MB RAM 점유, 단일 바이너리. 자체 호스팅 또는 관리형 클라우드 사용 가능

    876+230최근 7일 스타 변화
  • hacker-news-digest@polyrabbit

    ChatGPT가 Hacker News를 요약해 주는 서비스

    756+0최근 7일 스타 변화
  • npm-pdfreader@adrienjoly

    🚜 PDF 파일에서 텍스트와 표를 파싱합니다.

    704+0최근 7일 스타 변화
  • scrapecraft@ScrapeGraphAI

    🤖 시각적 워크플로우 빌더가 포함된 AI 기반 웹 스크래핑 에디터. 자연어를 사용하여 웹 스크래퍼를 빌드, 테스트 및 배포하세요. ScrapeGraphAI 및 LangGraph 기반.

    688+2최근 7일 스타 변화
  • Google Reviews API 통합 및 확장 가능한 Google Reviews 스크래퍼. 구조화된 Google Review API를 사용하여 Google Maps에서 평점, 리뷰 텍스트, 비즈니스 인사이트를 추출합니다.

    593-1최근 7일 스타 변화
  • ai-web-scraper@ScrapingBee

    Effortlessly extract data with our AI scraper API. Simplify data extraction, get clean JSON outputs and adapt to page changes. Try it free today!

    571최근 7일 스타 변화
  • github-statuses@mrshu

    GitHub 상태 기록을 문서화하기 위한 Flat Data 기반의 GitHub 상태 페이지

    561+9최근 7일 스타 변화
  • Stealth-Requests@jpjacobpadilla

    Python을 이용한 감지되지 않는 웹 스크래핑 및 원활한 HTML 파싱

    561+2최근 7일 스타 변화
  • reader@vakra-dev

    AI를 위한 오픈소스 웹 인프라. 웹 스크래핑, 크롤링, 자동화, 마크다운 정리 및 브라우저 세션 기능을 제공하여 에이전트 구축 지원

    558+0최근 7일 스타 변화
  • ai-data-extractor@bawadou

    AI 코딩 어시스턴트 채팅 기록을 위한 무료 오픈 소스 추출기입니다. Claude Code, Cursor, Windsurf, Aider, Cline/Roo Code 등을 지원합니다.

    550+11최근 7일 스타 변화
← 토픽 목록으로