跳到主要內容
buildradar
登入
主題 · web-scraping

web-scraping

標記 web-scraping 主題、收錄中的開源專案,依星數排序。

共 119 個專案
  • wigolo@KnockOutEZ

    你的 AI 程式碼代理的首選網路——本地優先搜尋、抓取、爬取與研究 MCP。無 API 金鑰、無雲端、$0/查詢。公開測試版

    4,865+0近 7 天星數變化
  • patchright@Kaliiiiiiiiii-Vinyzu

    未被偵測的 Playwright 測試與自動化庫版本

    4,255+0近 7 天星數變化
  • snoop@snooppr

    Snoop — 基於開放數據的情報工具(OSINT world)

    4,015+0近 7 天星數變化
  • design-extract@Manavarya09

    透過一行指令擷取任何網站的完整設計系統。DTCG 標記、語義+原始+複合,適用於 Claude Code/Cursor/Windsurf 的 MCP 伺服器、多平台發射器(iOS SwiftUI、Android Compose、Flutter、WordPress)、Tailwind v4、Figma 變數、shadcn/ui、CSS 健康度審計、WCAG 修復、Chrome 擴充功能。採用 MIT 授權、Playwright、Node 20+。

    4,008+0近 7 天星數變化
  • amazon-scraper@oxylabs

    免費試用 Amazon Scraper API,用於提取搜尋、產品、優惠列表、評論、問答、暢銷書和賣家資料。

    3,388+0近 7 天星數變化
  • 使用 AI 驅動的抓取器、爬蟲與瀏覽器自動化,從任何網站收集結構化資料。透過自然語言提示進行抓取與爬蟲。為 LLM 代理提供最新資料。AI Studio Python SDK 用於智能網頁資料收集。

    3,387+0近 7 天星數變化
  • php-curl-class@php-curl-class

    PHP Curl Class 讓發送 HTTP 請求並整合網路 API 變得簡單。

    3,296+0近 7 天星數變化
  • 使用 Python 從 Amazon 擷取產品資料的流程,包括標題、評分、價格、圖片和描述。

    3,257+0近 7 天星數變化
  • VirtualBrowser@Virtual-Browser

    免費反指紋瀏覽器,指紋瀏覽器、隱私瀏覽器、防識別瀏覽器、反識別瀏覽器、防關聯瀏覽器,免費的 Web3 空投專用指紋瀏覽器 https://virtualbrowser.cc/?src=github

    3,086+0近 7 天星數變化
  • pythoncode-tutorials@x4nth055

    Python 程式碼教學

    3,000+0近 7 天星數變化
  • 逐步學習如何使用 Python 和 Oxylabs SERP API 抓取 Google Trends 數據並進行結果比較。擷取關鍵字、其受歡迎程度、按地區劃分的數據、相關查詢等。

    2,909+0近 7 天星數變化
  • twscrape@vladkens

    用於 X/Twitter 爬取的 Python 函式庫與 CLI,支援多帳號輪替與內建速率限制處理。

    2,732+0近 7 天星數變化
  • spider@spider-rs

    為 AI 代理和大型語言模型(LLM)獲取網頁資料

    2,687+0近 7 天星數變化
  • brightdata-mcp@brightdata

    一款強大的 Model Context Protocol (MCP) 伺服器,為公開網路存取提供全方位解決方案。

    2,624+0近 7 天星數變化
  • anakin@Anakin-Inc

    開源網頁爬蟲 API。將任何網站轉為整潔的 markdown 或結構化 JSON。具備防偵測瀏覽器、代理伺服器自動選擇、可自架等特性。一行指令:make up

    2,599+0近 7 天星數變化
  • 30-Days-of-Python@codingforentrepreneurs

    在接下來的 30 天左右學習 Python。

    2,511+0近 7 天星數變化
  • grab@lorien

    網頁爬蟲框架

    2,463+0近 7 天星數變化
  • webclaw@0xMassi

    為 LLM 提供快速、本機優先的網頁內容擷取工具。使用 Rust 進行網頁抓取、爬取、擷取結構化資料。提供 CLI、REST API 與 MCP 伺服器。

    2,318+0近 7 天星數變化
  • HeadlessX@saifyxpro

    無法被偵測的自架瀏覽器自動化平台。由 Camoufox (Firefox) 驅動,實現 0% 偵測率。為速度、隱私與可擴展性而打造。

    2,279+0近 7 天星數變化
  • 使用 Python 與 Oxylabs E-Commerce Scraper API 從 Amazon 擷取熱銷商品、搜尋結果與現有特惠的程式碼。

    2,091+0近 7 天星數變化
  • 使用 Python 與 Oxylabs SERP Scraper API 從 Google Scholar 提取標題、作者與引文的指南。

    2,059+0近 7 天星數變化
  • RPA@A9T9

    具有電腦視覺、OCR、Anthropic Computer Use/LLM 功能的 Ui.Vision 開源 RPA 軟體。支援 Selenium IDE 匯入/匯出。

    2,000+0近 7 天星數變化
  • 適用於 Playwright 的免費防檢測隱身瀏覽器:未被偵測的無頭 Firefox 指紋。Python 爬蟲、recaptcha 與機器人檢測繞過。開源

    1,962+0近 7 天星數變化
  • stealth-browser-mcp@vibheksoni

    唯一能繞過反機器人系統的瀏覽器自動化工具。透過簡單的聊天,由 AI 編寫網路掛鉤並以像素級精準度複製 UI。

    1,888+0近 7 天星數變化
  • moli@lexmount

    最適合 AI 代理的無頭瀏覽器。輕量、快速、高相容性。以 Rust 編寫。

    1,841+204近 7 天星數變化
  • creatorhub@3441293738

    多平台內容監控·採集·搬運,一個 Web 面板管起抖音 / 小紅書 / 快手

    1,833+0近 7 天星數變化
  • browserless@microlinkhq

    基於 Puppeteer 的無頭 Chrome/Chromium 驅動程式。提供可用於正式環境的 API,用以擷取螢幕截圖、產生 PDF 以及擷取文字與 HTML。

    1,833+0近 7 天星數變化
  • 學習如何使用 Python 與 Oxylabs 的 Google Jobs Scraper API,建構能同時為多個搜尋查詢與地理位置爬取 Google Jobs 的自訂爬蟲。https://oxylabs.io/blog/how-to-scrape-google-jobs

    1,767+0近 7 天星數變化
  • 在本教學中,我們將展示如何使用 Python 與 Oxylabs API 擷取公開的 Google 資料。

    1,692+0近 7 天星數變化
  • selectolax@rushter

    Modest 與 Lexbor 引擎的 Python 綁定。適用於 Python、支援 CSS 選擇器的快速 HTML5 解析器。

    1,671+0近 7 天星數變化
← 返回主題列表