跳到主要內容
buildradar
登入
主題 · web-scraping

web-scraping

標記 web-scraping 主題、收錄中的開源專案,依星數排序。

共 119 個專案
  • finvizfinance@lit26

    Finviz 分析 Python 函式庫。

    1,624+0近 7 天星數變化
  • DAT8@justmarkham

    General Assembly 於華盛頓特區舉辦的 2015 年 Data Science 課程

    1,620+0近 7 天星數變化
  • Scweet@Altimis

    從 Twitter/X 抓取推文、個人資料、粉絲與追蹤中,無需 API 金鑰。具備智慧多帳號池化、代理支援與非同步的 Python 程式庫。

    1,607+0近 7 天星數變化
  • ai-map-py@oxylabs

    AI Map 是由 Oxylabs AI Studio 開發的 AI 驅動網站地圖工具,使用自然語言提示詞智慧探索並從任何網站萃取相關 URL。

    1,598+0近 7 天星數變化
  • single-file-cli@gildas-lormeau

    用於在單一 HTML 檔案中儲存完整網頁真實副本的 CLI 工具(基於 SingleFile)

    1,579+0近 7 天星數變化
  • rvest@tidyverse

    適用於 R 的簡單網頁爬蟲工具

    1,520+0近 7 天星數變化
  • patchright-python@Kaliiiiiiiiii-Vinyzu

    Playwright 測試與自動化程式庫的未偵測 Python 版本。

    1,492+0近 7 天星數變化
  • fredy@orangecoding

    ❤️ Fredy - 輕鬆尋找房地產 - Fredy 持續在 ImmoScout24、Immowelt、eBay Kleinanzeigen 等德國平台上搜尋新公寓與房屋,並透過 Slack、Telegram、Email、Discord 或 ntfy 即時將結果傳送給您,讓您專注於生活中更重要的事 ;)

    1,462+0近 7 天星數變化
  • core@roach-php

    PHP 的完整網頁爬蟲工具包。

    1,455+0近 7 天星數變化
  • agentql@tinyfish-io

    AgentQL 是一套用於將 AI 連線至網 pecul 的工具。具備查詢語言與 Playwright 整合功能,可快速、精確且大規模地與元素互動並擷取資料。包含 REST API、Python 與 JavaScript SDK,以及瀏覽器偵錯工具。

    1,454+0近 7 天星數變化
  • wreq-python@0x676e67

    一個符合人體工學且注重隱私的 Python HTTP 用戶端

    1,438+0近 7 天星數變化
  • rebrowser-patches@rebrowser

    用於 Puppeteer 與 Playwright 的修補程式集合,可避免自動化偵測與洩漏。有助於規避 Cloudflare 與 DataDome CAPTCHA 頁面。易於修補與解除修補,可依需求啟用或停用。

    1,422+0近 7 天星數變化
  • 使用 Web Scraper API 從 Google Finance 擷取資料,包含股票名稱、價格與百分比價格變動。

    1,403+0近 7 天星數變化
  • open-scouts@firecrawl

    🔥 AI 驅動的網頁監控平台。建立自動化偵察工具來搜尋網路,並在找到目標內容時發送電子郵件警報。

    1,360+0近 7 天星數變化
  • openserp@karust

    用於 AI、SEO 與自動化的自架 SERP API。透過瀏覽器渲染 Google、Bing、Yandex、Baidu、DuckDuckGo 與 Ecosia 搜尋並進行頁面萃取 🎉

    1,335+0近 7 天星數變化
  • WebAI2API@foxhui

    WebAI2API:基於 Camoufox 的網頁 AI 轉 API 工具,支援 LMArena/Gemini 等,具備多視窗併發與帳號隔離功能。

    1,315+0近 7 天星數變化
  • httpcloak@sardanioss

    具備瀏覽器相同 TLS/HTTP2 指紋識別功能的 Go HTTP 用戶端。在密碼學層級(JA3/JA4、Akamai 指紋、標頭順序)完美模仿 Chrome、Firefox 與 Safari 以繞過機器人偵測。支援 HTTP/1.1、HTTP/2、HTTP/3、工作階段、Cookie 與代理伺服器。

    1,275+0近 7 天星數變化
  • Decodo@Decodo

    HTTP(S)/SOCKS5 輪換住宅代理 - 程式碼範例與一般資訊。

    1,244+0近 7 天星數變化
  • user-agents@intoli

    一個用於產生隨機使用者代理(User Agent)的 JavaScript 函式庫,其資料每日更新。

    1,188+0近 7 天星數變化
  • miasma@austin-weeks

    將 AI 網路爬蟲困在無盡的毒藥坑中。

    1,179+0近 7 天星數變化
  • faster-than-requests@juancarlospaco

    在 Python 3 上提供更快的 requests 效能

    1,128+0近 7 天星數變化
  • reverse-api-engineer@nottelabs

    能將網站轉化為 API 的 Agent!

    1,121+2近 7 天星數變化
  • kimuraframework@vifreefly

    使用簡潔、AI 輔助的 DSL 在 Ruby 中編寫網路爬蟲。Kimurai 利用 AI 來找出資料所在位置,然後快取選取器並使用純 Ruby 進行爬取。獲得 LLM 的智慧,而無需付出每次請求的延遲或 Token 成本。

    1,102+0近 7 天星數變化
  • scrapfly-scrapers@scrapfly

    適用於 40 多個熱門域名的可擴充 Python 網路爬蟲腳本

    1,078+5近 7 天星數變化
  • awesome-agent-apis@Anil-matcha

    OpenClaw 資源、工具、技能、教學與文章的精選列表。OpenClaw(前稱 Moltbot / Clawdbot)— 適用於 WhatsApp、Telegram、Discord 及 50 多種整合的開源自託管 AI agent。

    1,005+8近 7 天星數變化
  • ShardBrowser@ProxyShard

    免費、開源的防關聯瀏覽器啟動器,用於網路爬蟲與多帳號管理。由 ProxyShard 團隊開發。內含 Chromium 148 的引擎級指紋偽裝(WebGL / WebGPU / Client Hints / 字型 / TLS),內建 170+ 種裝置設定檔,透過 SOCKS5 支援穩定的 QUIC + WebRTC。

    1,002+184近 7 天星數變化
  • crw@us

    用 Rust 寫的快速、輕量級 Firecrawl/Tavily 替代方案。具備 MCP 伺服器的網頁爬蟲、抓取與搜尋 API,專為 AI agent 設計。相容 Firecrawl API(/scrape、/crawl、/search)。在 1K-URL 效能測試中,比 Tavily 快 2.3 倍、比 Firecrawl 快 1.5 倍。僅需 6 MB RAM、單一執行檔。可自架或使用託管雲端。

    965+56近 7 天星數變化
  • x-reader@runesleo

    支援 10+ 個平台的通用內容閱讀器 MCP Server

    961+0近 7 天星數變化
  • 透過發送帶有有效 ChatGPT 抓取 API 憑證的提示詞,從 ChatGPT 抓取工具收集結構化回應。只需幾個參數即可啟用即時搜尋、注入 HTML 內容,並自動化智慧抓取 ChatGPT 工作流程。

    942+153近 7 天星數變化
  • Oxylabs 產品的官方 Agent 技能。

    871+0近 7 天星數變化
← 返回主題列表