web-scraping
標記 web-scraping 主題、收錄中的開源專案,依星數排序。
相關主題
常跟 web-scraping 一起出現在同一個專案上的主題。
近期新秀
近 90 天內建立、標記 web-scraping 主題的專案。
- #1
多平台內容監控·採集·搬運,一個 Web 面板管起抖音 / 小紅書 / 快手
★ 1,781 - #2★ 1,481
- #3
自託管爬蟲引擎 — 可繞過任何 JS 挑戰與驗證碼:Cloudflare、Turnstile、reCAPTCHA、hCaptcha、GeeTest。作為 FlareSolverr 與 Byparr 的替代方案,可直接替換至您的 *arr 堆疊中。
★ 742 - #4
A skill for AI agents: search the web with SearXNG, browse with Camofox, bypass protections with CloakBrowser. Anti-hallucination by design. Self-hosted, free, unlimited.
★ 506 - #5
Turn any website into a compact CLI tailored for AI agents. Browse the web in hundreds of tokens, not tens of thousands.
★ 412
- #1★ 174,034+3,406近 7 天星數變化
- #2★ 77,158+1,432近 7 天星數變化
- #3★ 64,098+106近 7 天星數變化
- #4
最佳且最簡單的網站變更偵測工具,支援網頁監控與變更提醒。適合追蹤內容變更、價格下降、補貨提醒與網站被竄改監測——免費或使用我們的 SaaS 計畫!
★ 33,414+132近 7 天星數變化 - #5
使用 AI 編碼代理,一條指令即可克隆任意網站
★ 33,352+683近 7 天星數變化 - #6
隱形 Chromium,通過所有機器人偵測測試。可直接替代 Playwright,提供源碼層級的指紋修補。30/30 測試通過。
★ 30,947+439近 7 天星數變化 - #7
用 Python 實作的開源 AI 求職申請機器人:自動瀏覽、抓取職缺資訊,並為每則職缺自動填寫履歷與求職信。
★ 30,278+58近 7 天星數變化 - #8
基於 AI 的 Python 抓取工具
★ 30,047+244近 7 天星數變化 - #9
Crawlee — 用於 Node.js 的網頁抓取與瀏覽器自動化函式庫,支援 JavaScript 與 TypeScript。可為 AI、LLM、RAG 或 GPT 抽取資料,下載 HTML、PDF、JPG、PNG 等檔案,兼容 Puppeteer、Playwright、Cheerio、JSDOM 與原始 HTTP,支援有頭與無頭模式,並提供代理輪換。
★ 25,556+98近 7 天星數變化 - #10
🚀「Douyin_TikTok_Download_API」是一個開箱即用的高效能非同步抖音、快手、TikTok、Bilibili 資料爬取工具,支援 API 呼叫、線上批量解析與下載。
★ 19,727+192近 7 天星數變化 - #11★ 17,322+70近 7 天星數變化
- #12
開源 NotebookLM 替代方案。透過單一平台、API 或 MCP 伺服器,於開放網路上即時搜尋 Reddit、YT、IG、TikTok、Indeed、Google Search、Maps 等資料。加入我們的 Discord: https://discord.gg/ejRNvftDp9
★ 16,029+46近 7 天星數變化 - #13
將文件網站、GitHub 倉庫與 PDF 轉換為 Claude AI 技能,並自動偵測衝突
★ 14,858+64近 7 天星數變化 - #14
📊 用於網頁自動化、測試與繞過機器人偵測的 API
★ 12,971+30近 7 天星數變化 - #15★ 11,384+0近 7 天星數變化
- #16★ 10,173+57近 7 天星數變化
- #17
Crawlee — 用於 Python 的網頁抓取與瀏覽器自動化函式庫,可建構可靠的爬蟲。支援 AI、LLM、RAG 或 GPT 的資料抽取,下載 HTML、PDF、JPG、PNG 等檔案,兼容 Parsel、BeautifulSoup、Playwright 與原始 HTTP,支援有頭與無頭模式,並具代理輪換功能。
★ 9,477+19近 7 天星數變化 - #18
為 AI 代理設計的隱形無頭瀏覽器 — 繞過 Cloudflare、機器人偵測與防抓取。即插即用的 Puppeteer/Playwright 替代方案。
★ 8,960+195近 7 天星數變化 - #19★ 8,324-1近 7 天星數變化
- #20
Web 抓取與資料處理的函式庫、工具與 API 列表
★ 8,138+10近 7 天星數變化 - #21
一個智慧、全自動、快速且輕量的 Python 網頁爬蟲
★ 7,915+25近 7 天星數變化 - #22
此 GitHub 倉庫是 API 的強大集合,可立即使用,從簡單自動化到全規模應用皆可構建。GitHub 上最有價值的 API 清單——毫無疑問。💪
★ 7,556+47近 7 天星數變化 - #23
🔥 官方 Firecrawl MCP 伺服器 – 為 Cursor、Claude 及其他 LLM 客戶端新增強大的網頁抓取與搜尋功能
★ 7,347+58近 7 天星數變化 - #24★ 7,082+14近 7 天星數變化
- #25★ 7,053+16近 7 天星數變化
- #26
Python 與命令列工具,用於在網路上收集文字與中繼資料:爬蟲、擷取、抽取,輸出為 CSV、JSON、HTML、MD、TXT、XML
★ 6,728+50近 7 天星數變化 - #27★ 6,416+56近 7 天星數變化
- #28★ 6,008-1近 7 天星數變化
- #29
從 Google Maps 擷取資料。提取名稱、地址、電話號碼、網站 URL、評分、評論數、緯度經度、評論、電子郵件等資訊
★ 5,662+84近 7 天星數變化 - #30
Browser automation CLI built for AI agents. Break through anti-bot walls, hand off to humans across platforms when stuck. Parallel multi-task execution, independent multi-session operation, isolated multi-account browsing.
★ 5,522+129近 7 天星數變化