crawler
標記 crawler 主題、收錄中的開源專案,依星數排序。
- #91★ 1,410+0近 7 天星數變化
- #92★ 1,386+1近 7 天星數變化
- #93★ 1,379+0近 7 天星數變化
- #94★ 1,360+0近 7 天星數變化
- #95★ 1,303+1近 7 天星數變化
- #96
📝 快速爬取 Instagram 個人檔案資訊(例如:粉絲、標籤等...)。
★ 1,302+1近 7 天星數變化 - #97★ 1,302+0近 7 天星數變化
- #98
Boss直聘爬蟲 / BOSS直聘職位資料抓取工具,基於 Chrome CDP 協議復用真實登入態,繞過字體反爬,輸出明文薪資 JSON/CSV + 薪資技能分析。A Chrome-CDP-based BOSS Zhipin job scraper/crawler.
★ 1,282+33近 7 天星數變化 - #99★ 1,258-1近 7 天星數變化
- #100
一個好用的嗶哩嗶哩漫畫下載器,擁有圖形介面,支援關鍵字搜尋漫畫和二維碼登入,黑科技下載未解鎖章節,多執行緒下載,多種儲存格式,本地漫畫管理,一鍵檢查更新!
★ 1,243+1近 7 天星數變化 - #101
基於 appium 的 App 自動遍歷工具
★ 1,237+0近 7 天星數變化 - #102
輕鬆下載 tumblr 部落格的所有相片/影片。下載指定的 Tumblr 博客中的圖片,視頻
★ 1,157+0近 7 天星數變化 - #103
📰 Newspaper4k,備受喜愛的 Newspaper3k 的分支。從新聞網站擷取文章、標題與中繼資料。
★ 1,141+1近 7 天星數變化 - #104
基於 OpenSearch 建構的開源、自架企業與網站搜尋伺服器。支援網頁/檔案/資料庫/雲端來源爬取、20 種以上語言、REST API 以及 AI/RAG 與語意搜尋。採用 Apache-2.0 授權。
★ 1,128+1近 7 天星數變化 - #105
在單一 Docker 容器中執行高傳真基於瀏覽器的網頁歸檔爬蟲
★ 1,127+5近 7 天星數變化 - #106★ 1,116+2近 7 天星數變化
- #107
使用簡潔、AI 輔助的 DSL 在 Ruby 中編寫網路爬蟲。Kimurai 利用 AI 來找出資料所在位置,然後快取選取器並使用純 Ruby 進行爬取。獲得 LLM 的智慧,而無需付出每次請求的延遲或 Token 成本。
★ 1,102+0近 7 天星數變化 - #108
適用於 40 多個熱門域名的可擴充 Python 網路爬蟲腳本
★ 1,076+4近 7 天星數變化 - #109
Golang短影片去水印:抖音、皮皮蝦、火山、微視、最右、快手、全民小影片、皮皮搞笑、西瓜影片、虎牙、梨影片、acfun、好看影片...
★ 1,032+10近 7 天星數變化 - #110
小說下載、小說爬蟲、起點、筆趣閣、匯出 Markdown、匯出 txt、轉換 epub、廣告過濾、自動校對
★ 1,017+8近 7 天星數變化 - #111★ 1,017+12近 7 天星數變化
- #112
受 <facundoolano/google-play-scraper> 啟發的 Python Google Play 爬蟲
★ 1,010+2近 7 天星數變化 - #113★ 1,009-1近 7 天星數變化
- #114
基於 Apache Storm 的可擴展、成熟且多功能的網頁爬蟲
★ 994+1近 7 天星數變化 - #115
SpiderSuite(網頁安全爬蟲)版本釋出、wiki 與發展藍圖
★ 974+1近 7 天星數變化 - #116★ 956+0近 7 天星數變化
- #117
用 Rust 寫的快速、輕量級 Firecrawl/Tavily 替代方案。具備 MCP 伺服器的網頁爬蟲、抓取與搜尋 API,專為 AI agent 設計。相容 Firecrawl API(/scrape、/crawl、/search)。在 1K-URL 效能測試中,比 Tavily 快 2.3 倍、比 Firecrawl 快 1.5 倍。僅需 6 MB RAM、單一執行檔。可自架或使用託管雲端。
★ 955+87近 7 天星數變化 - #118★ 940-1近 7 天星數變化
- #119★ 933+1近 7 天星數變化
- #120★ 916+0近 7 天星數變化