跳到主要內容
buildradar
Sign in
主題 · crawler

crawler

標記 crawler 主題、收錄中的開源專案,依星數排序。

共 153 個專案
  • sperm@darbra

    瀏覽過的精彩逆向文章彙總,值得一看

    1,410+0近 7 天星數變化
  • mlscraper@lorey

    🤖 僅需提供範例即可從 HTML 網站自動擷取資料

    1,386+1近 7 天星數變化
  • crawler@kgspider

    K 哥爬蟲程式碼分享,JS 逆向,爬蟲進階。關注公眾號:K哥爬蟲

    1,379+0近 7 天星數變化
  • wombat@felipecsl

    輕量級 Ruby 網路爬蟲/擷取工具,具有優雅的 DSL,可從頁面中萃取結構化資料。

    1,360+0近 7 天星數變化
  • XSRFProbe@0xInfection

    頂尖的跨站請求偽造(CSRF)審計與利用工具包。

    1,303+1近 7 天星數變化
  • 📝 快速爬取 Instagram 個人檔案資訊(例如:粉絲、標籤等...)。

    1,302+1近 7 天星數變化
  • go-dork@dwisiswant0

    用 Go 語言編寫的最快 Dork 掃描器。

    1,302+0近 7 天星數變化
  • boss-zhipin-scraper@eatmoreduck

    Boss直聘爬蟲 / BOSS直聘職位資料抓取工具,基於 Chrome CDP 協議復用真實登入態,繞過字體反爬,輸出明文薪資 JSON/CSV + 薪資技能分析。A Chrome-CDP-based BOSS Zhipin job scraper/crawler.

    1,282+33近 7 天星數變化
  • Beanbun@kiddyuchina

    Beanbun 是用 PHP 編寫的多行程網路爬蟲框架,具有良好的開放性、高可擴充性,基於 Workerman。

    1,258-1近 7 天星數變化
  • 一個好用的嗶哩嗶哩漫畫下載器,擁有圖形介面,支援關鍵字搜尋漫畫和二維碼登入,黑科技下載未解鎖章節,多執行緒下載,多種儲存格式,本地漫畫管理,一鍵檢查更新!

    1,243+1近 7 天星數變化
  • AppCrawler@seveniruby

    基於 appium 的 App 自動遍歷工具

    1,237+0近 7 天星數變化
  • tumblr-crawler@dixudx

    輕鬆下載 tumblr 部落格的所有相片/影片。下載指定的 Tumblr 博客中的圖片,視頻

    1,157+0近 7 天星數變化
  • newspaper4k@AndyTheFactory

    📰 Newspaper4k,備受喜愛的 Newspaper3k 的分支。從新聞網站擷取文章、標題與中繼資料。

    1,141+1近 7 天星數變化
  • fess@codelibs

    基於 OpenSearch 建構的開源、自架企業與網站搜尋伺服器。支援網頁/檔案/資料庫/雲端來源爬取、20 種以上語言、REST API 以及 AI/RAG 與語意搜尋。採用 Apache-2.0 授權。

    1,128+1近 7 天星數變化
  • browsertrix-crawler@webrecorder

    在單一 Docker 容器中執行高傳真基於瀏覽器的網頁歸檔爬蟲

    1,127+5近 7 天星數變化
  • crawly@elixir-crawly

    Crawly,一個適用於 Elixir 的高階網路爬蟲與資料擷取框架。

    1,116+2近 7 天星數變化
  • kimuraframework@vifreefly

    使用簡潔、AI 輔助的 DSL 在 Ruby 中編寫網路爬蟲。Kimurai 利用 AI 來找出資料所在位置,然後快取選取器並使用純 Ruby 進行爬取。獲得 LLM 的智慧,而無需付出每次請求的延遲或 Token 成本。

    1,102+0近 7 天星數變化
  • scrapfly-scrapers@scrapfly

    適用於 40 多個熱門域名的可擴充 Python 網路爬蟲腳本

    1,076+4近 7 天星數變化
  • parse-video@wujunwei928

    Golang短影片去水印:抖音、皮皮蝦、火山、微視、最右、快手、全民小影片、皮皮搞笑、西瓜影片、虎牙、梨影片、acfun、好看影片...

    1,032+10近 7 天星數變化
  • 小說下載、小說爬蟲、起點、筆趣閣、匯出 Markdown、匯出 txt、轉換 epub、廣告過濾、自動校對

    1,017+8近 7 天星數變化
  • wreq@0x676e67

    一個符合人體工學且注重隱私的 Rust HTTP Client

    1,017+12近 7 天星數變化
  • google-play-scraper@JoMingyu

    受 <facundoolano/google-play-scraper> 啟發的 Python Google Play 爬蟲

    1,010+2近 7 天星數變化
  • Pxer@pea3nut

    一個 pixiv.net 的工具。人人可用的 P 站爬蟲

    1,009-1近 7 天星數變化
  • stormcrawler@apache

    基於 Apache Storm 的可擴展、成熟且多功能的網頁爬蟲

    994+1近 7 天星數變化
  • SpiderSuite@spidersuite

    SpiderSuite(網頁安全爬蟲)版本釋出、wiki 與發展藍圖

    974+1近 7 天星數變化
  • crawler@fredwu

    基於 Elixir 的高效能網路爬蟲 / 擷取器。

    956+0近 7 天星數變化
  • crw@us

    用 Rust 寫的快速、輕量級 Firecrawl/Tavily 替代方案。具備 MCP 伺服器的網頁爬蟲、抓取與搜尋 API,專為 AI agent 設計。相容 Firecrawl API(/scrape、/crawl、/search)。在 1K-URL 效能測試中,比 Tavily 快 2.3 倍、比 Firecrawl 快 1.5 倍。僅需 6 MB RAM、單一執行檔。可自架或使用託管雲端。

    955+87近 7 天星數變化
  • x-kit@xiaoxiunique

    適用於 X.com 的純 Python 協定工具與研究筆記,包含 VibeLoft Twitter 帳號資料集

    940-1近 7 天星數變化
  • icrawler@hellock

    一個多執行緒爬蟲框架,內建多種圖片爬蟲。

    933+1近 7 天星數變化
  • chatWeb@SkywalkerDarren

    ChatWeb 可以爬取網頁、閱讀 PDF、DOCX、TXT 並萃取主要內容,然後根據內容回答你的問題,或總結重點。

    916+0近 7 天星數變化
← 返回主題列表