跳到主要内容
buildradar
登录
主题 · scraper

scraper

标记 scraper 主题、收录中的开源项目,按星标数排序。

共 114 个项目
  • google-play-scraper@facundoolano

    从 Google Play 获取数据的 Node.js 爬虫

    2,956+0近 7 天星标变化
  • 逐步学习如何使用 Python 和 Oxylabs SERP API 抓取 Google Trends 数据并进行结果比较。提取关键词、其受欢迎程度、按地区划分的数据、相关查询等。

    2,909+0近 7 天星标变化
  • geziyor@geziyor

    Geziyor,适用于 Go 的极速网页爬虫与数据抓取框架。支持 JS 渲染。

    2,776+0近 7 天星标变化
  • metascraper@microlinkhq

    使用 Open Graph、JSON-LD、HTML meta 标签与智能后备机制,从任何 URL 抓取元数据。

    2,734+0近 7 天星标变化
  • twscrape@vladkens

    用于 X/Twitter 爬取的 Python 库与 CLI,支持多账号轮替与内置速率限制处理。

    2,732+0近 7 天星标变化
  • QueryList@jae-jae

    优雅的渐进式 PHP 爬虫框架。

    2,690+0近 7 天星标变化
  • 从 Reddit 下载并归档内容

    2,608+0近 7 天星标变化
  • anakin@Anakin-Inc

    开源网页抓取 API。将任何网站转为整洁的 markdown 或结构化 JSON。具备防检测浏览器、代理服务器自动选择、可自托管等特性。一行指令:make up

    2,599+0近 7 天星标变化
  • WaterCrawl@watercrawl

    将网页内容转换为适合 LLM 使用的数据

    2,158+0近 7 天星标变化
  • TikTok-Live-Connector@zerodytrash

    用 Node.js 库从 TikTok LIVE 实时接收直播事件(评论、礼物等)。

    2,139+0近 7 天星标变化
  • DevDocs@cyberagiinc

    完全免费、具隐私性且基于 UI 的技术文档 MCP 服务器。专为程序员与软件开发人员设计。可轻松集成至 Cursor、Windsurf、Cline、Roo Code、Claude Desktop App

    2,105+0近 7 天星标变化
  • NewPipeExtractor@TeamNewPipe

    NewPipe 的核心函式库,用于从串流网站撷取资料

    1,960+0近 7 天星标变化
  • 学习如何使用 Python 与 Oxylabs 的 Google Jobs Scraper API,构建能同时为多个搜索查询与地理位置爬取 Google Jobs 的自定义爬虫。https://oxylabs.io/blog/how-to-scrape-google-jobs

    1,767+0近 7 天星标变化
  • Google Play 爬虫,用于收集应用程序、游戏、电影与电视节目、书籍等的公开详细信息。

    1,757+0近 7 天星标变化
  • node-website-scraper@website-scraper

    将网站下载到本地目录(包含所有 css、图片、js 等)

    1,751+0近 7 天星标变化
  • selectolax@rushter

    Modest 与 Lexbor 引擎的 Python 绑定。适用于 Python、支持 CSS 选择器的快速 HTML5 解析器。

    1,671+0近 7 天星标变化
  • informer@paulpierre

    用 Python 写的 Telegram 大规模监控 Bot

    1,662+0近 7 天星标变化
  • bot@GramAddict

    完全免费且开源的类人 Instagram 机器人。由 UIAutomator2 驱动,基本上兼容于任何能运行 Instagram 的 5.0+ Android 设备——实体或模拟器皆可。

    1,634+0近 7 天星标变化
  • Scweet@Altimis

    从 Twitter/X 抓取推文、个人资料、粉丝与关注中,无需 API 密钥。具备智能多账号池化、代理支持与异步的 Python 库。

    1,607+0近 7 天星标变化
  • osi.ig@th3unkn0n

    Instagram 信息搜集工具。

    1,554+0近 7 天星标变化
  • animdl@justfoolingaround

    一个高效、快速、强大且轻量级的动漫下载与串流播放器,用于观看你喜爱的动漫。

    1,522+0近 7 天星标变化
  • Episode-ReName@Nriver

    电视剧/番剧自动化重命名工具,一键批量改名。可配合 QBittorrent 下载后自动重命名,方便 Emby 自动刮削。支持 Windows、Linux、MacOS、Docker 和群晖套件环境运行

    1,491+0近 7 天星标变化
  • wreq-python@0x676e67

    一个符合人体工程学且注重隐私的 Python HTTP 客户端

    1,438+0近 7 天星标变化
  • mlscraper@lorey

    🤖 仅需提供示例即可从 HTML 网站自动抓取数据

    1,386+0近 7 天星标变化
  • wombat@felipecsl

    轻量级 Ruby 网络爬虫/抓取工具,具有优雅的 DSL,可从页面中提取结构化数据。

    1,360+0近 7 天星标变化
  • instagram-crawler@huaying

    无需使用 Instagram API 即可获取 Instagram 贴文、个人档案与标签数据

    1,352+0近 7 天星标变化
  • finviz@mariostoev

    finviz.com 的非官方 API

    1,332+0近 7 天星标变化
  • cinemagoer@cinemagoer

    Cinemagoer 是一个 Python 软件包,可用于检索和管理 IMDb(我们与其无任何关联)电影数据库中关于电影、人员和角色的数据

    1,323+0近 7 天星标变化
  • AnimeGarden@yjl9903

    动漫花园镜像站 | 动画 BT 资源聚合站 | 动画 BT 资源开放接口

    1,301+0近 7 天星标变化
  • boss-zhipin-scraper@eatmoreduck

    Boss直聘爬虫 / BOSS直聘职位数据抓取工具,基于 Chrome CDP 协议复用真实登录态,绕过字体反爬,输出明文薪资 JSON/CSV + 薪资技能分析。A Chrome-CDP-based BOSS Zhipin job scraper/crawler.

    1,282+0近 7 天星标变化
← 返回主题列表