scraper
标记 scraper 主题、收录中的开源项目,按星标数排序。
- #31
从 Google Play 获取数据的 Node.js 爬虫
★ 2,956+0近 7 天星标变化 - #32
逐步学习如何使用 Python 和 Oxylabs SERP API 抓取 Google Trends 数据并进行结果比较。提取关键词、其受欢迎程度、按地区划分的数据、相关查询等。
★ 2,909+0近 7 天星标变化 - #33★ 2,776+0近 7 天星标变化
- #34
使用 Open Graph、JSON-LD、HTML meta 标签与智能后备机制,从任何 URL 抓取元数据。
★ 2,734+0近 7 天星标变化 - #35★ 2,732+0近 7 天星标变化
- #36★ 2,690+0近 7 天星标变化
- #37
从 Reddit 下载并归档内容
★ 2,608+0近 7 天星标变化 - #38★ 2,599+0近 7 天星标变化
- #39
将网页内容转换为适合 LLM 使用的数据
★ 2,158+0近 7 天星标变化 - #40
用 Node.js 库从 TikTok LIVE 实时接收直播事件(评论、礼物等)。
★ 2,139+0近 7 天星标变化 - #41
完全免费、具隐私性且基于 UI 的技术文档 MCP 服务器。专为程序员与软件开发人员设计。可轻松集成至 Cursor、Windsurf、Cline、Roo Code、Claude Desktop App
★ 2,105+0近 7 天星标变化 - #42
NewPipe 的核心函式库,用于从串流网站撷取资料
★ 1,960+0近 7 天星标变化 - #43
学习如何使用 Python 与 Oxylabs 的 Google Jobs Scraper API,构建能同时为多个搜索查询与地理位置爬取 Google Jobs 的自定义爬虫。https://oxylabs.io/blog/how-to-scrape-google-jobs
★ 1,767+0近 7 天星标变化 - #44
Google Play 爬虫,用于收集应用程序、游戏、电影与电视节目、书籍等的公开详细信息。
★ 1,757+0近 7 天星标变化 - #45
将网站下载到本地目录(包含所有 css、图片、js 等)
★ 1,751+0近 7 天星标变化 - #46
Modest 与 Lexbor 引擎的 Python 绑定。适用于 Python、支持 CSS 选择器的快速 HTML5 解析器。
★ 1,671+0近 7 天星标变化 - #47★ 1,662+0近 7 天星标变化
- #48
完全免费且开源的类人 Instagram 机器人。由 UIAutomator2 驱动,基本上兼容于任何能运行 Instagram 的 5.0+ Android 设备——实体或模拟器皆可。
★ 1,634+0近 7 天星标变化 - #49★ 1,607+0近 7 天星标变化
- #50★ 1,554+0近 7 天星标变化
- #51★ 1,522+0近 7 天星标变化
- #52
电视剧/番剧自动化重命名工具,一键批量改名。可配合 QBittorrent 下载后自动重命名,方便 Emby 自动刮削。支持 Windows、Linux、MacOS、Docker 和群晖套件环境运行
★ 1,491+0近 7 天星标变化 - #53
一个符合人体工程学且注重隐私的 Python HTTP 客户端
★ 1,438+0近 7 天星标变化 - #54★ 1,386+0近 7 天星标变化
- #55★ 1,360+0近 7 天星标变化
- #56
无需使用 Instagram API 即可获取 Instagram 贴文、个人档案与标签数据
★ 1,352+0近 7 天星标变化 - #57★ 1,332+0近 7 天星标变化
- #58
Cinemagoer 是一个 Python 软件包,可用于检索和管理 IMDb(我们与其无任何关联)电影数据库中关于电影、人员和角色的数据
★ 1,323+0近 7 天星标变化 - #59
动漫花园镜像站 | 动画 BT 资源聚合站 | 动画 BT 资源开放接口
★ 1,301+0近 7 天星标变化 - #60
Boss直聘爬虫 / BOSS直聘职位数据抓取工具,基于 Chrome CDP 协议复用真实登录态,绕过字体反爬,输出明文薪资 JSON/CSV + 薪资技能分析。A Chrome-CDP-based BOSS Zhipin job scraper/crawler.
★ 1,282+0近 7 天星标变化