跳到主要内容
buildradar
登录
主题 · web-scraping

web-scraping

标记 web-scraping 主题、收录中的开源项目,按星标数排序。

共 119 个项目
  • 一个具备隐匿功能的浏览器自动化框架

    861-3近 7 天星标变化
  • spidr@postmodern

    一个功能多样的 Ruby 网络爬虫库,可以爬取网站、多个域、特定链接或进行无限爬取。Spidr 的设计宗旨是快速且易于使用。

    836+0近 7 天星标变化
  • Uscrapper@z0m31en7

    Uscrapper Vanta:通过此强大的开源工具深入探索网络。轻松高效地从表面网络与深层网络来源提取有价值的洞察。利用 Vanta 的进阶功能增强您的数据挖掘与分析能力。快速、可靠且易于使用,Uscrapper Vanta 是研究人员与分析师的最佳选择。

    796+5近 7 天星标变化
  • trawl@germondai

    自托管爬虫引擎 — 可绕过任何 JS 挑战与验证码:Cloudflare、Turnstile、reCAPTCHA、hCaptcha、GeeTest。作为 FlareSolverr 与 Byparr 的替代方案,可直接替换至您的 *arr 堆栈中。

    793+26近 7 天星标变化
  • patchright-nodejs@Kaliiiiiiiiii-Vinyzu

    Playwright 测试与自动化库的未检测(Undetected)NodeJS 版本。

    778+5近 7 天星标变化
  • 使用 Google Sheets 进行基础网页爬虫指南

    764-1近 7 天星标变化
  • 通过 SERP API 获取 Google 搜索结果的 Python 软件包

    755+2近 7 天星标变化
  • neo@4ier

    将任何网页应用程序转换为 API。通过 Chrome 扩展程序捕获浏览器流量、自动生成 Schema,并让 AI 直接重新执行 API。无需官方 API。

    751+0近 7 天星标变化
  • gpt-promo-scanner@JUk1-GH

    ChatGPT Team(Business) 促销码自动扫描工具 — 批量发现/验证/价格收集,支持 17 国 34 个码,最高折扣 71% | ChatGPT Business promo code scanner — batch discovery, validation, price collection, 34 codes across 17 countries, up to 71% off

    733+7近 7 天星标变化
  • scrapecraft@ScrapeGraphAI

    🤖 具备可视化工作流程构建器的 AI 网页爬虫编辑器。通过自然语言构建、测试与部署网页爬虫。由 ScrapeGraphAI 与 LangGraph 驱动。

    695+4近 7 天星标变化
  • figranium@figranium

    通过可视化堆叠区块来建立复杂的浏览器工作流程,并通过 API 执行

    693+27近 7 天星标变化
  • deepcrawl@lumpinif

    100% 免费且完全开源的 Firecrawl 替代方案,具备更佳的 agent 链接提取功能,可自行部署至 cloudflare 或 vercel。

    669+3近 7 天星标变化
  • 通过远程云端会话执行复杂的自动化脚本,具备集成式住宅代理、自动验证码解决机制,以及针对最棘手动态网站的原生 JavaScript 渲染功能。

    666+0近 7 天星标变化
  • 数据科学项目的完整生命周期

    653+0近 7 天星标变化
  • 一款适用于央视网的网络视频流解析处理工具

    638+9近 7 天星标变化
  • google-search@web-agent-master

    一个基于 Playwright 的 Node.js 工具,可绕过搜索引擎的反爬虫机制执行 Google 搜索。集成 MCP 服务器的 SERP API 本地替代方案。

    622+1近 7 天星标变化
  • PHPScraper@spekulatius

    一个通用的 PHP 网页工具。

    588+0近 7 天星标变化
  • primp@deedy5

    可模拟网页浏览器 TLS/HTTP2 指纹的 HTTP 客户端。

    587+5近 7 天星标变化
  • social-media-profile-scrapers@shaikhsajid1111

    跨社交媒体获取用户数据

    573+1近 7 天星标变化
  • Automate scraping hotel data including pricing, availability, ratings, and booking providers with a Google Hotels API integration.

    566近 7 天星标变化
  • Stealth-Requests@jpjacobpadilla

    Python 中隐蔽的网页爬虫与无缝 HTML 解析工具!

    563+2近 7 天星标变化
  • reader@vakra-dev

    用于 AI 的开源网页基础设施。支持网页抓取、爬虫、自动化、Markdown 清理与浏览器会话,为你的 Agent 做好准备。

    560+2近 7 天星标变化
  • 通过 Basketball Reference 获取 NBA 统计数据的 API

    556+0近 7 天星标变化
  • ketch@1broseidon

    专为 AI 代理设计的快速、无状态网页搜索与抓取 CLI

    550+12近 7 天星标变化
  • jekyll@programminghistorian

    基于 Jekyll 的 The Programming Historian 静态网站。

    548+1近 7 天星标变化
  • 哔哩哔哩 (bilibili) 评论区数据可视化分析软件,协助 UP 主指导选题并厘清粉丝群体。

    528+0近 7 天星标变化
  • browser-search@Johell1NS

    A skill for AI agents: search the web with SearXNG, browse with Camofox, bypass protections with CloakBrowser. Anti-hallucination by design. Self-hosted, free, unlimited.

    515+1近 7 天星标变化
  • Python 快速入门指南,协助您充分利用 Oxylabs Web Scraper API 免费试用版。

    512-1近 7 天星标变化
  • scrapple@AlexMathew

    用于创建半自动网页内容提取器的框架

    504+0近 7 天星标变化
← 返回主题列表