跳到主要内容
buildradar
Sign in
主题 · webscraping

webscraping

标记 webscraping 主题、收录中的开源项目,按星标数排序。

项目数
42
总星标数
510,374
平均星标数
12,152
占比
0.03%

常跟 webscraping 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 webscraping 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • firecrawl@firecrawl

    提供大规模搜索、抓取与交互的 Context API。🔥

    175,781+1,747近 7 天星标变化
  • Scrapling@D4Vinci

    🕷️ 一个自适应的网络爬虫框架,能够处理单一请求到全规模爬取的所有需求!

    78,099+941近 7 天星标变化
  • huginn@huginn

    创建可监控并代替你执行操作的代理人。你的代理人已待命!

    49,881+9近 7 天星标变化
  • CloakBrowser@CloakHQ

    隐形 Chromium,通过所有机器人检测测试。可直接替代 Playwright,提供源代码层级的指纹修补。30/30 测试通过。

    31,110+163近 7 天星标变化
  • Scrapegraph-ai@ScrapeGraphAI

    基于 AI 的 Python 抓取工具

    30,435+388近 7 天星标变化
  • gpt-researcher@assafelovic

    一个使用任意 LLM 供应商进行深度研究的自主代理。

    29,262+62近 7 天星标变化
  • maxun@getmaxun

    🔥 开源无代码平台,用于网页爬取、爬虫、搜索与 AI 数据抽取 • 只需几分钟即可将网站转化为结构化 API 🔥

    17,349+27近 7 天星标变化
  • ani-cli@pystardust

    用于浏览与播放动画的 CLI 工具

    13,698+61近 7 天星标变化
  • SeleniumBase@seleniumbase

    📊 用于网页自动化、测试与绕过机器人检测的 API

    12,972+1近 7 天星标变化
  • camoufox@daijro

    🦊 防检测浏览器

    11,634+100近 7 天星标变化
  • awesome-web-scraping@lorien

    Web 抓取与数据处理的库、工具和 API 列表

    8,139+1近 7 天星标变化
  • autoscraper@alirezamika

    一个智慧、全自动、快速且轻量的 Python 网页爬虫

    7,932+17近 7 天星标变化
  • browser-fingerprinting@niespodd

    Bot 防护系统分析与可用对策 🚿。如何击败 anti‑bot 系统 👻 并在网页抓取时绕过浏览器指纹脚本 🕵️‍♂️

    5,131+2近 7 天星标变化
  • patchright@Kaliiiiiiiiii-Vinyzu

    未被检测的 Playwright 测试与自动化库版本

    4,255+37近 7 天星标变化
  • CyberScraper-2077@itsOwen

    一个由 LLM 驱动的强大网页爬虫 | OpenAI、Gemini & Ollama

    3,251+1近 7 天星标变化
  • 使用此自动申请工具自动化您的求职申请流程,让找工作变得更轻松

    2,769+22近 7 天星标变化
  • soup@anaskhan96

    用 Go 实现的网页爬虫,类似于 BeautifulSoup

    2,287+0近 7 天星标变化
  • tarsier@reworkd

    用于网页交互代理的视觉工具 👀

    1,761+0近 7 天星标变化
  • 网络爬虫开源项目仓库,旨在分享使用 Python 进行网络爬虫的知识与经验

    1,735+0近 7 天星标变化
  • CrossLinked@m8sec

    通过搜索引擎抓取从组织中提取有效员工姓名的 LinkedIn 枚举工具

    1,584+2近 7 天星标变化
  • requests-cache@requests-cache

    为 python requests 提供持久化 HTTP 缓存

    1,501+0近 7 天星标变化
  • patchright-python@Kaliiiiiiiiii-Vinyzu

    Playwright 测试与自动化库的未检测 Python 版本。

    1,492+5近 7 天星标变化
  • scrapeghost@jamesturk

    👻 使用 OpenAI 的 GPT API 进行网页爬虫的实验性库。

    1,442+0近 7 天星标变化
  • zendriver@cdpdriver

    基于 ultrafunkamsterdam/nodriver、极速且优先考虑异步、无法被侦测的网页抓取/网页自动化框架。现已支持 Docker!

    1,413+1近 7 天星标变化
  • parsera@raznem

    使用 LLM 进行网站爬虫的轻量级库

    1,353+3近 7 天星标变化
  • Google-Maps-Scrapper@zohaibbashir

    此代码用于执行 Google Maps 的网页抓取和数据提取。它专门用于获取企业信息,包括名称、地址、网站、电话号码、评价等。

    1,296+4近 7 天星标变化
  • mov-cli@mov-cli

    在终端中监看所有内容。

    1,294+1近 7 天星标变化
  • scrapfly-scrapers@scrapfly

    适用于 40 多个热门域名的可扩展 Python 网络爬虫脚本

    1,077+6近 7 天星标变化
  • ShardBrowser@ProxyShard

    免费、开源的防关联浏览器启动器,用于网络爬虫与多账号管理。由 ProxyShard 团队开发。内含 Chromium 148 的引擎级指纹伪装(WebGL / WebGPU / Client Hints / 字体 / TLS),内置 170+ 种设备配置文件,通过 SOCKS5 支持稳定的 QUIC + WebRTC。

    909+176近 7 天星标变化
  • xidel@benibela

    使用 CSS、XPath 3.0、XQuery 3.0、JSONiq 或模式匹配从 HTML/XML 页面或 JSON-API 下载并提取数据的命令行工具。它还可以创建新或转换后的 XML/HTML/JSON 文档。

    844+1近 7 天星标变化
← 返回主题列表