跳到主要内容
buildradar
Sign in
主题 · web-crawling

web-crawling

标记 web-crawling 主题、收录中的开源项目,按星标数排序。

项目数
7
总星标数
51,732
平均星标数
7,390
占比
0.00%

常跟 web-crawling 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 web-crawling 主题的项目。

  • moli@lexmount

    最适合 AI 代理的无头浏览器。轻量、快速、高兼容性。以 Rust 编写。

    1,774
  • crawlee@apify

    Crawlee — 用于 Node.js 的网页抓取与浏览器自动化库,支持 JavaScript 与 TypeScript。可为 AI、LLM、RAG 或 GPT 抽取数据,下载 HTML、PDF、JPG、PNG 等文件,兼容 Puppeteer、Playwright、Cheerio、JSDOM 与原始 HTTP,支持有头与无头模式,并提供代理轮换。

    25,622+66近 7 天星标变化
  • crawlee-python@apify

    Crawlee — 用于 Python 的网页抓取和浏览器自动化库,用于构建可靠的爬虫。提取 AI、LLM、RAG 或 GPT 的数据,下载 HTML、PDF、JPG、PNG 等文件,兼容 Parsel、BeautifulSoup、Playwright 与原始 HTTP,支持有头和无头模式,并具代理轮换功能。

    9,481+4近 7 天星标变化
  • ferret@MontFerret

    声明式数据自动化语言与 Go 运行时,用于结构化抽取工作流。

    6,009+1近 7 天星标变化
  • botasaurus@omkarcloud

    一体化框架,打造无懈可击的爬虫

    5,695+3近 7 天星标变化
  • brightdata-mcp@brightdata

    一款强大的 Model Context Protocol (MCP) 服务器,为公开网络访问提供全方位解决方案。

    2,624+10近 7 天星标变化
  • moli@lexmount

    最适合 AI 代理的无头浏览器。轻量、快速、高兼容性。以 Rust 编写。

    1,774+331近 7 天星标变化
  • Craw4LLM@cxcscmu

    “Craw4LLM: Efficient Web Crawling for LLM Pretraining”官方仓库

    664+1近 7 天星标变化
← 返回主题列表