Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · scraper

scraper

Các kho mã nguồn mở đang theo dõi được gắn thẻ scraper, sắp xếp theo số sao.

Kho mã
114
Tổng số sao
640.059
Số sao trung bình
5.615
Tỷ trọng
0,03%

Những chủ đề thường xuất hiện cùng scraper trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ scraper.

  • boss-zhipin-scraper@eatmoreduck

    Trình thu thập dữ liệu việc làm BOSS Zhipin dựa trên giao thức Chrome CDP để tái sử dụng trạng thái đăng nhập thực tế, vượt qua cơ chế chống thu thập font chữ, xuất dữ liệu lương dạng văn bản thuần túy JSON/CSV + phân tích kỹ năng lương.

    1.256
  • trawl@germondai

    Công cụ scraping tự lưu trữ — vượt qua mọi thử thách JS và captcha: Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Giải pháp thay thế cho FlareSolverr và Byparr cho ngăn xếp *arr của bạn.

    742
  • firecrawl@firecrawl

    Context API để tìm kiếm, thu thập dữ liệu và tương tác với web ở quy mô lớn. 🔥

    174.034+3.406Thay đổi số sao trong 7 ngày qua
  • huginn@huginn

    Tạo các agent giám sát và hành động thay cho bạn. Các agent của bạn đã sẵn sàng!

    49.872+40Thay đổi số sao trong 7 ngày qua
  • EasySpider@NaiboWang

    Một công cụ thu thập thông tin/quét web trực quan không cần mã (no-code/code-free). 易采集 (Dịch vụ thu thập dễ dàng): Một phần mềm kiểm thử tự động hóa trình duyệt/thu thập dữ liệu/quét web trực quan, có thể thiết kế và thực thi các tác vụ quét web bằng đồ họa không cần mã. Tên khác: ServiceWrapper - hệ thống đóng gói dịch vụ thông minh dành cho ứng dụng Web.

    44.470+72Thay đổi số sao trong 7 ngày qua
  • lux@iawia002

    👾 Thư viện tải xuống video và công cụ CLI nhanh chóng, đơn giản được viết bằng Go

    31.659+21Thay đổi số sao trong 7 ngày qua
  • cheerio@cheeriojs

    Thư viện nhanh chóng, linh hoạt và thanh lịch để phân tích và thao tác HTML, XML.

    30.471+11Thay đổi số sao trong 7 ngày qua
  • crawlee@apify

    Crawlee—Một thư viện cào web và tự động hóa trình duyệt dành cho Node.js để xây dựng các trình thu thập dữ liệu đáng tin cậy. Bằng JavaScript và TypeScript. Trích xuất dữ liệu cho AI, LLMs, RAG hoặc GPTs. Tải xuống HTML, PDF, JPG, PNG và các tệp khác từ trang web. Hoạt động với Puppeteer, Playwright, Cheerio, JSDOM và HTTP thô. Cả chế độ hiển thị giao diện và không có giao diện. Có tính năng xoay proxy.

    25.556+98Thay đổi số sao trong 7 ngày qua
  • colly@gocolly

    Framework cào web và thu thập dữ liệu thanh lịch dành cho Golang

    25.488+26Thay đổi số sao trong 7 ngày qua
  • 🚀「Douyin_TikTok_Download_API」là một công cụ cào dữ liệu Douyin, Kuaishou, TikTok, Bilibili hiệu suất cao bất đồng bộ, sẵn sàng sử dụng ngay, hỗ trợ gọi API, phân tích và tải xuống hàng loạt trực tuyến.

    19.727+192Thay đổi số sao trong 7 ngày qua
  • maxun@getmaxun

    🔥 Nền tảng no-code mã nguồn mở để cào web, thu thập, tìm kiếm và trích xuất dữ liệu AI • Biến các trang web thành API có cấu trúc trong vài phút 🔥

    17.322+70Thay đổi số sao trong 7 ngày qua
  • newspaper@codelucas

    newspaper3k là công cụ trích xuất tin tức, toàn bộ văn bản và dữ liệu tả (metadata) bài viết trong Python 3. Tài liệu nâng cao:

    15.146+8Thay đổi số sao trong 7 ngày qua
  • avbook@guyueyingmu

    Hệ thống quản lý phim AV, crawler avmoo, javbus, javlibrary, thư viện phim AV trực tuyến, cơ sở dữ liệu liên kết magnet AV, Thư viện phim người lớn Nhật Bản, Liên kết Magnet phim người lớn - Cơ sở dữ liệu phim người lớn Nhật Bản

    10.044+10Thay đổi số sao trong 7 ngày qua
  • crawlee-python@apify

    Crawlee—Một thư viện cào web và tự động hóa trình duyệt dành cho Python để xây dựng các trình thu thập dữ liệu đáng tin cậy. Trích xuất dữ liệu cho AI, LLMs, RAG hoặc GPTs. Tải xuống HTML, PDF, JPG, PNG và các tệp khác từ các trang web. Hoạt động với Parsel, BeautifulSoup, Playwright và HTTP thô. Cả chế độ hiển thị giao diện và chạy ẩn. Hỗ trợ xoay proxy.

    9.477+19Thay đổi số sao trong 7 ngày qua
  • autoscraper@alirezamika

    Công cụ cào dữ liệu web thông minh, tự động, nhanh chóng và nhẹ cho Python

    7.915+25Thay đổi số sao trong 7 ngày qua
  • Một bộ sưu tập các web crawler và spider tuyệt vời bằng nhiều ngôn ngữ khác nhau.

    7.298+6Thay đổi số sao trong 7 ngày qua
  • rod@go-rod

    Một driver Chrome DevTools Protocol dành cho tự động hóa web và scraping.

    7.082+14Thay đổi số sao trong 7 ngày qua
  • llm-scraper@mishushakov

    Biến bất kỳ trang web nào thành dữ liệu có cấu trúc bằng LLM

    6.917+2Thay đổi số sao trong 7 ngày qua
  • Website-downloader@AhmadIbrahiim

    💡 Tải xuống toàn bộ mã nguồn của bất kỳ trang web nào (bao gồm mọi tài sản) [Javascript, Stylesheets, Hình ảnh] bằng Node.js

    5.274+76Thay đổi số sao trong 7 ngày qua
  • browser-fingerprinting@niespodd

    Phân tích các hệ thống bảo vệ bot kèm theo các biện pháp đối phó có sẵn 🚿. Cách vượt qua hệ thống chống bot 👻 và né tránh các tập lệnh lấy dấu vân tay trình duyệt 🕵️‍♂️ khi thu thập dữ liệu web?

    5.129+3Thay đổi số sao trong 7 ngày qua
  • pipet@bjesus

    Công cụ vạn năng để cào và trích xuất dữ liệu từ các tài nguyên trực tuyến, dành cho hacker

    4.771+1Thay đổi số sao trong 7 ngày qua
  • node-ytdl-core@fent

    Trình tải xuống video YouTube bằng JavaScript.

    4.730+0Thay đổi số sao trong 7 ngày qua
  • twikit@d60

    Trình cào dữ liệu Twitter API | Không cần khóa API | API nội bộ Twitter | Miễn phí | Trình cào Twitter | Bot Twitter

    4.638+11Thay đổi số sao trong 7 ngày qua
  • linkedin_scraper@joeyism

    Thư viện trích xuất dữ liệu người dùng từ LinkedIn

    4.458+15Thay đổi số sao trong 7 ngày qua
  • myGPTReader@myreader-io

    Cách do cộng đồng thúc đẩy để đọc và trò chuyện với bot AI - được hỗ trợ bởi chatGPT.

    4.418-1Thay đổi số sao trong 7 ngày qua
  • UltimaScraper@UltimaHoarder

    Trích xuất toàn bộ tệp đa phương tiện từ một tài khoản OnlyFans - Được cập nhật thường xuyên

    4.271-2Thay đổi số sao trong 7 ngày qua
  • scrape-it@IonicaBizau

    🔮 Một công cụ scraper Node.js thân thiện dành cho con người.

    4.073-2Thay đổi số sao trong 7 ngày qua
  • Một plugin trình cào phim Nhật Bản dành cho Emby/Jellyfin, có thể lấy thông tin phim từ một số trang web.

    3.796-2Thay đổi số sao trong 7 ngày qua
  • cariddi@edoardottt

    Nhận danh sách tên miền, thu thập URL và quét các điểm cuối, thông tin mật, khóa API, phần mở rộng tệp, mã thông báo và nhiều hơn nữa

    3.756+6Thay đổi số sao trong 7 ngày qua
  • mdcx@sqzw-x

    Công cụ thu thập siêu dữ liệu phim

    3.725-6Thay đổi số sao trong 7 ngày qua
  • Bạn muốn HỌC KIẾN THỨC MỚI MIỄN PHÍ? Đừng lo, với sức mạnh của web-scraping và tự động hóa, tập lệnh này sẽ tìm các mã giảm giá Udemy cần thiết và đăng ký các KHÓA HỌC UDEMY CÓ PHÍ HOÀN TOÀN MIỄN PHÍ cho bạn!

    3.291+3Thay đổi số sao trong 7 ngày qua
  • CyberScraper-2077@itsOwen

    Công cụ cào web (web scraper) mạnh mẽ được hỗ trợ bởi LLM | OpenAI, Gemini & Ollama

    3.250+27Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề