Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · scrapy

scrapy

Các kho mã nguồn mở đang theo dõi được gắn thẻ scrapy, sắp xếp theo số sao.

Kho mã
30
Tổng số sao
69.876
Số sao trung bình
2.329
Tỷ trọng
0,00%

Những chủ đề thường xuất hiện cùng scrapy trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ scrapy.

Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.

  • crawlab@crawlab-team

    Nền tảng quản lý trình thu thập dữ liệu web phân tán để quản lý các spider bất kể ngôn ngữ và framework.

    12.268+6Thay đổi số sao trong 7 ngày qua
  • WechatSogou@chyroc

    Giao diện cào dữ liệu WeChat Official Account dựa trên Sogou WeChat Search

    6.378+1Thay đổi số sao trong 7 ngày qua
  • ECommerceCrawlers@DropsDevopsOrg

    Trình thu thập dữ liệu web và thương mại điện tử thực chiến bằng Python.

    5.670+6Thay đổi số sao trong 7 ngày qua
  • scrapy-redis@rmax

    Các thành phần dựa trên Redis cho Scrapy.

    5.643+1Thay đổi số sao trong 7 ngày qua
  • WeiboSpider@nghuyong

    Công cụ thu thập dữ liệu Sina Weibo được duy trì liên tục 🚀🚀🚀

    4.112+3Thay đổi số sao trong 7 ngày qua
  • feapder@Boris-code

    🚀🚀🚀 feapder là một framework crawler dễ sử dụng và mạnh mẽ. Tích hợp sẵn bốn loại crawler AirSpider, Spider, TaskSpider, BatchSpider để giải quyết các nhu cầu trong các kịch bản khác nhau. Hỗ trợ tiếp tục cào dữ liệu khi ngắt, giám sát cảnh báo, kết xuất trình duyệt, khử trùng lặp dữ liệu lớn và nhiều tính năng khác. Cùng với hệ thống quản lý crawler mạnh mẽ feaplat hỗ trợ triển khai và điều phối thuận tiện

    3.732-3Thay đổi số sao trong 7 ngày qua
  • Gerapy@Gerapy

    Framework quản lý crawler phân tán dựa trên Scrapy, Scrapyd, Django và Vue.js

    3.512+0Thay đổi số sao trong 7 ngày qua
  • scrapydweb@my8100

    Ứng dụng web quản lý cụm Scrapyd, phân tích và trực quan hóa nhật ký Scrapy, tự động đóng gói, tác vụ hẹn giờ, giám sát & cảnh báo, cùng giao diện di động. Tài liệu 文档 :point_right:

    3.411+1Thay đổi số sao trong 7 ngày qua
  • scrapy-splash@scrapy-plugins

    Scrapy kết hợp Splash để tích hợp JavaScript

    3.227+0Thay đổi số sao trong 7 ngày qua
  • Image-Downloader@QianyanTech

    Tải xuống hình ảnh từ Google, Bing, Baidu.

    2.360-2Thay đổi số sao trong 7 ngày qua
  • Kho lưu trữ dự án mở về cào web nhằm chia sẻ kiến thức và kinh nghiệm về web scraping bằng Python

    1.735+0Thay đổi số sao trong 7 ngày qua
  • advertools@eliasdabbas

    advertools - các công cụ phân tích và năng suất tiếp thị trực tuyến

    1.450+3Thay đổi số sao trong 7 ngày qua
  • scrapy-playwright@scrapy-plugins

    🎭 Tích hợp Playwright cho Scrapy

    1.442+3Thay đổi số sao trong 7 ngày qua
  • domains@tb0hdan

    Bộ dữ liệu tên miền Internet đơn lẻ lớn nhất thế giới

    1.157+4Thay đổi số sao trong 7 ngày qua
  • spider_python@xingag

    Trình thu thập dữ liệu web bằng Python.

    1.151+0Thay đổi số sao trong 7 ngày qua
  • faster-than-requests@juancarlospaco

    Yêu cầu nhanh hơn trên Python 3

    1.128-1Thay đổi số sao trong 7 ngày qua
  • stealer@moyada

    抖音、快手、火山、皮皮虾,视频去水印程序

    1.128+0Thay đổi số sao trong 7 ngày qua
  • kimuraframework@vifreefly

    Viết web scraper bằng Ruby sử dụng một DSL sạch, được hỗ trợ bởi AI. Kimurai sử dụng AI để tìm vị trí của dữ liệu, sau đó lưu cache các bộ chọn và cào dữ liệu bằng Ruby thuần túy. Nhận sự thông minh của LLM mà không có độ trễ trên mỗi yêu cầu hoặc chi phí token.

    1.102+0Thay đổi số sao trong 7 ngày qua
  • scrapy-selenium@clemfromspace

    Scrapy middleware để xử lý các trang javascript sử dụng selenium

    950-1Thay đổi số sao trong 7 ngày qua
  • icrawler@hellock

    Khung crawl đa luồng với nhiều trình crawl hình ảnh tích hợp sẵn.

    933+0Thay đổi số sao trong 7 ngày qua
  • scrapyrt@scrapinghub

    HTTP API cho Scrapy spiders

    883+0Thay đổi số sao trong 7 ngày qua
  • API hiệu năng cao hỗ trợ bất đồng bộ cho Douyin, TikTok, Xiaohongshu, Kuaishou, Weibo, Instagram, YouTube, Twitter (X), giải mã Captcha và email tạm thời.

    876+11Thay đổi số sao trong 7 ngày qua
  • xianyu_spider@superboyyy

    Trình thu thập dữ liệu Xianyu, phát triển dựa trên phiên bản web của Xianyu, sử dụng FastAPI để xây dựng giao diện tìm kiếm sản phẩm, hỗ trợ yêu cầu bất đồng bộ và tự động khử trùng lặp dữ liệu. Hiện đã hỗ trợ đăng nhập.

    838+18Thay đổi số sao trong 7 ngày qua
  • alltheplaces@alltheplaces

    Bộ sưu tập các trình thu thập dữ liệu để trích xuất thông tin vị trí từ các trang web đăng tải địa điểm.

    821+2Thay đổi số sao trong 7 ngày qua
  • easy-scraping-tutorial@MorvanZhou

    Mã nguồn hướng dẫn web scraping bằng Python đơn giản nhưng hữu ích.

    820+1Thay đổi số sao trong 7 ngày qua
  • scrapy-rotating-proxies@TeamHG-Memex

    Sử dụng nhiều proxy với Scrapy

    772-1Thay đổi số sao trong 7 ngày qua
  • NewsCrawl@casual-silva

    Dự án trình thu thập tin tức dư luận cấp doanh nghiệp: hỗ trợ chạy một lần bất kỳ số lượng trình thu thập, tác vụ định kỳ, xóa hàng loạt; triển khai một lần; trực quan hóa giám sát; cấu hình chiến lược phân bổ cụm. Tài liệu triển khai Docker có sẵn.

    686+1Thay đổi số sao trong 7 ngày qua
  • spider-admin-pro@mouday

    spider-admin-pro là một công cụ quản lý trực quan tích hợp Scrapy+Scrapyd để xem dự án và lập lịch tác vụ爬虫, phiên bản nâng cấp của SpiderAdmin.

    613+0Thay đổi số sao trong 7 ngày qua
  • PHPScraper@spekulatius

    Một tiện ích web đa năng cho PHP.

    588+0Thay đổi số sao trong 7 ngày qua
  • scrapple@AlexMathew

    Một framework để tạo các trình trích xuất nội dung web bán tự động

    504+1Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề