crawler
Repositori open source terpantau bertanda crawler, diurutkan berdasarkan bintang.
- #31
Praktik langsung berbagai crawler data situs web dan e-commerce. Termasuk: produk Taobao, akun resmi WeChat, Dazhong Dianping, Qichacha, situs rekrutmen, Xianyu, tugas Alibaba,博客园, Weibo, Baidu Tieba, ulasan film Douban, Baotu, Panorama, musik Douban, badan pengawas obat provinsi, berita Sohu, pengumpulan teks machine learning, pengumpulan aset fofa, Autohome, Biro Statistik Nasional, jumlah indeks kata kunci Baidu, direktori spider, Toutiao, ulasan film Douban, Ctrip, toko aplikasi Xiaomi, Anjuke, dan homestay Tujia.
★ 5.670+4Perubahan bintang dalam 7 hari terakhir - #32
Komponen berbasis Redis untuk Scrapy.
★ 5.643+1Perubahan bintang dalam 7 hari terakhir - #33
Analisis sistem perlindungan bot beserta penanggulangannya. Cara mengalahkan sistem anti-bot dan melewati skrip sidik jari peramban saat melakukan web scraping
★ 5.131+2Perubahan bintang dalam 7 hari terakhir - #34★ 4.767+29Perubahan bintang dalam 7 hari terakhir
- #35
Kumpulan kasus ilegal terkait web crawler di Tiongkok. Proyek ini mengumpulkan berita, materi, serta hukum dan regulasi terkait tuntutan hukum dan pelanggaran pengembang crawler di Tiongkok daratan, guna membantu praktisi industri crawler memahami hukum yang berlaku dan menghindari pelanggaran kepatuhan data.
★ 4.724+6Perubahan bintang dalam 7 hari terakhir - #36
Crawler Sina Weibo, menggunakan python untuk mengambil data Sina Weibo, serta mengunduh gambar dan video Weibo
★ 4.632+3Perubahan bintang dalam 7 hari terakhir - #37
Cara berbasis komunitas untuk membaca dan mengobrol dengan bot AI - ditenagai oleh chatGPT.
★ 4.417-1Perubahan bintang dalam 7 hari terakhir - #38
Alat pengunduh komik dan novel untuk berbagai platform seperti Tencent Comics, DaJiaoChong, YouYaoQi, Migu, SF Comics, dan banyak lagi, dengan output format epub.
★ 4.203+5Perubahan bintang dalam 7 hari terakhir - #39
Proxy [Finder | Checker | Server]. HTTP(S) & SOCKS :performing_arts:
★ 4.156-2Perubahan bintang dalam 7 hari terakhir - #40
DotnetSpider, pustaka web crawling standar .NET. Ini adalah kerangka kerja web crawling & scraping tingkat tinggi yang ringan, efisien, dan cepat
★ 4.138+0Perubahan bintang dalam 7 hari terakhir - #41
Kumpulan proxy cerdas untuk manusia™ guna mengekstrak konten dari internet dan membangun Large Language Models Anda sendiri di era AI baru ini
★ 4.020+1Perubahan bintang dalam 7 hari terakhir - #42
API .NET untuk Headless Chrome.
★ 3.917+1Perubahan bintang dalam 7 hari terakhir - #43
Mengambil daftar domain, merayapi URL, dan memindai endpoint, rahasia, kunci API, ekstensi file, token, dan lainnya
★ 3.758+2Perubahan bintang dalam 7 hari terakhir - #44
Alat lengkap untuk pengumpulan informasi, pemindaian kerentanan, dan perayapan. Alat wajib bagi semua penguji penetrasi
★ 3.749-1Perubahan bintang dalam 7 hari terakhir - #45
🚀🚀🚀feapder adalah kerangka kerja web crawler Python yang mudah digunakan dan kuat | feapder adalah kerangka kerja crawler Python yang ramah pengguna dan bertenaga. Dilengkapi dengan empat jenis crawler: AirSpider, Spider, TaskSpider, dan BatchSpider untuk memenuhi kebutuhan berbagai skenario. Mendukung kelanjutan setelah terputus, pemantauan dan peringatan, rendering browser, deduplikasi data masif, serta dilengkapi dengan sistem manajemen crawler feaplat yang kuat untuk penerapan dan penjadwalan yang mudah
★ 3.732-3Perubahan bintang dalam 7 hari terakhir - #46★ 3.724-1Perubahan bintang dalam 7 hari terakhir
- #47★ 3.555+0Perubahan bintang dalam 7 hari terakhir
- #48★ 3.036+1Perubahan bintang dalam 7 hari terakhir
- #49★ 2.995+1Perubahan bintang dalam 7 hari terakhir
- #50
Web Recon All-in-One.
★ 2.957+3Perubahan bintang dalam 7 hari terakhir - #51
Scraper Node.js untuk mengambil data dari Google Play.
★ 2.956+4Perubahan bintang dalam 7 hari terakhir - #52★ 2.875+1Perubahan bintang dalam 7 hari terakhir
- #53
DecryptLogin: API untuk masuk ke beberapa situs web menggunakan requests.
★ 2.852+0Perubahan bintang dalam 7 hari terakhir - #54★ 2.829+0Perubahan bintang dalam 7 hari terakhir
- #55
Geziyor, framework web crawling & scraping yang sangat cepat untuk Go. Mendukung rendering JS.
★ 2.776+0Perubahan bintang dalam 7 hari terakhir - #56
Videodl: Pengunduh video ringan yang ditulis dalam Python murni. Mendukung berbagai platform streaming seperti Douyin, Kuaishou, Xiaohongshu, Bilibili, YouTube, TikTok, dan banyak lagi.
★ 2.713+20Perubahan bintang dalam 7 hari terakhir - #57★ 2.690-1Perubahan bintang dalam 7 hari terakhir
- #58★ 2.687+6Perubahan bintang dalam 7 hari terakhir
- #59★ 2.510+0Perubahan bintang dalam 7 hari terakhir
- #60
news-please - perayap web dan ekstraktor informasi terintegrasi untuk berita yang langsung berfungsi.
★ 2.485+0Perubahan bintang dalam 7 hari terakhir