crawler
Repositori open source terpantau bertanda crawler, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan crawler di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda crawler.
- #1
Pemantauan, pengumpulan, dan transfer konten lintas platform. Satu panel Web untuk mengelola Douyin / Xiaohongshu / Kuaishou
★ 1.833 - #2
Scraper/crawler pekerjaan BOSS Zhipin berbasis Chrome-CDP yang menggunakan kembali status login asli melalui protokol Chrome CDP, melewati anti-scraping font, dan menghasilkan JSON/CSV gaji teks biasa beserta analisis keterampilan gaji.
★ 1.282
- #1
API konteks untuk mencari, melakukan scraping, dan berinteraksi dengan web dalam skala besar. 🔥
★ 175.781+1.747Perubahan bintang dalam 7 hari terakhir - #2
🕷️ Kerangka kerja Web Scraping adaptif yang menangani segalanya, mulai dari permintaan tunggal hingga perayapan skala penuh!
★ 78.099+941Perubahan bintang dalam 7 hari terakhir - #3★ 64.179+81Perubahan bintang dalam 7 hari terakhir
- #4
Crawler/spider web visual tanpa kode. Perangkat lunak otomatisasi browser/pengumpulan data/web crawler visual yang memungkinkan desain dan eksekusi tugas crawler secara grafis tanpa kode.
★ 44.492+22Perubahan bintang dalam 7 hari terakhir - #5★ 31.660+1Perubahan bintang dalam 7 hari terakhir
- #6
Scraper Python berbasis AI.
★ 30.435+388Perubahan bintang dalam 7 hari terakhir - #7
Bot lamaran kerja AI sumber terbuka berbasis Python: menggunakan otomatisasi browser dan web scraping untuk membaca lowongan kerja, lalu melamar secara otomatis dengan resume dan surat lamaran yang disesuaikan untuk setiap lowongan.
★ 30.304+26Perubahan bintang dalam 7 hari terakhir - #8
Crawlee—Pustaka web scraping dan otomatisasi browser untuk Node.js guna membangun crawler yang andal. Tersedia dalam JavaScript dan TypeScript. Ekstrak data untuk AI, LLM, RAG, atau GPT. Unduh HTML, PDF, JPG, PNG, dan file lainnya dari situs web. Mendukung Puppeteer, Playwright, Cheerio, JSDOM, dan HTTP mentah. Mendukung mode headful dan headless, serta rotasi proxy.
★ 25.622+66Perubahan bintang dalam 7 hari terakhir - #9★ 25.494+6Perubahan bintang dalam 7 hari terakhir
- #10
Python ProxyPool untuk web spider
★ 23.659+11Perubahan bintang dalam 7 hari terakhir - #11
Douyin_TikTok_Download_API adalah alat pengikis data Douyin, Kuaishou, TikTok, dan Bilibili yang berkinerja tinggi dan siap pakai, mendukung panggilan API, serta penguraian dan pengunduhan batch secara daring.
★ 19.789+62Perubahan bintang dalam 7 hari terakhir - #12★ 17.378+20Perubahan bintang dalam 7 hari terakhir
- #13
Platform no-code open-source untuk web scraping, crawling, pencarian, dan ekstraksi data AI • Ubah situs web menjadi API terstruktur dalam hitungan menit
★ 17.349+27Perubahan bintang dalam 7 hari terakhir - #14
newspaper3k adalah alat ekstraksi berita, teks lengkap, dan metadata artikel dalam Python 3. Dokumentasi lengkap:
★ 15.148+2Perubahan bintang dalam 7 hari terakhir - #15
Beberapa contoh crawler Python yang menarik dan ramah bagi pemula, terutama untuk melakukan crawling pada situs seperti Taobao, Tmall, WeChat, WeChat Reading, Douban, QQ, dll.
★ 14.686+5Perubahan bintang dalam 7 hari terakhir - #16★ 13.160+4Perubahan bintang dalam 7 hari terakhir
- #17
Platform admin web crawler terdistribusi untuk manajemen spider tanpa batasan bahasa atau framework.
★ 12.268+4Perubahan bintang dalam 7 hari terakhir - #18★ 11.681+1Perubahan bintang dalam 7 hari terakhir
- #19
Skrip Python untuk login otomatis Zhihu, web scraping, operasi excel, akun resmi WeChat, dan menyalakan komputer dari jarak jauh.
★ 10.808+5Perubahan bintang dalam 7 hari terakhir - #20
Sistem manajemen film AV, crawler avmoo, javbus, javlibrary, perpustakaan film AV online, basis data tautan magnetik AV, Japanese Adult Video Library, Adult Video Magnet Links - Japanese Adult Video Database
★ 10.047+3Perubahan bintang dalam 7 hari terakhir - #21
Crawlee—Pustaka web scraping dan otomatisasi browser untuk Python guna membangun crawler yang andal. Ekstrak data untuk AI, LLM, RAG, atau GPT. Unduh HTML, PDF, JPG, PNG, dan file lainnya dari situs web. Bekerja dengan Parsel, BeautifulSoup, Playwright, dan HTTP mentah. Mendukung mode headful dan headless. Dengan rotasi proxy.
★ 9.481+4Perubahan bintang dalam 7 hari terakhir - #22
Agent AI akuisisi pelanggan media mandiri yang dirancang khusus untuk OPC / UMKM
★ 8.489+14Perubahan bintang dalam 7 hari terakhir - #23
Daftar pustaka, alat, dan API untuk web scraping dan pemrosesan data.
★ 8.139+1Perubahan bintang dalam 7 hari terakhir - #24
Web Scraper yang Cerdas, Otomatis, Cepat, dan Ringan untuk Python
★ 7.932+17Perubahan bintang dalam 7 hari terakhir - #25
Koleksi web crawler dan spider luar biasa dalam berbagai bahasa pemrograman
★ 7.303+5Perubahan bintang dalam 7 hari terakhir - #26
Python API untuk JMComic | Menyediakan akses Python API ke JMComic, mendukung versi web dan seluler | Pengunduh GitHub Actions untuk JMComic🚀
★ 7.075+37Perubahan bintang dalam 7 hari terakhir - #27
Pydoll adalah pustaka untuk mengotomatiskan peramban berbasis Chromium tanpa WebDriver, menawarkan interaksi yang realistis.
★ 7.060+7Perubahan bintang dalam 7 hari terakhir - #28
Web Crawler/Spider untuk NodeJS + jQuery sisi server ;-)
★ 6.796-2Perubahan bintang dalam 7 hari terakhir - #29
Alat Python & baris perintah untuk mengumpulkan teks dan metadata di Web: Crawling, scraping, ekstraksi, output sebagai CSV, JSON, HTML, MD, TXT, XML
★ 6.754+26Perubahan bintang dalam 7 hari terakhir - #30
Antarmuka crawler akun resmi WeChat berdasarkan Pencarian Sogou WeChat
★ 6.378+0Perubahan bintang dalam 7 hari terakhir