crawler
Repositori open source terpantau bertanda crawler, diurutkan berdasarkan bintang.
- #91★ 1.410+0Perubahan bintang dalam 7 hari terakhir
- #92★ 1.386+1Perubahan bintang dalam 7 hari terakhir
- #93
Berbagi kode web scraping Brother K, rekayasa balik JS, web scraping tingkat lanjut. Ikuti Akun Resmi: Brother K Web Scraping
★ 1.379+0Perubahan bintang dalam 7 hari terakhir - #94
Web crawler/scraper Ruby yang ringan dengan DSL elegan yang mengekstrak data terstruktur dari halaman.
★ 1.360+0Perubahan bintang dalam 7 hari terakhir - #95★ 1.303+1Perubahan bintang dalam 7 hari terakhir
- #96
📝 Mengambil informasi profil Instagram dengan cepat (mis. pengikut, tag, dll.).
★ 1.302+1Perubahan bintang dalam 7 hari terakhir - #97★ 1.302+0Perubahan bintang dalam 7 hari terakhir
- #98
Scraper/crawler pekerjaan BOSS Zhipin berbasis Chrome-CDP yang menggunakan kembali status login asli melalui protokol Chrome CDP, melewati anti-scraping font, dan menghasilkan JSON/CSV gaji teks biasa beserta analisis keterampilan gaji.
★ 1.282+33Perubahan bintang dalam 7 hari terakhir - #99
Beanbun adalah framework web crawler multi-proses yang ditulis dalam PHP, memiliki keterbukaan yang baik, skalabilitas tinggi, dan berbasis Workerman.
★ 1.258-1Perubahan bintang dalam 7 hari terakhir - #100
Pengunduh komik Bilibili yang mudah digunakan dengan antarmuka grafis, mendukung pencarian komik berdasarkan kata kunci dan login kode QR, pengunduhan bab yang belum dibuka dengan teknologi canggih, pengunduhan multi-utas, berbagai format penyimpanan, manajemen komik lokal, dan pemeriksaan pembaruan dengan satu klik!
★ 1.243+1Perubahan bintang dalam 7 hari terakhir - #101
Alat traversal aplikasi otomatis berbasis Appium
★ 1.237+0Perubahan bintang dalam 7 hari terakhir - #102
Unduh semua foto/video dari blog Tumblr dengan mudah. Unduh gambar dan video dari blog Tumblr yang ditentukan.
★ 1.157+0Perubahan bintang dalam 7 hari terakhir - #103
📰 Newspaper4k, sebuah fork dari Newspaper3k yang disukai. Ekstraksi artikel, judul, dan metadata dari situs web berita.
★ 1.141+1Perubahan bintang dalam 7 hari terakhir - #104
Server pencarian situs & perusahaan sumber terbuka yang di-host mandiri, dibangun di atas OpenSearch. Melakukan crawling web / file / DB / sumber cloud, 20+ bahasa, REST API, serta AI/RAG & pencarian semantik. Apache-2.0.
★ 1.128+1Perubahan bintang dalam 7 hari terakhir - #105
Menjalankan crawler pengarsipan web berbasis peramban berketepatan tinggi dalam satu container Docker
★ 1.127+5Perubahan bintang dalam 7 hari terakhir - #106★ 1.116+2Perubahan bintang dalam 7 hari terakhir
- #107
Tulis web scraper di Ruby menggunakan DSL bersih yang dibantu AI. Kimurai menggunakan AI untuk mengetahui letak data, lalu melakukan cache pada selector dan melakukan scraping dengan Ruby murni. Dapatkan kecerdasan LLM tanpa latensi per permintaan atau biaya token.
★ 1.102+0Perubahan bintang dalam 7 hari terakhir - #108
Skrip web scraping Python yang dapat diskalakan untuk +40 domain populer
★ 1.076+5Perubahan bintang dalam 7 hari terakhir - #109
Penghilang watermark video pendek Golang: Douyin, Pipixia, Huoshan, Weishi, Zuiyou, Kuaishou, Quanmin Xiaoshipin, Pipigaoxiao, Xigua Video, Huya, Pear Video, AcFun, Haokan Video...
★ 1.032+11Perubahan bintang dalam 7 hari terakhir - #110
Unduh novel | Crawling novel | Qidian | Biquge | Ekspor Markdown | Ekspor txt | Konversi epub | Filter iklan | Koreksi otomatis
★ 1.017+9Perubahan bintang dalam 7 hari terakhir - #111★ 1.017+13Perubahan bintang dalam 7 hari terakhir
- #112
Scraper Google Play untuk Python yang terinspirasi oleh <facundoolano/google-play-scraper>
★ 1.010+3Perubahan bintang dalam 7 hari terakhir - #113★ 1.009-1Perubahan bintang dalam 7 hari terakhir
- #114
Web crawler yang skalabel, matang, dan serbaguna berbasis Apache Storm
★ 994+1Perubahan bintang dalam 7 hari terakhir - #115
Rilis, wiki, dan peta jalan SpiderSuite (crawler keamanan web)
★ 974+1Perubahan bintang dalam 7 hari terakhir - #116★ 956+0Perubahan bintang dalam 7 hari terakhir
- #117
Alternatif Firecrawl/Tavily yang cepat dan ringan dalam Rust. Web scraper, crawler & search API dengan server MCP untuk AI agent. Kompatibel dengan API Firecrawl (/scrape, /crawl, /search). 2,3x lebih cepat dari Tavily, 1,5x lebih cepat dari Firecrawl dalam benchmark 1K-URL. RAM 6 MB, biner tunggal. Dapat di-self-host atau menggunakan cloud terkelola.
★ 955+90Perubahan bintang dalam 7 hari terakhir - #118
Alat protokol berbasis Python murni dan catatan riset untuk X.com, dengan dataset akun Twitter VibeLoft
★ 940-1Perubahan bintang dalam 7 hari terakhir - #119★ 933+1Perubahan bintang dalam 7 hari terakhir
- #120
ChatWeb dapat merayapi halaman web, membaca PDF, DOCX, TXT, mengekstrak konten utama, lalu menjawab pertanyaan Anda berdasarkan konten tersebut atau merangkum poin-poin penting.
★ 916+0Perubahan bintang dalam 7 hari terakhir