web-scraping
Repositori open source terpantau bertanda web-scraping, diurutkan berdasarkan bintang.
- #31
Web andalan untuk agen pengodean AI Anda — pencarian, pengambilan, perayapan, dan riset lokal melalui MCP. Tanpa kunci API, tanpa cloud, $0/kueri. Beta publik.
★ 4.865+0Perubahan bintang dalam 7 hari terakhir - #32
Versi Playwright yang tidak terdeteksi untuk pustaka pengujian dan otomatisasi.
★ 4.255+0Perubahan bintang dalam 7 hari terakhir - #33★ 4.015+0Perubahan bintang dalam 7 hari terakhir
- #34
Ekstrak sistem desain lengkap situs web apa pun dengan satu perintah. Mendukung token DTCG, semantik+primitif+komposit, server MCP untuk Claude Code/Cursor/Windsurf, emiter multi-platform (iOS SwiftUI, Android Compose, Flutter, WordPress), Tailwind v4, variabel Figma, shadcn/ui, audit kesehatan CSS, perbaikan WCAG, dan ekstensi Chrome. MIT, Playwright, Node 20+.
★ 4.008+0Perubahan bintang dalam 7 hari terakhir - #35
API Scraper Amazon Uji Coba Gratis untuk mengekstrak data pencarian, produk, daftar penawaran, ulasan, tanya jawab, produk terlaris, dan data penjual.
★ 3.388+0Perubahan bintang dalam 7 hari terakhir - #36
Pengumpulan data terstruktur dari situs web mana pun menggunakan scraper, crawler, dan otomatisasi browser berbasis AI. Melakukan scraping dan crawling dengan perintah bahasa alami. Lengkapi agen LLM Anda dengan data terkini. SDK Python AI Studio untuk pengumpulan data web yang cerdas.
★ 3.387+0Perubahan bintang dalam 7 hari terakhir - #37
PHP Curl Class memudahkan pengiriman permintaan HTTP dan integrasi dengan web API
★ 3.296+0Perubahan bintang dalam 7 hari terakhir - #38
Proses ekstraksi data produk dari Amazon menggunakan Python, termasuk judul, peringkat, harga, gambar, dan deskripsi.
★ 3.257+0Perubahan bintang dalam 7 hari terakhir - #39
Peramban anti-sidik jari gratis, peramban privasi, peramban anti-deteksi, peramban anti-asosiasi, peramban sidik jari khusus airdrop web3 gratis
★ 3.086+0Perubahan bintang dalam 7 hari terakhir - #40
Tutorial Kode Python
★ 3.000+0Perubahan bintang dalam 7 hari terakhir - #41
Pelajari langkah demi langkah cara mengikis data Google Trends dan melakukan perbandingan hasil menggunakan Python dan Oxylabs SERP API. Ekstrak kata kunci, popularitas, rincian wilayah, kueri terkait, dan lainnya.
★ 2.909+0Perubahan bintang dalam 7 hari terakhir - #42
Pustaka Python dan CLI untuk scraping X/Twitter dengan rotasi multi-akun dan penanganan pembatasan tarif bawaan.
★ 2.732+0Perubahan bintang dalam 7 hari terakhir - #43★ 2.687+0Perubahan bintang dalam 7 hari terakhir
- #44
Server Model Context Protocol (MCP) canggih yang menyediakan solusi lengkap untuk akses web publik.
★ 2.624+0Perubahan bintang dalam 7 hari terakhir - #45
API web scraping open-source. Ubah situs web apa pun menjadi markdown bersih atau JSON terstruktur. Dilengkapi anti-detect browser, pemilihan proxy otomatis, dan self-hosted. Satu perintah: make up
★ 2.599+0Perubahan bintang dalam 7 hari terakhir - #46
Belajar Python selama sekitar 30 hari.
★ 2.511+0Perubahan bintang dalam 7 hari terakhir - #47★ 2.463+0Perubahan bintang dalam 7 hari terakhir
- #48
Ekstraksi konten web lokal yang cepat untuk LLM. Lakukan scraping, crawling, dan ekstrak data terstruktur—semuanya dari Rust. Dilengkapi CLI, REST API, dan server MCP.
★ 2.318+0Perubahan bintang dalam 7 hari terakhir - #49
Platform otomatisasi peramban mandiri yang tidak terdeteksi. Didukung oleh Camoufox (Firefox) untuk tingkat deteksi 0%. Dibangun untuk kecepatan, privasi, dan skalabilitas.
★ 2.279+0Perubahan bintang dalam 7 hari terakhir - #50
Kode untuk mengekstrak item terlaris, hasil pencarian, dan penawaran yang tersedia saat ini dari Amazon menggunakan Python dan API E-Commerce Scraper Oxylabs.
★ 2.091+0Perubahan bintang dalam 7 hari terakhir - #51
Panduan untuk mengekstrak judul, penulis, dan sitasi dari Google Scholar menggunakan Python dan Oxylabs SERP Scraper API.
★ 2.059+0Perubahan bintang dalam 7 hari terakhir - #52
Perangkat lunak RPA open-source Ui.Vision dengan Computer Vision, OCR, Anthropic Computer Use/LLM. Impor/ekspor Selenium IDE.
★ 2.000+0Perubahan bintang dalam 7 hari terakhir - #53
Browser antidetect stealth gratis untuk Playwright: fingerprint Firefox headless yang tidak terdeteksi. Scraping Python, bypass recaptcha dan deteksi bot. Sumber terbuka
★ 1.962+0Perubahan bintang dalam 7 hari terakhir - #54
Satu-satunya otomatisasi browser yang melewati sistem anti-bot. AI menulis network hook, mengklon UI dengan presisi piksel melalui obrolan sederhana.
★ 1.888+0Perubahan bintang dalam 7 hari terakhir - #55
Browser headless terbaik untuk agen AI. Ringan, cepat, kompatibilitas tinggi. Dibangun dengan Rust
★ 1.841+204Perubahan bintang dalam 7 hari terakhir - #56
Driver headless Chrome/Chromium di atas Puppeteer. Ambil screenshot, buat PDF, ekstrak teks dan HTML dengan API yang siap produksi.
★ 1.833+0Perubahan bintang dalam 7 hari terakhir - #57
Pemantauan, pengumpulan, dan transfer konten lintas platform. Satu panel Web untuk mengelola Douyin / Xiaohongshu / Kuaishou
★ 1.833+0Perubahan bintang dalam 7 hari terakhir - #58
Pelajari cara membangun scraper Google Jobs Anda sendiri yang secara bersamaan melakukan scraping Google Jobs untuk berbagai kueri pencarian dan lokasi geografis dengan Python dan API Google Jobs Scraper dari Oxylabs. https://oxylabs.io/blog/how-to-scrape-google-jobs
★ 1.767+0Perubahan bintang dalam 7 hari terakhir - #59
Dalam tutorial ini, kami menunjukkan cara melakukan scraping data publik Google dengan Python dan Oxylabs API.
★ 1.692+0Perubahan bintang dalam 7 hari terakhir - #60
Binding Python untuk engine Modest dan Lexbor. Parser HTML5 cepat dengan pemilih CSS untuk Python.
★ 1.671+0Perubahan bintang dalam 7 hari terakhir