Lompat ke konten utama
buildradar
Sign in
Topik · scraper

scraper

Repositori open source terpantau bertanda scraper, diurutkan berdasarkan bintang.

114 repositori
  • newspaper4k@AndyTheFactory

    📰 Newspaper4k, sebuah fork dari Newspaper3k yang disukai. Ekstraksi artikel, judul, dan metadata dari situs web berita.

    1.141+1Perubahan bintang dalam 7 hari terakhir
  • crawly@elixir-crawly

    Crawly, kerangka kerja web crawling & scraping tingkat tinggi untuk Elixir.

    1.116+2Perubahan bintang dalam 7 hari terakhir
  • kimuraframework@vifreefly

    Tulis web scraper di Ruby menggunakan DSL bersih yang dibantu AI. Kimurai menggunakan AI untuk mengetahui letak data, lalu melakukan cache pada selector dan melakukan scraping dengan Ruby murni. Dapatkan kecerdasan LLM tanpa latensi per permintaan atau biaya token.

    1.102+0Perubahan bintang dalam 7 hari terakhir
  • scrapfly-scrapers@scrapfly

    Skrip web scraping Python yang dapat diskalakan untuk +40 domain populer

    1.076+5Perubahan bintang dalam 7 hari terakhir
  • jikan@jikan-me

    API PHP+REST MyAnimeList tidak resmi yang menyediakan fungsi di luar API resmi

    1.072+6Perubahan bintang dalam 7 hari terakhir
  • URS@JosephLai241

    Universal Reddit Scraper - Alat baris perintah pengikisan/pengarsipan Reddit yang komprehensif.

    1.022+1Perubahan bintang dalam 7 hari terakhir
  • GreenResourcesManager@klsdf

    Pengelola komprehensif untuk mengelola sumber daya di komputer dan menyediakan gamifikasi

    1.019+9Perubahan bintang dalam 7 hari terakhir
  • wreq@0x676e67

    Klien HTTP Rust yang ergonomis dan memperhatikan privasi

    1.017+13Perubahan bintang dalam 7 hari terakhir
  • google-play-scraper@JoMingyu

    Scraper Google Play untuk Python yang terinspirasi oleh <facundoolano/google-play-scraper>

    1.010+3Perubahan bintang dalam 7 hari terakhir
  • Alat pertama untuk melihat "postingan pribadi Instagram" secara anonim

    994+14Perubahan bintang dalam 7 hari terakhir
  • crawler@fredwu

    Web crawler / scraper berkinerja tinggi di Elixir.

    956+0Perubahan bintang dalam 7 hari terakhir
  • x-tweet-fetcher@ythx-101

    Mengambil tweet, balasan, lini masa, dan artikel X/Twitter tanpa login atau kunci API — alat lapangan untuk agen AI.

    955+7Perubahan bintang dalam 7 hari terakhir
  • scrapyrt@scrapinghub

    HTTP API untuk spider Scrapy

    884+2Perubahan bintang dalam 7 hari terakhir
  • skrape.it@skrapeit

    Pustaka pengujian/pengikisan/penguraian berbasis Kotlin yang menyediakan kemampuan untuk menganalisis dan mengekstrak data dari HTML (yang dirender di sisi server & klien). Pustaka ini sangat menekankan pada kemudahan penggunaan dan tingkat keterbacaan yang tinggi dengan menyediakan DSL yang intuitif. Bertujuan sebagai pustaka pengujian, tetapi juga dapat digunakan untuk mengikis situs web dengan cara yang mudah.

    875+0Perubahan bintang dalam 7 hari terakhir
  • xidel@benibela

    Alat baris perintah untuk mengunduh dan mengekstrak data dari halaman HTML/XML atau API JSON, menggunakan CSS, XPath 3.0, XQuery 3.0, JSONiq, atau pencocokan pola. Alat ini juga dapat membuat dokumen XML/HTML/JSON baru atau yang telah diubah.

    844+1Perubahan bintang dalam 7 hari terakhir
  • zimit@openzim

    Buat file ZIM dari situs web mana pun dan jelajahi secara offline!

    842+5Perubahan bintang dalam 7 hari terakhir
  • HDoujinDownloader@HDoujinDownloader

    Pengunduh doujinshi dan galeri gambar serbaguna

    841+0Perubahan bintang dalam 7 hari terakhir
  • epublifier@maoserr

    Mengonversi beberapa novel web ke format epub

    840+2Perubahan bintang dalam 7 hari terakhir
  • spidr@postmodern

    Pustaka web spidering Ruby serbaguna yang dapat melakukan spidering pada situs, beberapa domain, tautan tertentu, atau tanpa batas. Spidr dirancang agar cepat dan mudah digunakan.

    836+0Perubahan bintang dalam 7 hari terakhir
  • jvppeteer@fanyong920

    API Java untuk Chrome dan Firefox

    805+0Perubahan bintang dalam 7 hari terakhir
  • opensanctions@opensanctions

    Basis data terbuka untuk data sanksi internasional, orang yang dicari, dan tokoh politik yang terekspos

    797+6Perubahan bintang dalam 7 hari terakhir
  • trawl@germondai

    Mesin scraping yang di-host sendiri — melewati tantangan JS & captcha apa pun: Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Alternatif dan pengganti langsung untuk FlareSolverr & Byparr di stack *arr Anda.

    782+46Perubahan bintang dalam 7 hari terakhir
  • linkedin-profile-scraper-api@josephlimtech

    🕵️‍♂️ Scraper profil LinkedIn yang mengembalikan data profil terstruktur dalam format JSON.

    776+0Perubahan bintang dalam 7 hari terakhir
  • operative framework adalah framework OSINT investigasi berbasis Rust. Anda dapat berinteraksi dengan berbagai target, menjalankan banyak modul, membuat tautan dengan target, mengekspor laporan ke file PDF, menambahkan catatan ke target atau hasil, berinteraksi dengan RESTFul API, dan menulis modul Anda sendiri.

    749-1Perubahan bintang dalam 7 hari terakhir
  • HomeHarvest@ZacharyHampton

    Paket Python untuk scraping data properti real estat

    739+3Perubahan bintang dalam 7 hari terakhir
  • Discount-Bandit@Cybrarist

    Pelacak harga multi-pengguna yang di-host sendiri untuk Amazon, Aliexpress, ebay, dan banyak lagi termasuk toko kustom. Dapatkan notifikasi saat harga cocok dengan satu atau lebih kriteria yang ditetapkan pengguna.

    738+3Perubahan bintang dalam 7 hari terakhir
  • slash@theahmadov

    Alat OSINT Slash

    737+1Perubahan bintang dalam 7 hari terakhir
  • scala-scraper@ruippeixotog

    Pustaka Scala untuk mengambil konten dari halaman HTML

    732+0Perubahan bintang dalam 7 hari terakhir
  • scrapers@cassidoo

    Daftar scraper dari seluruh web.

    730+0Perubahan bintang dalam 7 hari terakhir
  • Dokumen API Internal Twitter.

    711+2Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik