data-extraction
Repositori open source terpantau bertanda data-extraction, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan data-extraction di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda data-extraction.
- #1
Ekstraktor sumber terbuka gratis untuk riwayat obrolan asisten koding AI. Mendukung Claude Code, Cursor, Windsurf, Aider, Cline/Roo Code, dan banyak lagi.
★ 550
- #1
API konteks untuk mencari, melakukan scraping, dan berinteraksi dengan web dalam skala besar. 🔥
★ 174.034+3.406Perubahan bintang dalam 7 hari terakhir - #2
🕷️ Kerangka kerja Web Scraping adaptif yang menangani segalanya, mulai dari permintaan tunggal hingga perayapan skala penuh!
★ 77.158+1.432Perubahan bintang dalam 7 hari terakhir - #3
Scraper Python berbasis AI.
★ 30.047+244Perubahan bintang dalam 7 hari terakhir - #4
Platform no-code open-source untuk web scraping, crawling, pencarian, dan ekstraksi data AI • Ubah situs web menjadi API terstruktur dalam hitungan menit
★ 17.322+70Perubahan bintang dalam 7 hari terakhir - #5
Bahasa otomasi data deklaratif dan Go runtime untuk alur kerja ekstraksi terstruktur.
★ 6.008-1Perubahan bintang dalam 7 hari terakhir - #6★ 5.712+0Perubahan bintang dalam 7 hari terakhir
- #7
CLI otomatisasi peramban yang dibuat untuk AI agent. Menembus blokir anti-bot, mengalihkan ke manusia di berbagai platform saat mengalami kendala. Eksekusi multi-tugas paralel, operasi multi-sesi independen, penjelajahan multi-akun terisolasi.
★ 5.522+129Perubahan bintang dalam 7 hari terakhir - #8
Server Model Context Protocol (MCP) canggih yang menyediakan solusi lengkap untuk akses web publik.
★ 2.614+10Perubahan bintang dalam 7 hari terakhir - #9
Platform otomatisasi peramban mandiri yang tidak terdeteksi. Didukung oleh Camoufox (Firefox) untuk tingkat deteksi 0%. Dibangun untuk kecepatan, privasi, dan skalabilitas.
★ 2.273+18Perubahan bintang dalam 7 hari terakhir - #10
Paket Python untuk scraping data resep.
★ 2.215+3Perubahan bintang dalam 7 hari terakhir - #11
ContextGem: Ekstraksi LLM yang mudah dari dokumen
★ 1.994+8Perubahan bintang dalam 7 hari terakhir - #12
Untuk mengekstrak artikel dari URL yang diberikan
★ 1.910+2Perubahan bintang dalam 7 hari terakhir - #13
:truck: Alur kerja Persiapan Data Agile menjadi lebih mudah dengan Pandas, Dask, cuDF, Dask-cuDF, Vaex, dan PySpark
★ 1.536+0Perubahan bintang dalam 7 hari terakhir - #14
Toolkit Python yang ramah pemula namun bertenaga untuk analisis keuangan dan otomatisasi — dibuat untuk membuat investasi modern dapat diakses oleh semua orang
★ 1.389+10Perubahan bintang dalam 7 hari terakhir - #15★ 1.352+0Perubahan bintang dalam 7 hari terakhir
- #16
⛏️ Mesin ekstraksi di balik Maigret: ubah URL profil apa pun menjadi catatan OSINT terstruktur di lebih dari 150 situs
★ 1.076+9Perubahan bintang dalam 7 hari terakhir - #17
Pustaka PDF tercepat untuk Python dan Rust. Ekstraksi teks, ekstraksi gambar, konversi markdown, pembuatan & pengeditan PDF. Rata-rata 0,8ms, 5x lebih cepat dari pemimpin industri, tingkat keberhasilan 100% pada 3.830 PDF. MIT/Apache-2.0.
★ 1.006+37Perubahan bintang dalam 7 hari terakhir - #18
Asisten AI open-source yang mengutamakan penyimpanan lokal untuk data Anda. Menyatukan tugas, catatan, dokumen, foto, dan bookmark. Bersifat pribadi, self-hosted, dan dapat diperluas melalui API.
★ 916+15Perubahan bintang dalam 7 hari terakhir - #19
Alternatif Firecrawl/Tavily yang cepat dan ringan dalam Rust. Web scraper, crawler & search API dengan server MCP untuk AI agent. Kompatibel dengan API Firecrawl (/scrape, /crawl, /search). 2,3x lebih cepat dari Tavily, 1,5x lebih cepat dari Firecrawl dalam benchmark 1K-URL. RAM 6 MB, biner tunggal. Dapat di-self-host atau menggunakan cloud terkelola.
★ 876+230Perubahan bintang dalam 7 hari terakhir - #20
:newspaper: Biarkan ChatGPT Meringkas Hacker News untuk Anda
★ 756+0Perubahan bintang dalam 7 hari terakhir - #21
🚜 Mengurai teks dan tabel dari file PDF.
★ 704+0Perubahan bintang dalam 7 hari terakhir - #22
🤖 Editor web scraping bertenaga AI dengan pembangun alur kerja visual. Bangun, uji & sebarkan web scraper menggunakan bahasa alami. Didukung oleh ScrapeGraphAI & LangGraph.
★ 688+2Perubahan bintang dalam 7 hari terakhir - #23
Integrasi Google Reviews API dan Scraper Google Reviews yang dapat menskalakan untuk mengekstrak rating, teks ulasan, dan wawasan bisnis dari Google Maps menggunakan Google Review API yang terstruktur.
★ 593-1Perubahan bintang dalam 7 hari terakhir - #24
Effortlessly extract data with our AI scraper API. Simplify data extraction, get clean JSON outputs and adapt to page changes. Try it free today!
★ 571—Perubahan bintang dalam 7 hari terakhir - #25
"Halaman Status GitHub yang Hilang" -- upaya Flat Data untuk mendokumentasikan status GitHub secara historis
★ 561+9Perubahan bintang dalam 7 hari terakhir - #26
Web-scraping tak terdeteksi & penguraian HTML mulus di Python!
★ 561+2Perubahan bintang dalam 7 hari terakhir - #27
Infrastruktur web sumber terbuka untuk AI. Mengikis, merayapi, dan mengotomatiskan web, membersihkan markdown, sesi peramban, siap untuk agen Anda.
★ 558+0Perubahan bintang dalam 7 hari terakhir - #28
Ekstraktor sumber terbuka gratis untuk riwayat obrolan asisten koding AI. Mendukung Claude Code, Cursor, Windsurf, Aider, Cline/Roo Code, dan banyak lagi.
★ 550+11Perubahan bintang dalam 7 hari terakhir