crawler
Erfasste Open-Source-Repos mit dem Tag crawler, sortiert nach Sternen.
- #91★ 1.410+0Sterne-Änderung der letzten 7 Tage
- #92
🤖 Automatisches Scrapen von Daten von HTML-Websites durch einfaches Bereitstellen von Beispielen
★ 1.386+1Sterne-Änderung der letzten 7 Tage - #93
K-Ge-Crawler-Code-Sharing, JS-Reverse-Engineering, fortgeschrittenes Crawling. Folgen Sie dem offiziellen Account: K哥爬虫
★ 1.379+0Sterne-Änderung der letzten 7 Tage - #94
Leichter Ruby-Web-Crawler/Scraper mit einer eleganten DSL, der strukturierte Daten aus Seiten extrahiert
★ 1.360+0Sterne-Änderung der letzten 7 Tage - #95
Das primäre Cross-Site Request Forgery (CSRF) Audit- und Exploitation-Toolkit.
★ 1.303+1Sterne-Änderung der letzten 7 Tage - #96★ 1.302+0Sterne-Änderung der letzten 7 Tage
- #97
📝 Schnelles Crawlen von Informationen (z. B. Follower, Tags usw.) eines Instagram-Profils.
★ 1.302+1Sterne-Änderung der letzten 7 Tage - #98
Ein Chrome-CDP-basierter Job-Scraper/Crawler für BOSS Zhipin, der echte Anmeldestatus wiederverwendet, Anti-Crawling-Schriftarten umgeht und Klartext-Gehälter als JSON/CSV inkl. Gehalts- und Skill-Analysen ausgibt.
★ 1.282+33Sterne-Änderung der letzten 7 Tage - #99
Beanbun ist ein in PHP geschriebenes Multi-Process-Web-Crawler-Framework mit guter Offenheit und hoher Skalierbarkeit, basierend auf Workerman.
★ 1.258-1Sterne-Änderung der letzten 7 Tage - #100
Ein nützlicher Bilibili-Manga-Downloader mit grafischer Benutzeroberfläche, der Stichwortsuche, QR-Code-Login, das Herunterladen gesperrter Kapitel durch erweiterte Techniken, Multithreading-Downloads, verschiedene Speicherformate, lokale Verwaltung und Ein-Klick-Updates unterstützt.
★ 1.243+1Sterne-Änderung der letzten 7 Tage - #101
App-Automatisierungs-Traversal-Tool basierend auf Appium
★ 1.237+0Sterne-Änderung der letzten 7 Tage - #102
Einfaches Herunterladen aller Fotos/Videos von Tumblr-Blogs.
★ 1.157+0Sterne-Änderung der letzten 7 Tage - #103
📰 Newspaper4k, ein Fork des beliebten Newspaper3k. Extraktion von Artikeln, Titeln und Metadaten von Nachrichtenwebsites.
★ 1.141+1Sterne-Änderung der letzten 7 Tage - #104
Open-Source, selbstgehosteter Enterprise- und Websuchserver auf Basis von OpenSearch. Durchsucht Web-, Datei-, Datenbank- und Cloud-Quellen, unterstützt über 20 Sprachen, REST-API sowie KI/RAG- und semantische Suche. Apache-2.0.
★ 1.128+1Sterne-Änderung der letzten 7 Tage - #105
Ausführen eines hochpräzisen, browserbasierten Web-Archivierungs-Crawlers in einem einzigen Docker-Container
★ 1.127+5Sterne-Änderung der letzten 7 Tage - #106★ 1.116+2Sterne-Änderung der letzten 7 Tage
- #107
Schreiben Sie Web-Scraper in Ruby mit einer sauberen, KI-unterstützten DSL. Kimurai nutzt KI, um herauszufinden, wo sich die Daten befinden, speichert dann die Selektoren im Cache und scrapt mit reinem Ruby. Erhalten Sie die Intelligenz eines LLM ohne Latenz pro Anfrage oder Token-Kosten.
★ 1.102+0Sterne-Änderung der letzten 7 Tage - #108
Skalierbare Python-Web-Scraping-Skripte für mehr als 40 beliebte Domains
★ 1.075+4Sterne-Änderung der letzten 7 Tage - #109
Golang-Tool zum Entfernen von Wasserzeichen aus Kurzvideos: Douyin, Pipixia, Huoshan, Weishi, Zuiyou, Kuaishou, Quanmin Xiaoshipin, Pipigaoxiao, Xigua Video, Huya, Pear Video, AcFun, Haokan Video...
★ 1.031+10Sterne-Änderung der letzten 7 Tage - #110
Roman-Download, Web-Scraping, Qidian, Biquge, Markdown-Export, TXT-Export, EPUB-Konvertierung, Werbefiltrierung, automatische Korrektur
★ 1.016+8Sterne-Änderung der letzten 7 Tage - #111★ 1.016+12Sterne-Änderung der letzten 7 Tage
- #112★ 1.009-1Sterne-Änderung der letzten 7 Tage
- #113
Google Play Scraper für Python, inspiriert von <facundoolano/google-play-scraper>
★ 1.009+2Sterne-Änderung der letzten 7 Tage - #114
Ein skalierbarer, ausgereifter und vielseitiger Web-Crawler auf Basis von Apache Storm
★ 994+1Sterne-Änderung der letzten 7 Tage - #115
SpiderSuite (Web-Security-Crawler) Releases, Wiki und Roadmap
★ 974+1Sterne-Änderung der letzten 7 Tage - #116★ 956+0Sterne-Änderung der letzten 7 Tage
- #117
Schnelle, leichtgewichtige Firecrawl-/Tavily-Alternative in Rust. Web-Scraper, -Crawler und -Such-API mit MCP-Server für KI-Agenten. Drop-in Firecrawl-kompatible API (/scrape, /crawl, /search). 2,3x schneller als Tavily, 1,5x schneller als Firecrawl bei 1K-URL-Benchmarks. 6 MB RAM, einzelne Binärdatei. Selbst hosten oder verwaltete Cloud nutzen.
★ 952+87Sterne-Änderung der letzten 7 Tage - #118
Rein in Python geschriebene Protokoll-Tools und Forschungsnotizen für X.com mit Datensätzen des Twitter-Kontos VibeLoft
★ 940-1Sterne-Änderung der letzten 7 Tage - #119★ 933+1Sterne-Änderung der letzten 7 Tage
- #120
ChatWeb kann Webseiten durchsuchen, PDFs, DOCX, TXT lesen und den Hauptinhalt extrahieren, um dann Ihre Fragen basierend auf dem Inhalt zu beantworten oder die Kernpunkte zusammenzufassen.
★ 916+0Sterne-Änderung der letzten 7 Tage