web-crawling
Erfasste Open-Source-Repos mit dem Tag web-crawling, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit web-crawling am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit web-crawling getaggt wurden.
- #1
Crawlee—A web scraping and browser automation library for Node.js zur Erstellung zuverlässiger Crawler. In JavaScript und TypeScript. Daten für KI, LLMs, RAG oder GPTs extrahieren. HTML, PDF, JPG, PNG und andere Dateien von Websites herunterladen. Funktioniert mit Puppeteer, Playwright, Cheerio, JSDOM und raw HTTP. Sowohl headful als auch headless-Modus. Mit Proxy-Rotation.
★ 25.622+66Sterne-Änderung der letzten 7 Tage - #2
Crawlee — Eine Web-Scraping- und Browser-Automatisierungsbibliothek für Python zur Erstellung zuverlässiger Crawler. Extrahieren Sie Daten für KI, LLMs, RAG oder GPTs. Laden Sie HTML, PDF, JPG, PNG und andere Dateien von Websites herunter. Funktioniert mit Parsel, BeautifulSoup, Playwright und nativem HTTP. Sowohl Headful- als auch Headless-Modus. Mit Proxy-Rotation.
★ 9.481+4Sterne-Änderung der letzten 7 Tage - #3
Deklarative Datenautomatisierungssprache und Go-Laufzeitumgebung für strukturierte Extraktionsworkflows.
★ 6.009+1Sterne-Änderung der letzten 7 Tage - #4
Das All-in-One-Framework zum Erstellen unaufhaltsamer Scraper
★ 5.695+3Sterne-Änderung der letzten 7 Tage - #5
Ein leistungsstarker Model Context Protocol (MCP)-Server, der eine All-in-One-Lösung für den Zugriff auf das öffentliche Web bietet.
★ 2.624+10Sterne-Änderung der letzten 7 Tage - #6
Bester Headless-Browser für KI-Agenten. Schlank, schnell, hohe Kompatibilität. In Rust entwickelt.
★ 1.779+353Sterne-Änderung der letzten 7 Tage - #7★ 664+1Sterne-Änderung der letzten 7 Tage