web-scraping
Erfasste Open-Source-Repos mit dem Tag web-scraping, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit web-scraping am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit web-scraping getaggt wurden.
- #1
Bester Headless-Browser für KI-Agenten. Schlank, schnell, hohe Kompatibilität. In Rust entwickelt.
★ 1.841 - #2
Plattformübergreifende Inhaltsüberwachung, -erfassung und -übertragung: Ein Web-Dashboard zur Verwaltung von Douyin, Xiaohongshu und Kuaishou.
★ 1.833 - #3
Selbst gehostete Scraping-Engine — umgeht jegliche JS-Herausforderungen und Captchas: Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Eine FlareSolverr- und Byparr-Alternative sowie direkter Ersatz für Ihren *arr-Stack.
★ 793 - #4
A skill for AI agents: search the web with SearXNG, browse with Camofox, bypass protections with CloakBrowser. Anti-hallucination by design. Self-hosted, free, unlimited.
★ 515 - #5
Turn any website into a compact CLI tailored for AI agents. Browse the web in hundreds of tokens, not tens of thousands.
★ 441
- #1
Die Context API zum Suchen, Scrapen und Interagieren mit dem Web auf großer Skalierung. 🔥
★ 175.781+0Sterne-Änderung der letzten 7 Tage - #2
🕷️ Ein adaptives Web-Scraping-Framework, das alles von einer einzelnen Anfrage bis zu einem groß angelegten Crawl behandelt!
★ 78.099+0Sterne-Änderung der letzten 7 Tage - #3★ 64.179+0Sterne-Änderung der letzten 7 Tage
- #4
Klonen Sie jede Website mit einem einzigen Befehl mithilfe von KI‑Coding‑Agenten.
★ 33.686+0Sterne-Änderung der letzten 7 Tage - #5
Das beste und einfachste Tool zur Erkennung von Website-Änderungen, Webseitenüberwachung und Benachrichtigungen über Änderungen. Ideal zum Verfolgen von Inhaltsänderungen, Preissenkungen, Nachschubwarnungen und Überwachung von Website-Vandalismus – kostenlos oder mit unserem SaaS-Plan.
★ 33.494+0Sterne-Änderung der letzten 7 Tage - #6
Stealth Chromium, das jeden Bot-Erkennungs-Test besteht. Drop-in-Ersatz für Playwright mit Quellcode-Ebene-Fingerabdruck-Patches. 30/30 Tests bestanden.
★ 31.110+0Sterne-Änderung der letzten 7 Tage - #7
Python‑Scraper basierend auf KI
★ 30.435+0Sterne-Änderung der letzten 7 Tage - #8
Open‑Source‑KI‑Bewerbungs‑Bot in Python: Browser‑Automatisierung und Web‑Scraping zum Lesen von Stellenanzeigen, dann automatisches Bewerben mit einem zugeschnittenen Lebenslauf und Anschreiben für jede Anzeige.
★ 30.304+0Sterne-Änderung der letzten 7 Tage - #9
Crawlee—A web scraping and browser automation library for Node.js zur Erstellung zuverlässiger Crawler. In JavaScript und TypeScript. Daten für KI, LLMs, RAG oder GPTs extrahieren. HTML, PDF, JPG, PNG und andere Dateien von Websites herunterladen. Funktioniert mit Puppeteer, Playwright, Cheerio, JSDOM und raw HTTP. Sowohl headful als auch headless-Modus. Mit Proxy-Rotation.
★ 25.622+0Sterne-Änderung der letzten 7 Tage - #10
🚀 „Douyin_TikTok_Download_API“ ist ein sofort einsatzbereites, performantes, asynchrones Daten-Scraping-Tool für Douyin, Kuaishou, TikTok und Bilibili, das API-Aufrufe sowie Online-Batch-Parsing und -Download unterstützt.
★ 19.789+0Sterne-Änderung der letzten 7 Tage - #11
🔥 Die Open-Source-No-Code-Plattform für Web-Scraping, Crawling, Suche und KI-Datenextraktion • Verwandeln Sie Websites in Minuten in strukturierte APIs 🔥
★ 17.349+0Sterne-Änderung der letzten 7 Tage - #12
Open-Source-Alternative zu NotebookLM. Durchsuche das offene Web mit Live-Daten (Reddit, YT, IG, TikTok, Indeed, Google Search, Maps usw.) über eine Plattform, API oder einen MCP-Server. Trete unserem Discord bei: https://discord.gg/ejRNvftDp9
★ 16.066+0Sterne-Änderung der letzten 7 Tage - #13
Konvertierung von Dokumentations-Websites, GitHub-Repositories und PDFs in Claude-AI-Fähigkeiten mit automatischer Konflikterkennung
★ 14.888+0Sterne-Änderung der letzten 7 Tage - #14
📊 APIs für Web-Automatisierung, Tests und das Umgehen von Bot-Erkennung.
★ 12.972+0Sterne-Änderung der letzten 7 Tage - #15
jsoup: Der Java-HTML-Parser, entwickelt für HTML-Bearbeitung, Bereinigung, Scraping und XSS-Sicherheit.
★ 11.385+0Sterne-Änderung der letzten 7 Tage - #16
Leistungsstarke Browser-Automatisierungsbrücke und Multi-Instance-Orchestrator mit erweiterter Stealth-Injektion und Echtzeit-Dashboard.
★ 10.219+0Sterne-Änderung der letzten 7 Tage - #17
Crawlee — Eine Web-Scraping- und Browser-Automatisierungsbibliothek für Python zur Erstellung zuverlässiger Crawler. Extrahieren Sie Daten für KI, LLMs, RAG oder GPTs. Laden Sie HTML, PDF, JPG, PNG und andere Dateien von Websites herunter. Funktioniert mit Parsel, BeautifulSoup, Playwright und nativem HTTP. Sowohl Headful- als auch Headless-Modus. Mit Proxy-Rotation.
★ 9.481+0Sterne-Änderung der letzten 7 Tage - #18
Stealth-Headless-Browser für AI-Agents – umgeht Cloudflare, Bot-Erkennung und Anti-Scraping. Drop-in-Ersatz für Puppeteer/Playwright.
★ 9.039+0Sterne-Änderung der letzten 7 Tage - #19★ 8.322+0Sterne-Änderung der letzten 7 Tage
- #20
Liste von Bibliotheken, Tools und APIs für Web Scraping und Datenverarbeitung.
★ 8.139+0Sterne-Änderung der letzten 7 Tage - #21
Ein intelligenter, automatischer, schneller und leichtgewichtiger Web Scraper für Python
★ 7.932+0Sterne-Änderung der letzten 7 Tage - #22
Dieses GitHub-Repository ist eine leistungsstarke Sammlung von APIs, die Sie sofort nutzen können, um alles von einfachen Automatisierungen bis hin zu vollwertigen Anwendungen zu entwickeln. Eine der wertvollsten API-Listen auf GitHub überhaupt. 💪
★ 7.585+0Sterne-Änderung der letzten 7 Tage - #23
🔥 Offizieller Firecrawl MCP Server – Fügt leistungsstarkes Web-Scraping und -Suchen zu Cursor, Claude und anderen LLM-Clients hinzu.
★ 7.381+0Sterne-Änderung der letzten 7 Tage - #24★ 7.084+0Sterne-Änderung der letzten 7 Tage
- #25
Pydoll ist eine Bibliothek zur Automatisierung von Chromium-basierten Browsern ohne WebDriver und bietet realistische Interaktionen.
★ 7.060+0Sterne-Änderung der letzten 7 Tage - #26
Python- und Befehlszeilen-Tool zum Sammeln von Text und Metadaten im Web: Crawling, Scraping, Extraktion, Ausgabe als CSV, JSON, HTML, MD, TXT, XML
★ 6.754+0Sterne-Änderung der letzten 7 Tage - #27
Python-Binding für das curl-impersonate-Fork via cffi. Ein HTTP-Client, der Browser-TLS/JA3/HTTP2-Fingerabdrücke imitieren kann.
★ 6.432+0Sterne-Änderung der letzten 7 Tage - #28
Deklarative Datenautomatisierungssprache und Go-Laufzeitumgebung für strukturierte Extraktionsworkflows.
★ 6.009+0Sterne-Änderung der letzten 7 Tage - #29
Daten von Google Maps scrapen. Extrahiert für jeden Ort Daten wie Name, Adresse, Telefonnummer, Website-URL, Bewertung, Anzahl der Rezensionen, Breiten- und Längengrad, Rezensionen, E-Mail und mehr.
★ 5.710+0Sterne-Änderung der letzten 7 Tage - #30
Für KI-Agenten entwickelte Browser-Automatisierungs-CLI. Überwindet Anti-Bot-Sperren und übergibt bei Problemen an Menschen auf verschiedenen Plattformen. Parallele Multitask-Ausführung, unabhängiger Multisitzungs-Betrieb, isoliertes Multi-Konto-Browsing.
★ 5.549+0Sterne-Änderung der letzten 7 Tage