scraping
Erfasste Open-Source-Repos mit dem Tag scraping, sortiert nach Sternen.
- #61
Ein komplett überarbeitetes und neu gestaltetes Fork, von Grund auf neu erdacht basierend auf dem originalen onlyfans-scraper
★ 1.153+0Sterne-Änderung der letzten 7 Tage - #62
📰 Newspaper4k, ein Fork des beliebten Newspaper3k. Extraktion von Artikeln, Titeln und Metadaten von Nachrichtenwebsites.
★ 1.141+0Sterne-Änderung der letzten 7 Tage - #63
Der Agent, der Websites in APIs verwandelt!
★ 1.121+2Sterne-Änderung der letzten 7 Tage - #64★ 1.116+0Sterne-Änderung der letzten 7 Tage
- #65
Automatische Archivierung von Links zu Videos, Bildern und Social-Media-Inhalten aus Google Sheets (und mehr).
★ 1.113+1Sterne-Änderung der letzten 7 Tage - #66
⛏️ Die Extraktions-Engine hinter Maigret: Verwandelt jede Profil-URL in einen strukturierten OSINT-Datensatz über 150+ Websites hinweg
★ 1.082+5Sterne-Änderung der letzten 7 Tage - #67
Skalierbare Python-Web-Scraping-Skripte für mehr als 40 beliebte Domains
★ 1.078+5Sterne-Änderung der letzten 7 Tage - #68
🧹 Python-Paket zur Textbereinigung
★ 1.028+0Sterne-Änderung der letzten 7 Tage - #69★ 1.022+0Sterne-Änderung der letzten 7 Tage
- #70
Sammeln Sie strukturierte Antworten von einem ChatGPT-Scraper, indem Sie einen Prompt mit gültigen ChatGPT-Scraping-API-Zugangsdaten senden. Ermöglicht Live-Suche, das Injizieren von HTML-Kontext und die Automatisierung intelligenter Scraper-ChatGPT-Workflows mit nur wenigen Parametern.
★ 942+153Sterne-Änderung der letzten 7 Tage - #71
📄 Python-Tool, um Notion.so-Seiten in leichte, anpassbare statische Websites zu verwandeln
★ 857+0Sterne-Änderung der letzten 7 Tage - #72
Ein CLI-Toolset zur automatischen Erstellung von Inhaltsverzeichnissen für PDF-Dateien.
★ 848+0Sterne-Änderung der letzten 7 Tage - #73
Einfacher, aber nützlicher Python-Web-Scraping-Tutorial-Code.
★ 820+0Sterne-Änderung der letzten 7 Tage - #74
Selbst gehostete Scraping-Engine — umgeht jegliche JS-Herausforderungen und Captchas: Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Eine FlareSolverr- und Byparr-Alternative sowie direkter Ersatz für Ihren *arr-Stack.
★ 793+26Sterne-Änderung der letzten 7 Tage - #75
🕵️♂️ LinkedIn-Profil-Scraper, der strukturierte Profildaten in JSON zurückgibt.
★ 776+0Sterne-Änderung der letzten 7 Tage - #76
Lookyloo ist eine Webschnittstelle, mit der Benutzer eine Website-Seite erfassen und anschließend einen Baum von Domains anzeigen können, die sich gegenseitig aufrufen.
★ 774+1Sterne-Änderung der letzten 7 Tage - #77
😈📚 Eine kuratierte Sammlung von Forschungspapieren und Präsentationen für Erkennungsgegenmaßnahmen und Web-Datenschutz-Enthusiasten.
★ 771+2Sterne-Änderung der letzten 7 Tage - #78
Google-Suchergebnisse über SERP API Python-Paket
★ 755+2Sterne-Änderung der letzten 7 Tage - #79
Eine hochperformante Proxy-Rotations-Engine mit automatisierter IP-Verwaltung und Echtzeit-Zustandsüberwachung
★ 748+5Sterne-Änderung der letzten 7 Tage - #80
Python-Paket zum Scraping von Immobilien-Daten
★ 739+2Sterne-Änderung der letzten 7 Tage - #81
Comic-dl ist ein Befehlszeilentool zum Herunterladen von Manga und Comics von verschiedenen Websites. Unterstützte Websites: readcomiconline.to, mangafox.me, comic naver und viele mehr.
★ 676+2Sterne-Änderung der letzten 7 Tage - #82
:card_index: Extrahieren Sie Social-Media-Profile und mehr mit regulären Ausdrücken
★ 656+0Sterne-Änderung der letzten 7 Tage - #83
Tauchen Sie ein in Web-Scraping und bauen Sie einen Next.js 13 E-Commerce-PreisTracker in einem einzigen Video, das Daten-Scraping, Cron-Jobs, E-Mail-Versand, Deployment und mehr vermittelt.
★ 636+1Sterne-Änderung der letzten 7 Tage - #84
Sandkastenbasierte Zusammenarbeit für Multi-Agenten-Teams: ein Git-basiertes Nachrichtenforum, bei dem jeder Agent in seinem eigenen Einweg-Sandbox isoliert ist. Verwandelt ein Git-Repository in ein sicheres Nachrichtenforum für KI-Agenten.
★ 633+22Sterne-Änderung der letzten 7 Tage - #85
Eine API zum Extrahieren von Metadaten von US-amerikanischen Gerichtswebsites.
★ 631+3Sterne-Änderung der letzten 7 Tage - #86
Kemono pawchive Downloader ist eine schnelle PyQt5-App zum Archivieren von Inhalten von einer Vielzahl von Websites, darunter Kemono, Coomer, Bunkr, Erome, Saint2.su, nhentai und Discord. Sie bietet einen Creator Browser, einen Update-Checker und unterstützt multithreaded und mehrteilige Downloads. Sitzungen können pausiert, fortgesetzt oder wiederhergestellt werden, inklusive Filtern.
★ 630+10Sterne-Änderung der letzten 7 Tage - #87
Die einfachste Demo zur Chrome-Automatisierung mit Python und Selenium in AWS Lambda
★ 618+0Sterne-Änderung der letzten 7 Tage - #88
Diese Python-Anwendung ist ein OSINT-Tool (Open Source Intelligence) namens „Ominis OSINT - Web Hunter“. Es führt Online-Informationsbeschaffung durch, indem es Google nach Suchergebnissen für eine Benutzereingabe abfragt. Das Tool extrahiert relevante Informationen wie Titel, URLs und potenzielle Erwähnungen der Suchanfrage in den Ergebnissen.
★ 614+2Sterne-Änderung der letzten 7 Tage - #89
Python 3-Skript zum Auslesen und Extrahieren von Unternehmensmitarbeitern über die LinkedIn-API
★ 611+0Sterne-Änderung der letzten 7 Tage - #90
Universal Reddit Scraper – Funktioniert auf jedem Subreddit und bei jedem Benutzer
★ 597+4Sterne-Änderung der letzten 7 Tage