Zum Hauptinhalt springen
buildradar
Anmelden
Thema · web-scraping

web-scraping

Erfasste Open-Source-Repos mit dem Tag web-scraping, sortiert nach Sternen.

Repos
119
Sterne gesamt
843.479
Sterne im Schnitt
7.088
Anteil
0,04%

Themen, die häufig gemeinsam mit web-scraping am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit web-scraping getaggt wurden.

  • moli@lexmount

    Bester Headless-Browser für KI-Agenten. Schlank, schnell, hohe Kompatibilität. In Rust entwickelt.

    1.841
  • creatorhub@3441293738

    Plattformübergreifende Inhaltsüberwachung, -erfassung und -übertragung: Ein Web-Dashboard zur Verwaltung von Douyin, Xiaohongshu und Kuaishou.

    1.833
  • trawl@germondai

    Selbst gehostete Scraping-Engine — umgeht jegliche JS-Herausforderungen und Captchas: Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Eine FlareSolverr- und Byparr-Alternative sowie direkter Ersatz für Ihren *arr-Stack.

    793
  • browser-search@Johell1NS

    A skill for AI agents: search the web with SearXNG, browse with Camofox, bypass protections with CloakBrowser. Anti-hallucination by design. Self-hosted, free, unlimited.

    515
  • oc@only-cli

    Turn any website into a compact CLI tailored for AI agents. Browse the web in hundreds of tokens, not tens of thousands.

    441
  • firecrawl@firecrawl

    Die Context API zum Suchen, Scrapen und Interagieren mit dem Web auf großer Skalierung. 🔥

    175.781+0Sterne-Änderung der letzten 7 Tage
  • Scrapling@D4Vinci

    🕷️ Ein adaptives Web-Scraping-Framework, das alles von einer einzelnen Anfrage bis zu einem groß angelegten Crawl behandelt!

    78.099+0Sterne-Änderung der letzten 7 Tage
  • scrapy@scrapy

    Scrapy, ein schneller, hochstufiges Web-Crawling- und Scraping-Framework für Python.

    64.179+0Sterne-Änderung der letzten 7 Tage
  • ai-website-cloner-template@JCodesMore

    Klonen Sie jede Website mit einem einzigen Befehl mithilfe von KI‑Coding‑Agenten.

    33.686+0Sterne-Änderung der letzten 7 Tage
  • changedetection.io@dgtlmoon

    Das beste und einfachste Tool zur Erkennung von Website-Änderungen, Webseitenüberwachung und Benachrichtigungen über Änderungen. Ideal zum Verfolgen von Inhaltsänderungen, Preissenkungen, Nachschubwarnungen und Überwachung von Website-Vandalismus – kostenlos oder mit unserem SaaS-Plan.

    33.494+0Sterne-Änderung der letzten 7 Tage
  • CloakBrowser@CloakHQ

    Stealth Chromium, das jeden Bot-Erkennungs-Test besteht. Drop-in-Ersatz für Playwright mit Quellcode-Ebene-Fingerabdruck-Patches. 30/30 Tests bestanden.

    31.110+0Sterne-Änderung der letzten 7 Tage
  • Scrapegraph-ai@ScrapeGraphAI

    Python‑Scraper basierend auf KI

    30.435+0Sterne-Änderung der letzten 7 Tage
  • AIHawk@feder-cr

    Open‑Source‑KI‑Bewerbungs‑Bot in Python: Browser‑Automatisierung und Web‑Scraping zum Lesen von Stellenanzeigen, dann automatisches Bewerben mit einem zugeschnittenen Lebenslauf und Anschreiben für jede Anzeige.

    30.304+0Sterne-Änderung der letzten 7 Tage
  • crawlee@apify

    Crawlee—A web scraping and browser automation library for Node.js zur Erstellung zuverlässiger Crawler. In JavaScript und TypeScript. Daten für KI, LLMs, RAG oder GPTs extrahieren. HTML, PDF, JPG, PNG und andere Dateien von Websites herunterladen. Funktioniert mit Puppeteer, Playwright, Cheerio, JSDOM und raw HTTP. Sowohl headful als auch headless-Modus. Mit Proxy-Rotation.

    25.622+0Sterne-Änderung der letzten 7 Tage
  • 🚀 „Douyin_TikTok_Download_API“ ist ein sofort einsatzbereites, performantes, asynchrones Daten-Scraping-Tool für Douyin, Kuaishou, TikTok und Bilibili, das API-Aufrufe sowie Online-Batch-Parsing und -Download unterstützt.

    19.789+0Sterne-Änderung der letzten 7 Tage
  • maxun@getmaxun

    🔥 Die Open-Source-No-Code-Plattform für Web-Scraping, Crawling, Suche und KI-Datenextraktion • Verwandeln Sie Websites in Minuten in strukturierte APIs 🔥

    17.349+0Sterne-Änderung der letzten 7 Tage
  • SurfSense@MODSetter

    Open-Source-Alternative zu NotebookLM. Durchsuche das offene Web mit Live-Daten (Reddit, YT, IG, TikTok, Indeed, Google Search, Maps usw.) über eine Plattform, API oder einen MCP-Server. Trete unserem Discord bei: https://discord.gg/ejRNvftDp9

    16.066+0Sterne-Änderung der letzten 7 Tage
  • Skill_Seekers@yusufkaraaslan

    Konvertierung von Dokumentations-Websites, GitHub-Repositories und PDFs in Claude-AI-Fähigkeiten mit automatischer Konflikterkennung

    14.888+0Sterne-Änderung der letzten 7 Tage
  • SeleniumBase@seleniumbase

    📊 APIs für Web-Automatisierung, Tests und das Umgehen von Bot-Erkennung.

    12.972+0Sterne-Änderung der letzten 7 Tage
  • jsoup@jhy

    jsoup: Der Java-HTML-Parser, entwickelt für HTML-Bearbeitung, Bereinigung, Scraping und XSS-Sicherheit.

    11.385+0Sterne-Änderung der letzten 7 Tage
  • pinchtab@pinchtab

    Leistungsstarke Browser-Automatisierungsbrücke und Multi-Instance-Orchestrator mit erweiterter Stealth-Injektion und Echtzeit-Dashboard.

    10.219+0Sterne-Änderung der letzten 7 Tage
  • crawlee-python@apify

    Crawlee — Eine Web-Scraping- und Browser-Automatisierungsbibliothek für Python zur Erstellung zuverlässiger Crawler. Extrahieren Sie Daten für KI, LLMs, RAG oder GPTs. Laden Sie HTML, PDF, JPG, PNG und andere Dateien von Websites herunter. Funktioniert mit Parsel, BeautifulSoup, Playwright und nativem HTTP. Sowohl Headful- als auch Headless-Modus. Mit Proxy-Rotation.

    9.481+0Sterne-Änderung der letzten 7 Tage
  • camofox-browser@jo-inc

    Stealth-Headless-Browser für AI-Agents – umgeht Cloudflare, Bot-Erkennung und Anti-Scraping. Drop-in-Ersatz für Puppeteer/Playwright.

    9.039+0Sterne-Änderung der letzten 7 Tage
  • helium@mherrmann

    Leichtere Web-Automatisierung mit Python

    8.322+0Sterne-Änderung der letzten 7 Tage
  • awesome-web-scraping@lorien

    Liste von Bibliotheken, Tools und APIs für Web Scraping und Datenverarbeitung.

    8.139+0Sterne-Änderung der letzten 7 Tage
  • autoscraper@alirezamika

    Ein intelligenter, automatischer, schneller und leichtgewichtiger Web Scraper für Python

    7.932+0Sterne-Änderung der letzten 7 Tage
  • API-mega-list@cporter202

    Dieses GitHub-Repository ist eine leistungsstarke Sammlung von APIs, die Sie sofort nutzen können, um alles von einfachen Automatisierungen bis hin zu vollwertigen Anwendungen zu entwickeln. Eine der wertvollsten API-Listen auf GitHub überhaupt. 💪

    7.585+0Sterne-Änderung der letzten 7 Tage
  • firecrawl-mcp-server@firecrawl

    🔥 Offizieller Firecrawl MCP Server – Fügt leistungsstarkes Web-Scraping und -Suchen zu Cursor, Claude und anderen LLM-Clients hinzu.

    7.381+0Sterne-Änderung der letzten 7 Tage
  • rod@go-rod

    Ein Chrome DevTools Protocol-Treiber für Web-Automatisierung und Scraping.

    7.084+0Sterne-Änderung der letzten 7 Tage
  • pydoll@autoscrape-labs

    Pydoll ist eine Bibliothek zur Automatisierung von Chromium-basierten Browsern ohne WebDriver und bietet realistische Interaktionen.

    7.060+0Sterne-Änderung der letzten 7 Tage
  • trafilatura@adbar

    Python- und Befehlszeilen-Tool zum Sammeln von Text und Metadaten im Web: Crawling, Scraping, Extraktion, Ausgabe als CSV, JSON, HTML, MD, TXT, XML

    6.754+0Sterne-Änderung der letzten 7 Tage
  • curl_cffi@lexiforest

    Python-Binding für das curl-impersonate-Fork via cffi. Ein HTTP-Client, der Browser-TLS/JA3/HTTP2-Fingerabdrücke imitieren kann.

    6.432+0Sterne-Änderung der letzten 7 Tage
  • ferret@MontFerret

    Deklarative Datenautomatisierungssprache und Go-Laufzeitumgebung für strukturierte Extraktionsworkflows.

    6.009+0Sterne-Änderung der letzten 7 Tage
  • Daten von Google Maps scrapen. Extrahiert für jeden Ort Daten wie Name, Adresse, Telefonnummer, Website-URL, Bewertung, Anzahl der Rezensionen, Breiten- und Längengrad, Rezensionen, E-Mail und mehr.

    5.710+0Sterne-Änderung der letzten 7 Tage
  • skills@browser-act

    Für KI-Agenten entwickelte Browser-Automatisierungs-CLI. Überwindet Anti-Bot-Sperren und übergibt bei Problemen an Menschen auf verschiedenen Plattformen. Parallele Multitask-Ausführung, unabhängiger Multisitzungs-Betrieb, isoliertes Multi-Konto-Browsing.

    5.549+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen