Zum Hauptinhalt springen
buildradar
Anmelden
Thema · scraping

scraping

Erfasste Open-Source-Repos mit dem Tag scraping, sortiert nach Sternen.

Repos
100
Sterne gesamt
703.012
Sterne im Schnitt
7.030
Anteil
0,04%

Themen, die häufig gemeinsam mit scraping am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit scraping getaggt wurden.

  • trawl@germondai

    Selbst gehostete Scraping-Engine — umgeht jegliche JS-Herausforderungen und Captchas: Cloudflare, Turnstile, reCAPTCHA, hCaptcha, GeeTest. Eine FlareSolverr- und Byparr-Alternative sowie direkter Ersatz für Ihren *arr-Stack.

    793
  • browser-search@Johell1NS

    A skill for AI agents: search the web with SearXNG, browse with Camofox, bypass protections with CloakBrowser. Anti-hallucination by design. Self-hosted, free, unlimited.

    515
  • firecrawl@firecrawl

    Die Context API zum Suchen, Scrapen und Interagieren mit dem Web auf großer Skalierung. 🔥

    175.781+0Sterne-Änderung der letzten 7 Tage
  • Scrapling@D4Vinci

    🕷️ Ein adaptives Web-Scraping-Framework, das alles von einer einzelnen Anfrage bis zu einem groß angelegten Crawl behandelt!

    78.099+0Sterne-Änderung der letzten 7 Tage
  • scrapy@scrapy

    Scrapy, ein schneller, hochstufiges Web-Crawling- und Scraping-Framework für Python.

    64.179+0Sterne-Änderung der letzten 7 Tage
  • maigret@soxoj

    🕵️‍♂️ Erstelle ein Dossier zu einer Person anhand des Benutzernamens von über 3000 Websites.

    37.256+0Sterne-Änderung der letzten 7 Tage
  • Scrapegraph-ai@ScrapeGraphAI

    Python‑Scraper basierend auf KI

    30.435+0Sterne-Änderung der letzten 7 Tage
  • AIHawk@feder-cr

    Open‑Source‑KI‑Bewerbungs‑Bot in Python: Browser‑Automatisierung und Web‑Scraping zum Lesen von Stellenanzeigen, dann automatisches Bewerben mit einem zugeschnittenen Lebenslauf und Anschreiben für jede Anzeige.

    30.304+0Sterne-Änderung der letzten 7 Tage
  • crawlee@apify

    Crawlee—A web scraping and browser automation library for Node.js zur Erstellung zuverlässiger Crawler. In JavaScript und TypeScript. Daten für KI, LLMs, RAG oder GPTs extrahieren. HTML, PDF, JPG, PNG und andere Dateien von Websites herunterladen. Funktioniert mit Puppeteer, Playwright, Cheerio, JSDOM und raw HTTP. Sowohl headful als auch headless-Modus. Mit Proxy-Rotation.

    25.622+0Sterne-Änderung der letzten 7 Tage
  • colly@gocolly

    Elegant Scraper und Crawler Framework für Golang

    25.494+0Sterne-Änderung der letzten 7 Tage
  • Pythonisches HTML-Parsing für Menschen™

    13.812+0Sterne-Änderung der letzten 7 Tage
  • undetected-chromedriver@ultrafunkamsterdam

    Benutzerdefinierter Selenium Chromedriver | Zero-Config | Umgeht ALLE Bot-Schutzsysteme (wie Distil / Imperva / Datadome / CloudFlare IUAM)

    12.821+0Sterne-Änderung der letzten 7 Tage
  • webmagic@code4craft

    Ein skalierbares Web-Crawler-Framework für Java.

    11.681+0Sterne-Änderung der letzten 7 Tage
  • camoufox@daijro

    🦊 Anti-Detect-Browser

    11.634+0Sterne-Änderung der letzten 7 Tage
  • crawlee-python@apify

    Crawlee — Eine Web-Scraping- und Browser-Automatisierungsbibliothek für Python zur Erstellung zuverlässiger Crawler. Extrahieren Sie Daten für KI, LLMs, RAG oder GPTs. Laden Sie HTML, PDF, JPG, PNG und andere Dateien von Websites herunter. Funktioniert mit Parsel, BeautifulSoup, Playwright und nativem HTTP. Sowohl Headful- als auch Headless-Modus. Mit Proxy-Rotation.

    9.481+0Sterne-Änderung der letzten 7 Tage
  • camofox-browser@jo-inc

    Stealth-Headless-Browser für AI-Agents – umgeht Cloudflare, Bot-Erkennung und Anti-Scraping. Drop-in-Ersatz für Puppeteer/Playwright.

    9.039+0Sterne-Änderung der letzten 7 Tage
  • awesome-web-scraping@lorien

    Liste von Bibliotheken, Tools und APIs für Web Scraping und Datenverarbeitung.

    8.139+0Sterne-Änderung der letzten 7 Tage
  • autoscraper@alirezamika

    Ein intelligenter, automatischer, schneller und leichtgewichtiger Web Scraper für Python

    7.932+0Sterne-Änderung der letzten 7 Tage
  • tabula@tabulapdf

    Tabula ist ein Werkzeug zum Befreien von Datentabellen, die in PDF-Dateien eingeschlossen sind.

    7.480+0Sterne-Änderung der letzten 7 Tage
  • pydoll@autoscrape-labs

    Pydoll ist eine Bibliothek zur Automatisierung von Chromium-basierten Browsern ohne WebDriver und bietet realistische Interaktionen.

    7.060+0Sterne-Änderung der letzten 7 Tage
  • trafilatura@adbar

    Python- und Befehlszeilen-Tool zum Sammeln von Text und Metadaten im Web: Crawling, Scraping, Extraktion, Ausgabe als CSV, JSON, HTML, MD, TXT, XML

    6.754+0Sterne-Änderung der letzten 7 Tage
  • 🚀 Kostenlose Liste von HTTP-, SOCKS4- und SOCKS5-Proxys * Alle 5 Minuten aktualisiert * sowie Rotations-Proxy-API (über 100 Länder)

    6.685+0Sterne-Änderung der letzten 7 Tage
  • pipet@bjesus

    Schweizer Taschenmesser zum Scraping und Extrahieren von Daten aus Online-Ressourcen, entwickelt für Hacker

    4.771+0Sterne-Änderung der letzten 7 Tage
  • twikit@d60

    Twitter API Scraper | Ohne API-Schlüssel | Twitter Interne API | Kostenlos | Twitter Scraper | Twitter Bot

    4.645+0Sterne-Änderung der letzten 7 Tage
  • mechanize@sparklemotion

    Mechanize ist eine Ruby-Bibliothek, die die automatisierte Web-Interaktion vereinfacht.

    4.440+0Sterne-Änderung der letzten 7 Tage
  • snoop@snooppr

    Snoop – ein OSINT-Recherche-Tool (Open Source Intelligence)

    4.015+0Sterne-Änderung der letzten 7 Tage
  • AnyCrawl@any4ai

    AnyCrawl 🚀: Ein Node.js/TypeScript-Crawler, der Websites in LLM-fähige Daten umwandelt und strukturierte SERP-Ergebnisse von Google/Bing/Baidu usw. extrahiert. Natives Multithreading für die Massenverarbeitung.

    3.446+0Sterne-Änderung der letzten 7 Tage
  • Möchtest du kostenlos neue Dinge lernen? Mit Hilfe von Web-Scraping und Automatisierung findet dieses Skript die nötigen Udemy-Gutscheine und schreibt dich absolut kostenlos in kostenpflichtige Udemy-Kurse ein!

    3.292+0Sterne-Änderung der letzten 7 Tage
  • facebook-scraper@kevinzg

    Öffentliche Facebook-Seiten ohne API-Schlüssel scrapen

    3.279+0Sterne-Änderung der letzten 7 Tage
  • panther@symfony

    Eine Browser-Test- und Web-Crawling-Bibliothek für PHP und Symfony

    3.069+0Sterne-Änderung der letzten 7 Tage
  • Ein Open-Source-Fingerabdruck-Browser basierend auf Ungoogled Chromium.

    3.014+0Sterne-Änderung der letzten 7 Tage
  • Lernen Sie Schritt für Schritt, wie Sie Google Trends-Daten scrapen und mit Python und der Oxylabs SERP API vergleichen. Extrahieren Sie Keywords, deren Beliebtheit, regionale Aufschlüsselung, verwandte Anfragen und mehr.

    2.909+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen