Zum Hauptinhalt springen
buildradar
Sign in
Thema · crawling

crawling

Erfasste Open-Source-Repos mit dem Tag crawling, sortiert nach Sternen.

Repos
39
Sterne gesamt
303.335
Sterne im Schnitt
7.778
Anteil
0,02%

Themen, die häufig gemeinsam mit crawling am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit crawling getaggt wurden.

  • donsetch@dondai44423

    Web fetch, search, and crawl for AI agents. Built from scratch in Rust. No keys, no accounts. AGPL v3.

    624
  • Scrapling@D4Vinci

    🕷️ Ein adaptives Web-Scraping-Framework, das alles von einer einzelnen Anfrage bis zu einem groß angelegten Crawl behandelt!

    78.099+941Sterne-Änderung der letzten 7 Tage
  • scrapy@scrapy

    Scrapy, ein schneller, hochstufiges Web-Crawling- und Scraping-Framework für Python.

    64.179+81Sterne-Änderung der letzten 7 Tage
  • crawlee@apify

    Crawlee—A web scraping and browser automation library for Node.js zur Erstellung zuverlässiger Crawler. In JavaScript und TypeScript. Daten für KI, LLMs, RAG oder GPTs extrahieren. HTML, PDF, JPG, PNG und andere Dateien von Websites herunterladen. Funktioniert mit Puppeteer, Playwright, Cheerio, JSDOM und raw HTTP. Sowohl headful als auch headless-Modus. Mit Proxy-Rotation.

    25.622+66Sterne-Änderung der letzten 7 Tage
  • colly@gocolly

    Elegant Scraper und Crawler Framework für Golang

    25.494+6Sterne-Änderung der letzten 7 Tage
  • maxun@getmaxun

    🔥 Die Open-Source-No-Code-Plattform für Web-Scraping, Crawling, Suche und KI-Datenextraktion • Verwandeln Sie Websites in Minuten in strukturierte APIs 🔥

    17.349+27Sterne-Änderung der letzten 7 Tage
  • newspaper@codelucas

    newspaper3k ist ein Tool für Python 3 zum Extrahieren von Nachrichten, Volltexten und Artikelmetadaten. Erweiterte Dokumentation:

    15.148+2Sterne-Änderung der letzten 7 Tage
  • crawlee-python@apify

    Crawlee — Eine Web-Scraping- und Browser-Automatisierungsbibliothek für Python zur Erstellung zuverlässiger Crawler. Extrahieren Sie Daten für KI, LLMs, RAG oder GPTs. Laden Sie HTML, PDF, JPG, PNG und andere Dateien von Websites herunter. Funktioniert mit Parsel, BeautifulSoup, Playwright und nativem HTTP. Sowohl Headful- als auch Headless-Modus. Mit Proxy-Rotation.

    9.481+4Sterne-Änderung der letzten 7 Tage
  • awesome-web-scraping@lorien

    Liste von Bibliotheken, Tools und APIs für Web Scraping und Datenverarbeitung.

    8.139+1Sterne-Änderung der letzten 7 Tage
  • rod@go-rod

    Ein Chrome DevTools Protocol-Treiber für Web-Automatisierung und Scraping.

    7.084+2Sterne-Änderung der letzten 7 Tage
  • hakrawler@hakluke

    Einfacher, schneller Web-Crawler für die einfache und schnelle Erkennung von Endpunkten und Assets in einer Webanwendung

    5.117+1Sterne-Änderung der letzten 7 Tage
  • exa-mcp-server@exa-labs

    Exa MCP für Websuche und Web-Crawling!

    4.956+11Sterne-Änderung der letzten 7 Tage
  • ai.robots.txt@ai-robots-txt

    Eine Liste von KI-Agenten und Robotern zum Blockieren.

    4.097+12Sterne-Änderung der letzten 7 Tage
  • puppeteer-sharp@hardkoded

    Headless Chrome .NET API

    3.917+1Sterne-Änderung der letzten 7 Tage
  • cariddi@edoardottt

    Nimmt eine Liste von Domains entgegen, durchsucht URLs und scannt nach Endpunkten, Secrets, API-Schlüsseln, Dateiendungen, Token und mehr.

    3.758+2Sterne-Änderung der letzten 7 Tage
  • nutch@apache

    Apache Nutch ist ein erweiterbarer und skalierbarer Web-Crawler

    3.283+4Sterne-Änderung der letzten 7 Tage
  • awesome-puppeteer@transitive-bullshit

    Eine kuratierte Liste fantastischer Puppeteer-Ressourcen.

    2.575+3Sterne-Änderung der letzten 7 Tage
  • grab@lorien

    Web-Scraping-Framework

    2.463+0Sterne-Änderung der letzten 7 Tage
  • holiday-cn@NateScarlet

    📅🇨🇳 Chinesische gesetzliche Feiertagsdaten, automatisch täglich aus Bekanntmachungen des Staatsrats abgerufen

    2.120+9Sterne-Änderung der letzten 7 Tage
  • skycaiji@zorlan

    Ein Open-Source-Webscraper zum Extrahieren von Daten per Point-and-Click

    2.088-1Sterne-Änderung der letzten 7 Tage
  • core@roach-php

    Das vollständige Web-Scraping-Toolkit für PHP.

    1.455+0Sterne-Änderung der letzten 7 Tage
  • rebrowser-patches@rebrowser

    Sammlung von Patches für Puppeteer und Playwright zur Vermeidung von Automatisierungserkennung und Leaks. Hilft dabei, Cloudflare- und DataDome-CAPTCHA-Seiten zu umgehen. Einfach zu patchen/entpatchen, bei Bedarf ein- und ausschaltbar.

    1.422-1Sterne-Änderung der letzten 7 Tage
  • mlscraper@lorey

    🤖 Automatisches Scrapen von Daten von HTML-Websites durch einfaches Bereitstellen von Beispielen

    1.386+1Sterne-Änderung der letzten 7 Tage
  • bhban_rpa@needleworm

    Beispielcode für „Work Automation: Finish 6 Months of Work in One Day“ (Saengneung Publishing, 2020). Dieser Code richtet sich an Personen, die noch nie Python gelernt haben, und bietet Beispiele für verschiedene Bereiche der Arbeitsautomatisierung, von Excel über Design und Makros bis hin zu Web Scraping.

    1.150+1Sterne-Änderung der letzten 7 Tage
  • browsertrix-crawler@webrecorder

    Ausführen eines hochpräzisen, browserbasierten Web-Archivierungs-Crawlers in einem einzigen Docker-Container

    1.127+5Sterne-Änderung der letzten 7 Tage
  • crawly@elixir-crawly

    Crawly, ein High-Level Web-Crawling- und -Scraping-Framework für Elixir.

    1.116+2Sterne-Änderung der letzten 7 Tage
  • scrapfly-scrapers@scrapfly

    Skalierbare Python-Web-Scraping-Skripte für mehr als 40 beliebte Domains

    1.076+4Sterne-Änderung der letzten 7 Tage
  • scrapy-selenium@clemfromspace

    Scrapy-Middleware zur Verarbeitung von JavaScript-Seiten mit Selenium

    950+0Sterne-Änderung der letzten 7 Tage
  • AdminHack@mishakorzik

    Heute werden wir das Admin-Panel der Website hacken.

    902+5Sterne-Änderung der letzten 7 Tage
  • siteone-crawler@janreges

    SiteOne Crawler ist ein plattformübergreifender Website-Crawler und -Analysator für SEO, Sicherheit, Barrierefreiheit und Leistungsoptimierung – ideal für Entwickler, DevOps, QA-Ingenieure und Berater. Unterstützt Windows, macOS und Linux (x64 und arm64).

    896+13Sterne-Änderung der letzten 7 Tage
  • scrapyrt@scrapinghub

    HTTP-API für Scrapy-Spider

    884+1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen