メインコンテンツへスキップ
buildradar
トピック · web-crawler

web-crawler

web-crawler がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
31
総スター数
313,958
平均スター数
10,128
シェア
0.02%

web-crawler と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、web-crawler がタグ付けされたリポジトリ。

  • moli@lexmount

    AI エージェント向けに最適なヘッドレスブラウザ。軽量、高速、高互換。Rust 製

    1,481
  • firecrawl@firecrawl

    大規模にウェブを検索、スクレイピング、操作するためのContext API。🔥

    174,034+3,406直近 7 日のスター増減
  • Scrapegraph-ai@ScrapeGraphAI

    AIベースの Python スクレイパー

    30,047+244直近 7 日のスター増減
  • crawlee@apify

    Crawlee—信頼性の高いクローラーを構築するためのNode.js用ウェブスクレイピングおよびブラウザ自動化ライブラリ。JavaScriptおよびTypeScriptで記述。AI、LLM、RAG、またはGPTs用のデータを抽出可能。ウェブサイトからHTML、PDF、JPG、PNGなどのファイルをダウンロード可能。Puppeteer、Playwright、Cheerio、JSDOM、および生のHTTPに対応。ヘッドフルモードとヘッドレスモードの両方に対応。プロキシローテーション機能付き。

    25,556+98直近 7 日のスター増減
  • crawlab@crawlab-team

    言語やフレームワークを問わない、スパイダー管理のための分散型Webクローラー管理プラットフォーム

    12,264+4直近 7 日のスター増減
  • crawlee-python@apify

    Crawlee—信頼性の高いクローラーを構築するためのPython用ウェブスクレイピングおよびブラウザ自動化ライブラリ。AI、LLM、RAG、またはGPTs向けにデータを抽出。ウェブサイトからHTML、PDF、JPG、PNGなどのファイルをダウンロード可能。Parsel、BeautifulSoup、Playwright、および生のHTTPに対応。ヘッドフルモードとヘッドレスモードの両方に対応。プロキシローテーション機能付き。

    9,477+19直近 7 日のスター増減
  • omniparse@adithya-s-k

    ドキュメントからマルチメディアまで、あらゆるデータ形式を取り込み、解析、最適化し、GenAIフレームワークとの互換性を強化

    7,819+5直近 7 日のスター増減
  • firecrawl-mcp-server@firecrawl

    🔥 公式Firecrawl MCPサーバー - Cursor、Claude、およびその他のLLMクライアントに強力なウェブスクレイピングと検索機能を追加。

    7,347+58直近 7 日のスター増減
  • さまざまな言語で書かれた素晴らしいウェブクローラー/スパイダーのコレクション。

    7,298+6直近 7 日のスター増減
  • wigolo@KnockOutEZ

    AIコーディングエージェントのための決定版ウェブサイト — MCP上でのローカルファースト検索、フェッチ、クロール、リサーチ。APIキー不要、クラウド不要、クエリあたり$0。パブリックベータ。

    4,752+131直近 7 日のスター増減
  • Argus@jasonxtn

    究極の情報収集ツールキット

    4,088+21直近 7 日のスター増減
  • nutch@apache

    Apache Nutchは、拡張性とスケーラビリティに優れたWebクローラーです。

    3,279+4直近 7 日のスター増減
  • URLからウェブサイトをクロールし、関連ページを見つけてデータを抽出する。すべて自然言語のプロンプトで制御されます。

    3,237+38直近 7 日のスター増減
  • spider@spider-rs

    AI エージェントや LLM 向けにウェブデータ取得を提供する

    2,681+14直近 7 日のスター増減
  • anakin@Anakin-Inc

    オープンソースのWebスクレイピングAPI。任意のウェブサイトをクリーンなMarkdownまたは構造化JSONに変換。アンチ検出ブラウザ、プロキシの自動選択、セルフホスト対応。1コマンド:make up

    2,453+178直近 7 日のスター増減
  • webclaw@0xMassi

    LLM向けの高速でローカルファーストなWebコンテンツ抽出ツール。スクレイピング、クロール、構造化データの抽出をすべてRustで実行。CLI、REST API、MCPサーバーに対応。

    2,313+15直近 7 日のスター増減
  • abot@sjdirect

    速度と柔軟性を重視して構築された、クロスプラットフォーム対応のC#製Webクローラーフレームワーク。このプロジェクトにスターをお願いします!+1。

    2,310+0直近 7 日のスター増減
  • MarginaliaSearch@MarginaliaSearch

    テキスト指向ウェブサイトのためのインターネット検索エンジン。小さく、古く、奇妙なウェブをインデックス化します。

    1,929+8直近 7 日のスター増減
  • single-file-cli@gildas-lormeau

    完全なWebページの正確なコピーを単一のHTMLファイルに保存するためのCLIツール(SingleFileベース)

    1,573+21直近 7 日のスター増減
  • moli@lexmount

    AI エージェント向けに最適なヘッドレスブラウザ。軽量、高速、高互換。Rust 製

    1,481+556直近 7 日のスター増減
  • linkinator@JustinBeckwith

    Webサイトを巡回してリンクを検証するリンク切れチェッカー。Webサイト、ドキュメント、ローカルファイル内のリンク切れや無効な URL を検出します。SEO 監査や CI/CD に最適です。

    1,255+4直近 7 日のスター増減
  • browsertrix-crawler@webrecorder

    単一のDockerコンテナで高忠実度なブラウザベースのウェブアーカイブクローラーを実行する

    1,124+6直近 7 日のスター増減
  • scrapfly-scrapers@scrapfly

    40以上の人気ドメインに対応したスケーラブルなPythonウェブスクレイピングスクリプト

    1,071+5直近 7 日のスター増減
  • stormcrawler@apache

    Apache Stormをベースにした、スケーラブルで成熟した多目的Webクローラー

    994+1直近 7 日のスター増減
  • LibreCrawl@PhialsBasement

    無料のデスクトップ SEO クローラー - Screaming Frog および類似ツールのオープンソース代替。サブスクリプション料金なしでウェブサイトのクロール、リンク分析、SEO データの抽出、結果のエクスポートが可能。完全にカスタマイズおよび拡張可能!

    890+16直近 7 日のスター増減
  • crw@us

    Rust製の高速で軽量な Firecrawl/Tavily 代替ツール。AI エージェント向け MCP サーバーを備えた Web スクレイパー、クローラー、検索 API。Firecrawl 互換 API (/scrape, /crawl, /search) をドロップインで利用可能。1K-URL のベンチマークでは Tavily の 2.3 倍、Firecrawl の 1.5 倍高速。6 MB RAM、シングルバイナリ。セルフホストまたはマネージドクラウドに対応。

    876+230直近 7 日のスター増減
  • spidr@postmodern

    サイト、複数のドメイン、特定のリンク、または無制限に巡回できる多目的 Ruby ウェブスパイダリングライブラリ。高速で使いやすいように設計されています。

    836+0直近 7 日のスター増減
  • firecrawl-app-examples@firecrawl

    🔥 このリポジトリには、Firecrawlを使用して開発されたWebサイトやその他のプロジェクトを含む完全なアプリケーション例が含まれています。

    811+2直近 7 日のスター増減
  • Craw4LLM@cxcscmu

    「Craw4LLM: Efficient Web Crawling for LLM Pretraining」の公式リポジトリ

    663+1直近 7 日のスター増減
  • Stealth-Requests@jpjacobpadilla

    Python による検知されにくいウェブスクレイピングとシームレスな HTML パース

    561+2直近 7 日のスター増減
  • reader@vakra-dev

    AIのためのオープンソースWebインフラ。Webのスクレイピング、クロール、自動化、クリーンなMarkdown変換、ブラウザセッションを提供し、エージェントの即時利用に対応します。

    558+0直近 7 日のスター増減
← トピック一覧に戻る