web-crawler
web-crawler がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
web-crawler と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、web-crawler がタグ付けされたリポジトリ。
- #1★ 174,034+3,406直近 7 日のスター増減
- #2
AIベースの Python スクレイパー
★ 30,047+244直近 7 日のスター増減 - #3
Crawlee—信頼性の高いクローラーを構築するためのNode.js用ウェブスクレイピングおよびブラウザ自動化ライブラリ。JavaScriptおよびTypeScriptで記述。AI、LLM、RAG、またはGPTs用のデータを抽出可能。ウェブサイトからHTML、PDF、JPG、PNGなどのファイルをダウンロード可能。Puppeteer、Playwright、Cheerio、JSDOM、および生のHTTPに対応。ヘッドフルモードとヘッドレスモードの両方に対応。プロキシローテーション機能付き。
★ 25,556+98直近 7 日のスター増減 - #4★ 12,264+4直近 7 日のスター増減
- #5
Crawlee—信頼性の高いクローラーを構築するためのPython用ウェブスクレイピングおよびブラウザ自動化ライブラリ。AI、LLM、RAG、またはGPTs向けにデータを抽出。ウェブサイトからHTML、PDF、JPG、PNGなどのファイルをダウンロード可能。Parsel、BeautifulSoup、Playwright、および生のHTTPに対応。ヘッドフルモードとヘッドレスモードの両方に対応。プロキシローテーション機能付き。
★ 9,477+19直近 7 日のスター増減 - #6★ 7,819+5直近 7 日のスター増減
- #7
🔥 公式Firecrawl MCPサーバー - Cursor、Claude、およびその他のLLMクライアントに強力なウェブスクレイピングと検索機能を追加。
★ 7,347+58直近 7 日のスター増減 - #8
さまざまな言語で書かれた素晴らしいウェブクローラー/スパイダーのコレクション。
★ 7,298+6直近 7 日のスター増減 - #9
AIコーディングエージェントのための決定版ウェブサイト — MCP上でのローカルファースト検索、フェッチ、クロール、リサーチ。APIキー不要、クラウド不要、クエリあたり$0。パブリックベータ。
★ 4,752+131直近 7 日のスター増減 - #10★ 4,088+21直近 7 日のスター増減
- #11★ 3,279+4直近 7 日のスター増減
- #12
URLからウェブサイトをクロールし、関連ページを見つけてデータを抽出する。すべて自然言語のプロンプトで制御されます。
★ 3,237+38直近 7 日のスター増減 - #13★ 2,681+14直近 7 日のスター増減
- #14
オープンソースのWebスクレイピングAPI。任意のウェブサイトをクリーンなMarkdownまたは構造化JSONに変換。アンチ検出ブラウザ、プロキシの自動選択、セルフホスト対応。1コマンド:make up
★ 2,453+178直近 7 日のスター増減 - #15
LLM向けの高速でローカルファーストなWebコンテンツ抽出ツール。スクレイピング、クロール、構造化データの抽出をすべてRustで実行。CLI、REST API、MCPサーバーに対応。
★ 2,313+15直近 7 日のスター増減 - #16★ 2,310+0直近 7 日のスター増減
- #17
テキスト指向ウェブサイトのためのインターネット検索エンジン。小さく、古く、奇妙なウェブをインデックス化します。
★ 1,929+8直近 7 日のスター増減 - #18
完全なWebページの正確なコピーを単一のHTMLファイルに保存するためのCLIツール(SingleFileベース)
★ 1,573+21直近 7 日のスター増減 - #19★ 1,481+556直近 7 日のスター増減
- #20
Webサイトを巡回してリンクを検証するリンク切れチェッカー。Webサイト、ドキュメント、ローカルファイル内のリンク切れや無効な URL を検出します。SEO 監査や CI/CD に最適です。
★ 1,255+4直近 7 日のスター増減 - #21
単一のDockerコンテナで高忠実度なブラウザベースのウェブアーカイブクローラーを実行する
★ 1,124+6直近 7 日のスター増減 - #22
40以上の人気ドメインに対応したスケーラブルなPythonウェブスクレイピングスクリプト
★ 1,071+5直近 7 日のスター増減 - #23
Apache Stormをベースにした、スケーラブルで成熟した多目的Webクローラー
★ 994+1直近 7 日のスター増減 - #24
無料のデスクトップ SEO クローラー - Screaming Frog および類似ツールのオープンソース代替。サブスクリプション料金なしでウェブサイトのクロール、リンク分析、SEO データの抽出、結果のエクスポートが可能。完全にカスタマイズおよび拡張可能!
★ 890+16直近 7 日のスター増減 - #25
Rust製の高速で軽量な Firecrawl/Tavily 代替ツール。AI エージェント向け MCP サーバーを備えた Web スクレイパー、クローラー、検索 API。Firecrawl 互換 API (/scrape, /crawl, /search) をドロップインで利用可能。1K-URL のベンチマークでは Tavily の 2.3 倍、Firecrawl の 1.5 倍高速。6 MB RAM、シングルバイナリ。セルフホストまたはマネージドクラウドに対応。
★ 876+230直近 7 日のスター増減 - #26★ 836+0直近 7 日のスター増減
- #27
🔥 このリポジトリには、Firecrawlを使用して開発されたWebサイトやその他のプロジェクトを含む完全なアプリケーション例が含まれています。
★ 811+2直近 7 日のスター増減 - #28★ 663+1直近 7 日のスター増減
- #29
Python による検知されにくいウェブスクレイピングとシームレスな HTML パース
★ 561+2直近 7 日のスター増減 - #30
AIのためのオープンソースWebインフラ。Webのスクレイピング、クロール、自動化、クリーンなMarkdown変換、ブラウザセッションを提供し、エージェントの即時利用に対応します。
★ 558+0直近 7 日のスター増減