メインコンテンツへスキップ
buildradar
Sign in
トピック · crawler

crawler

crawler がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

153 件のリポジトリ
  • sperm@darbra

    閲覧した素晴らしいリバースエンジニアリング関連記事のまとめ、必見です

    1,410+1直近 7 日のスター増減
  • mlscraper@lorey

    🤖 例を提供するだけで、HTMLウェブサイトからデータを自動スクレイピングする

    1,386+1直近 7 日のスター増減
  • crawler@kgspider

    K哥クローラーコード共有、JS リバースエンジニアリング、クローラーのステップアップ。公式アカウント「K哥爬虫」をフォローしてください

    1,379+0直近 7 日のスター増減
  • wombat@felipecsl

    ページから構造化データを抽出する、エレガントな DSL を備えた軽量な Ruby 製ウェブクローラー/スクレイパー

    1,360+0直近 7 日のスター増減
  • XSRFProbe@0xInfection

    クロスサイトリクエストフォージェリ(CSRF)の監査および悪用ツールキット

    1,303+1直近 7 日のスター増減
  • 📝 Instagram プロフィールの情報(フォロワー、タグなど)を素早くクロールします。

    1,302+1直近 7 日のスター増減
  • go-dork@dwisiswant0

    Go言語で書かれた最速のdorkスキャナー。

    1,302+1直近 7 日のスター増減
  • boss-zhipin-scraper@eatmoreduck

    Chrome CDP プロトコルを使用して実際のログイン状態を再利用し、フォントのスクレイピング対策を回避し、平文の給与 JSON/CSV および給与・スキル分析を出力する BOSS直聘 スクレイパー/求人データ取得ツール。

    1,282+50直近 7 日のスター増減
  • Beanbun@kiddyuchina

    Beanbun は PHP で書かれたマルチプロセス対応のWebクローラーフレームワークで、優れたオープン性と高い拡張性を持ち、Workerman をベースにしています。

    1,258-1直近 7 日のスター増減
  • 使いやすいBilibili漫画ダウンローダー。GUIを備え、キーワード検索やQRコードログイン、未解錠チャプターの高度なダウンロード、マルチスレッドダウンロード、多彩な保存形式、ローカル漫画管理、ワンクリックでのアップデート確認をサポート。

    1,243+1直近 7 日のスター増減
  • AppCrawler@seveniruby

    Appium に基づくアプリ自動クロールツール。

    1,237+0直近 7 日のスター増減
  • tumblr-crawler@dixudx

    Tumblr ブログからすべての写真や動画を簡単にダウンロード。

    1,157+0直近 7 日のスター増減
  • newspaper4k@AndyTheFactory

    ニュースサイトから記事、タイトル、メタデータを抽出する、親しまれているNewspaper3kのフォーク版「Newspaper4k」

    1,141+1直近 7 日のスター増減
  • fess@codelibs

    OpenSearch をベースに構築された、オープンソースかつセルフホスト型のエンタープライズおよびサイト検索サーバー。Web、ファイル、DB、クラウドデータソースのクロール、20 以上の言語、REST API、AI/RAG、セマンティック検索をサポート。Apache-2.0。

    1,128+1直近 7 日のスター増減
  • browsertrix-crawler@webrecorder

    単一のDockerコンテナで高忠実度なブラウザベースのウェブアーカイブクローラーを実行する

    1,127+7直近 7 日のスター増減
  • crawly@elixir-crawly

    Elixir向けのハイレベルなウェブクローラー&スクレイピングフレームワーク

    1,116+2直近 7 日のスター増減
  • kimuraframework@vifreefly

    クリーンで AI 支援型 DSL を使用して Ruby でウェブスクレイパーを記述する。Kimurai は AI を使用してデータの位置を特定し、セレクタをキャッシュして純粋な Ruby でスクレイピングを行います。リクエストごとのレイテンシやトークンコストなしで LLM の知能を活用できます。

    1,102+0直近 7 日のスター増減
  • scrapfly-scrapers@scrapfly

    40以上の人気ドメインに対応したスケーラブルなPythonウェブスクレイピングスクリプト

    1,075+3直近 7 日のスター増減
  • parse-video@wujunwei928

    Golang による短尺動画のウォーターマーク削除ツール:TikTok、皮皮蝦、火山、微視、最右、快手、全民小視頻、皮皮搞笑、西瓜視頻、虎牙、梨視頻、AcFun、好看視頻などに対応

    1,031+6直近 7 日のスター増減
  • wreq@0x676e67

    人間工学的でプライバシーに配慮したRust製HTTPクライアント

    1,016+8直近 7 日のスター増減
  • 小説のダウンロード・スクレイピング、起点、筆趣閣、Markdown エクスポート、txt エクスポート、epub 変換、広告フィルター、自動校正

    1,016+8直近 7 日のスター増減
  • Pxer@pea3nut

    pixiv.net 用ツール。誰でも使える pixiv スクレイパー

    1,009+0直近 7 日のスター増減
  • google-play-scraper@JoMingyu

    <facundoolano/google-play-scraper> にインスパイアされた Python 用 Google Play スクレイパー

    1,009+2直近 7 日のスター増減
  • stormcrawler@apache

    Apache Stormをベースにした、スケーラブルで成熟した多目的Webクローラー

    994+2直近 7 日のスター増減
  • SpiderSuite@spidersuite

    SpiderSuite(Web セキュリティクローラー)のリリース、Wiki、ロードマップ

    974-2直近 7 日のスター増減
  • crawler@fredwu

    Elixir 製の高性能ウェブクローラー/スクレイパー

    956+0直近 7 日のスター増減
  • crw@us

    Rust製の高速で軽量な Firecrawl/Tavily 代替ツール。AI エージェント向け MCP サーバーを備えた Web スクレイパー、クローラー、検索 API。Firecrawl 互換 API (/scrape, /crawl, /search) をドロップインで利用可能。1K-URL のベンチマークでは Tavily の 2.3 倍、Firecrawl の 1.5 倍高速。6 MB RAM、シングルバイナリ。セルフホストまたはマネージドクラウドに対応。

    952+133直近 7 日のスター増減
  • x-kit@xiaoxiunique

    VibeLoft の Twitter アカウントデータセットを含む、X.com 向けの純粋な Python プロトコルツールおよび研究ノート

    940+0直近 7 日のスター増減
  • icrawler@hellock

    多数の組み込み画像クローラーを備えたマルチスレッド対応クローラーフレームワーク

    933+0直近 7 日のスター増減
  • chatWeb@SkywalkerDarren

    ChatWeb はウェブページのクロール、PDF・DOCX・TXT の読み込みを行ってメインコンテンツを抽出し、その内容に基づいて質問に回答したり、要点をまとめたりすることができます。

    916+0直近 7 日のスター増減
← トピック一覧に戻る