メインコンテンツへスキップ
buildradar
Sign in
トピック · scraper

scraper

scraper がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

114 件のリポジトリ
  • newspaper4k@AndyTheFactory

    ニュースサイトから記事、タイトル、メタデータを抽出する、親しまれているNewspaper3kのフォーク版「Newspaper4k」

    1,141+1直近 7 日のスター増減
  • crawly@elixir-crawly

    Elixir向けのハイレベルなウェブクローラー&スクレイピングフレームワーク

    1,116+2直近 7 日のスター増減
  • kimuraframework@vifreefly

    クリーンで AI 支援型 DSL を使用して Ruby でウェブスクレイパーを記述する。Kimurai は AI を使用してデータの位置を特定し、セレクタをキャッシュして純粋な Ruby でスクレイピングを行います。リクエストごとのレイテンシやトークンコストなしで LLM の知能を活用できます。

    1,102+0直近 7 日のスター増減
  • scrapfly-scrapers@scrapfly

    40以上の人気ドメインに対応したスケーラブルなPythonウェブスクレイピングスクリプト

    1,075+3直近 7 日のスター増減
  • jikan@jikan-me

    公式 API 以外の機能を提供する、非公式の MyAnimeList PHP+REST API。

    1,071+2直近 7 日のスター増減
  • URS@JosephLai241

    Universal Reddit Scraper - 包括的な Reddit スクレイピング/アーカイビング用コマンドラインツール。

    1,022+1直近 7 日のスター増減
  • GreenResourcesManager@klsdf

    PC 内の資源を管理し、ゲーミフィケーションを提供する総合マネージャー

    1,015+4直近 7 日のスター増減
  • wreq@0x676e67

    人間工学的でプライバシーに配慮したRust製HTTPクライアント

    1,015+8直近 7 日のスター増減
  • google-play-scraper@JoMingyu

    <facundoolano/google-play-scraper> にインスパイアされた Python 用 Google Play スクレイパー

    1,010+2直近 7 日のスター増減
  • 「Instagram の非公開投稿」を匿名で閲覧できる史上初のツール

    991+8直近 7 日のスター増減
  • crawler@fredwu

    Elixir 製の高性能ウェブクローラー/スクレイパー

    956+0直近 7 日のスター増減
  • x-tweet-fetcher@ythx-101

    ログインやAPIキーなしでX/Twitterのツイート、リプライ、タイムライン、記事を取得 — AIエージェント向けの現場用ツール。

    954+7直近 7 日のスター増減
  • scrapyrt@scrapinghub

    Scrapy スパイダー用の HTTP API

    883+0直近 7 日のスター増減
  • skrape.it@skrapeit

    HTML(サーバーおよびクライアントサイドレンダリング)の分析とデータ抽出機能を提供する、Kotlinベースのテスト/スクレイピング/パースライブラリ。直感的なDSLを提供することで、使いやすさと高い可読性を特に重視しています。テストライブラリとしての利用を目的としていますが、手軽にウェブサイトのスクレイピングを行うためにも使用できます。

    874-1直近 7 日のスター増減
  • xidel@benibela

    CSS、XPath 3.0、XQuery 3.0、JSONiq、またはパターンマッチングを使用して、HTML/XMLページやJSON-APIからデータをダウンロードおよび抽出するコマンドラインツール。新規または変換されたXML/HTML/JSONドキュメントの作成も可能。

    844+0直近 7 日のスター増減
  • zimit@openzim

    あらゆるウェブサイトから ZIM ファイルを作成し、オフラインで閲覧しよう!

    842+3直近 7 日のスター増減
  • HDoujinDownloader@HDoujinDownloader

    汎用同人誌・画像ギャラリーダウンローダー

    841-1直近 7 日のスター増減
  • epublifier@maoserr

    一部のWEB小説をepub形式に変換する

    839+1直近 7 日のスター増減
  • spidr@postmodern

    サイト、複数のドメイン、特定のリンク、または無制限に巡回できる多目的 Ruby ウェブスパイダリングライブラリ。高速で使いやすいように設計されています。

    836+0直近 7 日のスター増減
  • jvppeteer@fanyong920

    ChromeおよびFirefox向けのJava API

    805-1直近 7 日のスター増減
  • opensanctions@opensanctions

    国際制裁データ、重要人物、および政治的に重要な人物に関するオープンデータベース

    797+7直近 7 日のスター増減
  • trawl@germondai

    セルフホスト型のスクレイピングエンジン。Cloudflare、Turnstile、reCAPTCHA、hCaptcha、GeeTestなどのJSチャレンジやCAPTCHAを回避します。FlareSolverrやByparrの代替となり、*arrスタックにそのまま組み込んで置き換えることが可能です。

    782+45直近 7 日のスター増減
  • linkedin-profile-scraper-api@josephlimtech

    LinkedInのプロフィール情報をスクレイピングし、構造化されたJSONデータとして返すツール

    776+0直近 7 日のスター増減
  • operative frameworkはRust製のOSINT調査フレームワークです。複数ターゲットへのインタラクション、複数モジュールの実行、ターゲットとのリンク作成、レポートのPDFエクスポート、ターゲットや結果へのメモ追加、RESTFul APIとの連携、独自モジュールの作成が可能です。

    749+0直近 7 日のスター増減
  • HomeHarvest@ZacharyHampton

    不動産データをスクレイピングするためのPythonパッケージ

    739+2直近 7 日のスター増減
  • slash@theahmadov

    Slash OSINTツール

    737+1直近 7 日のスター増減
  • Discount-Bandit@Cybrarist

    Amazon、Aliexpress、eBay、その他多数のカスタムストアに対応したマルチユーザーセルフホスト型価格追跡ツール。設定した条件に価格が一致した際に通知を受信。

    737+2直近 7 日のスター増減
  • scala-scraper@ruippeixotog

    HTML ページからコンテンツをスクレイピングするための Scala ライブラリ

    732+0直近 7 日のスター増減
  • scrapers@cassidoo

    ウェブ上のスクレイパーのリスト。

    730+0直近 7 日のスター増減
  • Twitter 内部 API ドキュメント

    710+1直近 7 日のスター増減
← トピック一覧に戻る