メインコンテンツへスキップ
buildradar
Sign in
トピック · crawler

crawler

crawler がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

153 件のリポジトリ
  • Leaked-GPTs@friuns2

    リークされた GPTs のプロンプト。25 メッセージの制限を回避したり、Plus サブスクリプションなしで GPTs を試したりできます。

    2,469+1直近 7 日のスター増減
  • grab@lorien

    ウェブスクレイピングフレームワーク

    2,463+0直近 7 日のスター増減
  • Crawler-Detect@JayBizzle

    🕷 CrawlerDetect は、ユーザーエージェント経由でボット、クローラー、スパイダーを検出するための PHP クラスです。

    2,403+2直近 7 日のスター増減
  • abot@sjdirect

    速度と柔軟性を重視して構築された、クロスプラットフォーム対応のC#製Webクローラーフレームワーク。このプロジェクトにスターをお願いします!+1。

    2,310+0直近 7 日のスター増減
  • goclone@goclone-dev

    Website Cloner - 強力なGo routineを活用し、数秒でウェブサイトをコンピュータにクローンします。

    2,239+5直近 7 日のスター増減
  • SCrawler@AAndyProgram

    🏳️‍🌈 Twitter、Reddit、Instagram、BlueSky、TikTok、Threads、Facebook、OnlyFans、YouTube、Pinterest、PornHub、XHamster、XVIDEOS、ThisVid など、あらゆるサイトからメディアをダウンロードするツール

    2,161+8直近 7 日のスター増減
  • WaterCrawl@watercrawl

    ウェブコンテンツをLLM対応データに変換

    2,158+32直近 7 日のスター増減
  • skycaiji@zorlan

    オープンソースかつ無料で使えるスクレイピングシステム「蓝天采集器」。クリック操作でルールを編集してデータを収集でき、ローカル、レンタルサーバー、クラウドサーバー上で実行可能です。あらゆるタイプのウェブページに対応し、各種 CMS とシームレスに連携、ログイン不要でリアルタイムにデータを公開し、完全自動で人手による介入を必要としません。完全クロスプラットフォーム対応のクラウドスクレイピングソフトウェアです。

    2,088-1直近 7 日のスター増減
  • gain@elliotgao2

    asyncio ベースの Web クローリングフレームワーク。

    2,019+0直近 7 日のスター増減
  • lxSpider@lixi5338619

    クローラーのサンプル集。淘宝、京东、天猫、豆瓣、抖音、快手、微博、微信、阿里、頭条、PDD、優酷、愛奇藝、携程、12306、58、捜狐、各種指数、維普万方、Zlibrary、Oalib、小説、入札サイト、調達サイト、小紅書、大衆点評、Twitter、脈脈、知乎などを含むがこれらに限定されない

    1,967+1直近 7 日のスター増減
  • Playwright 向けの無料アンチ検出ブラウザーステルス:検出されないヘッドレス Firefox フィンガープリンティング。Python スクレイピング、reCAPTCHA およびボット検知のバイパス。オープンソース。

    1,962+13直近 7 日のスター増減
  • NewPipeExtractor@TeamNewPipe

    ストリーミングサイトからデータを抽出するための NewPipe のコアライブラリ

    1,960+3直近 7 日のスター増減
  • ast-hook-for-js-RE@JSREI

    ブラウザメモリのメモリリーク/ダンプ調査ソリューション(探索中...)

    1,912+0直近 7 日のスター増減
  • 磁気サイト U3C3 の紹介とドメイン名の更新

    1,891+3直近 7 日のスター増減
  • x-crawl@coder-hxl

    柔軟な Node.js 製 AI 支援型クローラーライブラリ

    1,879+2直近 7 日のスター増減
  • creatorhub@3441293738

    マルチプラットフォームのコンテンツ監視・収集・転送:TikTok、小紅書(Xiaohongshu)、快手(Kuaishou)を1つのWebパネルで管理

    1,833+65直近 7 日のスター増減
  • diskover-community@diskoverdata

    Diskover Community Edition - Elasticsearchを搭載したオープンソースのファイルインデクサー、ファイル検索エンジン、データ管理・分析ツール

    1,816-2直近 7 日のスター増減
  • AutoCrawler@YoongiKim

    Google、Naver マルチプロセス画像ウェブクローラー (Selenium)

    1,692+1直近 7 日のスター増減
  • selectolax@rushter

    Modest および Lexbor エンジンの Python バインディング。Python 向けの CSS セレクタを備えた高速な HTML5 パーサー。

    1,671+4直近 7 日のスター増減
  • spider_collection@srx-2000

    Pythonクローラー。現在の在庫:NetEase Cloud Musicの楽曲、Bilibiliの動画、知乎のQ&A、壁紙、xvideosの動画、オーディオブック、Weibo、Anjukeの情報とデータ可視化、Bilibili動画の表紙抽出ツール、IPプロキシプールのカプセル化、知乎の100万人規模のユーザーデータクローラーと分析、GitHubユーザーのクローラー。

    1,649+4直近 7 日のスター増減
  • grab-site@ArchiveTeam

    アーキビスト向けのウェブクローラー:WARC出力、全クロールのダッシュボード、動的な除外パターン

    1,609+2直近 7 日のスター増減
  • douyin@erma0

    TikTokクローラー — アカウントのホーム、いいね、お気に入り、音楽の原音、トピック、検索、コレクション、投稿、フォロー、フォロワーなどの公開データを収集します。

    1,605+1直近 7 日のスター増減
  • ScopeSentry@Autumn-27

    ScopeSentry - サイバースペースのマッピング、サブドメイン列挙、ポートスキャン、機密情報の検出、脆弱性スキャン、分散ノード

    1,601+9直近 7 日のスター増減
  • single-file-cli@gildas-lormeau

    完全なWebページの正確なコピーを単一のHTMLファイルに保存するためのCLIツール(SingleFileベース)

    1,579+9直近 7 日のスター増減
  • fredy@orangecoding

    ❤️ Fredy - [F]ind [R]eal [E]state [D]amn Eas[y] - ImmoScout24、Immowelt、eBay Kleinanzeigenなどのプラットフォームでドイツの新着アパートや一戸建てを自動検索し、Slack、Telegram、Email、Discord、ntfy経由で即座にお知らせします。人生のより大切なことに集中しましょう ;)

    1,462+11直近 7 日のスター増減
  • fscrawler@dadoonet

    Elasticsearch File System Crawler (FS Crawler)

    1,451+0直近 7 日のスター増減
  • wreq-python@0x676e67

    使いやすくプライバシーに配慮したPython用HTTPクライアント

    1,438+1直近 7 日のスター増減
  • 小紅書(RED)のデータ収集、ウェブサイトの画像、動画リソースのバッチダウンロードツール。優れたデザインのデータ収集ツール(一括ダウンロード、動画抽出、画像)。Telegram: https://t.me/+ZtLSwuIKTo44MDY1

    1,436+2直近 7 日のスター増減
  • rebrowser-patches@rebrowser

    自動化検知やリークを回避するための puppeteer および playwright 用パッチ集。Cloudflare や DataDome の CAPTCHA ページを回避しやすくします。簡単にパッチの適用・解除が可能で、必要に応じて有効化/無効化できます。

    1,422-1直近 7 日のスター増減
  • OpenWPM@openwpm

    Web プライバシー測定フレームワーク

    1,417-1直近 7 日のスター増減
← トピック一覧に戻る