clip
clip がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
clip と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、clip がタグ付けされたリポジトリ。
直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。
- #1
X-AnyLabeling: テキスト、画像、動画、マルチモーダルデータをアノテーションするための軽量で効率的かつ統一されたクロスプラットフォームデスクトップアプリケーション。多機能な内蔵ツールと最先端のAIモデルを組み合わせ、柔軟なマルチフォーマットエクスポートに対応。
★ 10,313+59直近 7 日のスター増減 - #2
中国語のCLIP版。中国語のクロスモーダル検索と表現生成を実現。
★ 6,001+1直近 7 日のスター増減 - #3
オープンソースのアプリ不要なプッシュ通知サービス。iOS14+でQRコードスキャン即利用可能。クイックアプリ/iOSおよびMacクライアント、Androidクライアント、カスタムデバイスもサポート。
★ 5,022-1直近 7 日のスター増減 - #4
大規模マルチモーダルモデル (LMMs) のオープンソース評価ツールキット。220以上のLMM、80以上のベンチマークをサポート。
★ 4,375+13直近 7 日のスター増減 - #5
OpenMMLabの事前学習用ツールボックスおよびベンチマーク
★ 3,850-1直近 7 日のスター増減 - #6★ 3,836+2直近 7 日のスター増減
- #7
視覚タスク向けの優れた Vision-Language モデルのコレクション
★ 3,126+0直近 7 日のスター増減 - #8
BLIP と CLIP を使用した Image to prompt
★ 2,984+1直近 7 日のスター増減 - #9
クリップ埋め込みの容易な計算と、それを用いたクリップ検索システムの構築
★ 2,796+1直近 7 日のスター増減 - #10
🥂 マルチモーダル大規模言語モデルを使用してhCaptchaの挑戦を優雅にクリアする。
★ 2,483-1直近 7 日のスター増減 - #11★ 2,014+1直近 7 日のスター増減
- #12
Android UIの迅速な開発、ネイティブコントロールの様々な課題を解決
★ 1,958+0直近 7 日のスター増減 - #13
OpenAI vision API の実験や開発を行いたい方に必須のリソース 🔥
★ 1,690+0直近 7 日のスター増減 - #14★ 1,557+255直近 7 日のスター増減
- #15
[ACL 2024 🔥] Video-ChatGPT は、動画について意味のある対話を生成できる動画対話モデルです。LLM の機能と、時空間動画表現に適応させた事前学習済みビジュアルエンコーダーを組み合わせています。また、動画ベースの対話モデル向けの厳格な「定量評価ベンチマーク」も導入しています。
★ 1,507+1直近 7 日のスター増減 - #16★ 1,247+1直近 7 日のスター増減
- #17
CLIP (Contrastive Language-Image Pre-Training) の研究に関する素晴らしいリスト
★ 1,227+0直近 7 日のスター増減 - #18
このシリーズでは、NLPとComputer Visionの基礎から最先端のVision-Language Modelsまでを詳しく解説します。
★ 1,179+0直近 7 日のスター増減 - #19★ 1,031+0直近 7 日のスター増減
- #20
🔥🔥🔥 Java の無料オフライン AI アルゴリズムツールボックス。顔認識、生体検知、表情認識、物体検出、インスタンスセグメンテーション、歩行者検出、OCR 文字認識、ナンバープレート認識、表認識、ASR+TTS、機械翻訳などの機能をサポートし、Maven 依存関係に追加するだけで使用できます。PyTorch、Tensorflow をサポートし、Mtcnn、InsightFace、SeetaFace6、YOLOv8~v12、PaddleOCR(PPOCRv5)、Whisper などの主流モデルを統合済みです。
★ 908+3直近 7 日のスター増減 - #21
CLIP + FFT/DWT/RGBによるテキストから画像/動画への変換
★ 789+0直近 7 日のスター増減 - #22★ 733+2直近 7 日のスター増減
- #23
Paddle のマルチモーダル統合および探索ツールボックス。エンドツーエンドの大規模マルチモーダル事前学習モデルや拡散モデルを含む主流のマルチモーダルタスクをサポート。高性能と柔軟性を備えています。
★ 723-1直近 7 日のスター増減 - #24★ 709+13直近 7 日のスター増減
- #25
ビジョン・言語モデル(VLM)の論文とモデルに関する包括的なコレクションおよび調査のGitHubリポジトリ。随時更新。
★ 706+3直近 7 日のスター増減 - #26★ 688+1直近 7 日のスター増減
- #27
Twitchの配信、動画、クリップのダウンローダーおよびレコーダー。配信やVODのダウンロードと録画をサポートするGUIダウンローダーです。
★ 681+4直近 7 日のスター増減 - #28
複数の GPU を使用して生動画から動画の特徴量を抽出します。RAFT フローフレーム、S3D、I3D、R(2+1)D、VGGish、CLIP、TIMM モデルをサポートしています。
★ 655+0直近 7 日のスター増減 - #29
👁️ + 💬 + 🎧 = 🤖 厳選された主要な基盤モデルおよびマルチモーダルモデルのリスト![論文 + コード + サンプル + チュートリアル]
★ 637+0直近 7 日のスター増減 - #30
Keras beit,caformer,CMT,CoAtNet,convnext,davit,dino,efficientdet,edgenext,efficientformer,efficientnet,eva,fasternet,fastervit,fastvit,flexivit,gcvit,ghostnet,gpvit,hornet,hiera,iformer,inceptionnext,lcnet,levit,maxvit,mobilevit,moganet,nat,nfnets,pvt,swin,tinynet,tinyvit,uniformer,volo,vanillanet,yolor,yolov7,yolov8,yolox,gpt2,llama2 (エイリアス kecam)
★ 626+0直近 7 日のスター増減