llava
llava がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
llava と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、llava がタグ付けされたリポジトリ。
直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。
- #1
[NeurIPS'23 Oral] GPT-4Vレベルの能力、さらにはそれを超えることを目指したVisual Instruction Tuning (LLaVA)。
★ 25,014+12直近 7 日のスター増減 - #2
SUPIRは、実環境におけるフォトリアリスティックな画像復元のための実用的なアルゴリズムの開発を目指しています。新しいオンラインデモはsuppixel.aiでも公開されています。
★ 5,649+0直近 7 日のスター増減 - #3★ 5,462+41直近 7 日のスター増減
- #4
大規模マルチモーダルモデル (LMMs) のオープンソース評価ツールキット。220以上のLMM、80以上のベンチマークをサポート。
★ 4,375+15直近 7 日のスター増減 - #5★ 3,836+2直近 7 日のスター増減
- #6
LLM (🦙LLaMA/LLaVA) をローカルデバイスで効率的に実行するためのC#/.NETライブラリ。
★ 3,790+3直近 7 日のスター増減 - #7★ 3,511+46直近 7 日のスター増減
- #8★ 2,666+1直近 7 日のスター増減
- #9
[ACL 2024 🔥] Video-ChatGPT は、動画について意味のある対話を生成できる動画対話モデルです。LLM の機能と、時空間動画表現に適応させた事前学習済みビジュアルエンコーダーを組み合わせています。また、動画ベースの対話モデル向けの厳格な「定量評価ベンチマーク」も導入しています。
★ 1,507+1直近 7 日のスター増減 - #10★ 1,348+2直近 7 日のスター増減
- #11★ 1,247+2直近 7 日のスター増減
- #12
民主化されたマルチモーダル学習のための完全オープンなフレームワーク。
★ 1,195+3直近 7 日のスター増減 - #13
小規模の大規模マルチモーダルモデルのためのフレームワーク
★ 1,004+1直近 7 日のスター増減 - #14★ 842+0直近 7 日のスター増減
- #15★ 794+1直近 7 日のスター増減
- #16
Paddle のマルチモーダル統合および探索ツールボックス。エンドツーエンドの大規模マルチモーダル事前学習モデルや拡散モデルを含む主流のマルチモーダルタスクをサポート。高性能と柔軟性を備えています。
★ 724+1直近 7 日のスター増減 - #17
ビジョン・言語モデル(VLM)の論文とモデルに関する包括的なコレクションおよび調査のGitHubリポジトリ。随時更新。
★ 705+5直近 7 日のスター増減 - #18
👁️ + 💬 + 🎧 = 🤖 厳選された主要な基盤モデルおよびマルチモーダルモデルのリスト![論文 + コード + サンプル + チュートリアル]
★ 637+0直近 7 日のスター増減 - #19
視覚言語モデル(Qwen3-VL、Moondream 3、Florence-2、SmolVLM2、InternVL、Gemma 3、MiniCPM-V)用のComfyUIノード。さらに、オープン語彙検出、SAM2/SAM3セグメンテーション、動画の時間的推論、llama.cppによるGGUF、ホスト型LLM/VLM APIに対応。
★ 589+1直近 7 日のスター増減 - #20
LLaVA-Miniは、画像、高解像度画像、動画の理解を効率的にサポートする統合型の大規模マルチモーダルモデル(LMM)です。
★ 577+0直近 7 日のスター増減 - #21
日常のタスクを支援するAI搭載アシスタント。Llama 3、DeepSeek R1、およびHuggingFace上のその他の多くのモデルを活用
★ 530+0直近 7 日のスター増減