メインコンテンツへスキップ
buildradar
Sign in
トピック · llava

llava

llava がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
21
総スター数
66,002
平均スター数
3,143
シェア
0.00%

llava と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、llava がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • LLaVA@haotian-liu

    [NeurIPS'23 Oral] GPT-4Vレベルの能力、さらにはそれを超えることを目指したVisual Instruction Tuning (LLaVA)。

    25,014+12直近 7 日のスター増減
  • SUPIR@Fanghua-Yu

    SUPIRは、実環境におけるフォトリアリスティックな画像復元のための実用的なアルゴリズムの開発を目指しています。新しいオンラインデモはsuppixel.aiでも公開されています。

    5,649+0直近 7 日のスター増減
  • mlx-vlm@Blaizzy

    MLX-VLMは、MLXを使用してMac上でVision Language Models (VLMs) の推論とファインチューニングを行うためのパッケージです。

    5,462+41直近 7 日のスター増減
  • VLMEvalKit@open-compass

    大規模マルチモーダルモデル (LMMs) のオープンソース評価ツールキット。220以上のLMM、80以上のベンチマークをサポート。

    4,375+15直近 7 日のスター増減
  • zero_nlp@yuanzhoulvpi2017

    中国語NLPソリューション(大規模モデル、データ、モデル、トレーニング、推論)

    3,836+2直近 7 日のスター増減
  • LLamaSharp@SciSharp

    LLM (🦙LLaMA/LLaVA) をローカルデバイスで効率的に実行するためのC#/.NETライブラリ。

    3,790+3直近 7 日のスター増減
  • Eagle@NVlabs

    Eagle: データ中心戦略を採用した最先端のVision-Language Models

    3,511+46直近 7 日のスター増減
  • OmAgent@om-ai-lab

    [EMNLP-2024] 高速なプロトタイプ作成と本番環境向けマルチモーダル言語エージェントの構築。

    2,666+1直近 7 日のスター増減
  • Video-ChatGPT@mbzuai-oryx

    [ACL 2024 🔥] Video-ChatGPT は、動画について意味のある対話を生成できる動画対話モデルです。LLM の機能と、時空間動画表現に適応させた事前学習済みビジュアルエンコーダーを組み合わせています。また、動画ベースの対話モデル向けの厳格な「定量評価ベンチマーク」も導入しています。

    1,507+1直近 7 日のスター増減
  • taggui@jhc13

    画像データセット向けのタグマネージャーおよびキャプションツール

    1,348+2直近 7 日のスター増減
  • UForm@unum-cloud

    多言語のテキスト、画像、動画を対象としたコンテンツ理解と生成のためのポケットサイズマルチモーダルAI。OpenAI CLIPやLLaVAと比較して最大5倍高速

    1,247+2直近 7 日のスター増減
  • LLaVA-OneVision-2@EvolvingLMMs-Lab

    民主化されたマルチモーダル学習のための完全オープンなフレームワーク。

    1,195+3直近 7 日のスター増減
  • TinyLLaVA_Factory@TinyLLaVA

    小規模の大規模マルチモーダルモデルのためのフレームワーク

    1,004+1直近 7 日のスター増減
  • LLaVA-pp@mbzuai-oryx

    🔥🔥 LLaVA++: LLaVA を Phi-3 および LLaMA-3 で拡張 (LLaVA LLaMA-3, LLaVA Phi-3)

    842+0直近 7 日のスター増減
  • machina@PsyChip

    OpenCV、YOLO、LLAVAを活用したビデオ監視システム

    794+1直近 7 日のスター増減
  • PaddleMIX@PaddlePaddle

    Paddle のマルチモーダル統合および探索ツールボックス。エンドツーエンドの大規模マルチモーダル事前学習モデルや拡散モデルを含む主流のマルチモーダルタスクをサポート。高性能と柔軟性を備えています。

    724+1直近 7 日のスター増減
  • ビジョン・言語モデル(VLM)の論文とモデルに関する包括的なコレクションおよび調査のGitHubリポジトリ。随時更新。

    705+5直近 7 日のスター増減
  • 👁️ + 💬 + 🎧 = 🤖 厳選された主要な基盤モデルおよびマルチモーダルモデルのリスト![論文 + コード + サンプル + チュートリアル]

    637+0直近 7 日のスター増減
  • ComfyUI_VLM_nodes@gokayfem

    視覚言語モデル(Qwen3-VL、Moondream 3、Florence-2、SmolVLM2、InternVL、Gemma 3、MiniCPM-V)用のComfyUIノード。さらに、オープン語彙検出、SAM2/SAM3セグメンテーション、動画の時間的推論、llama.cppによるGGUF、ホスト型LLM/VLM APIに対応。

    589+1直近 7 日のスター増減
  • LLaVA-Mini@ictnlp

    LLaVA-Miniは、画像、高解像度画像、動画の理解を効率的にサポートする統合型の大規模マルチモーダルモデル(LMM)です。

    577+0直近 7 日のスター増減
  • llama-assistant@nrl-ai

    日常のタスクを支援するAI搭載アシスタント。Llama 3、DeepSeek R1、およびHuggingFace上のその他の多くのモデルを活用

    530+0直近 7 日のスター増減
← トピック一覧に戻る