メインコンテンツへスキップ
buildradar
Sign in
トピック · large-multimodal-models

large-multimodal-models

large-multimodal-models がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
9
総スター数
10,371
平均スター数
1,152
シェア
0.00%

large-multimodal-models と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、large-multimodal-models がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • VITA@VITA-MLLM

    ✨✨[NeurIPS 2025] VITA-1.5:GPT-4oレベルのリアルタイム視覚・音声インタラクションに向けて

    2,532-1直近 7 日のスター増減
  • [ICCV 2025] Describe Anything の実装: 詳細な局所化画像および動画キャプション生成

    1,517+3直近 7 日のスター増減
  • 155種類以上のビジョン・言語モデル(VLM/MLLM)アーキテクチャのキュレーションされたビジュアルカタログ:論文、図解、学習レシピ、データセット、マルチモーダルAIエージェントのリリース年表。

    1,310+2直近 7 日のスター増減
  • ShareGPT4Video@ShareGPT4Omni

    [NeurIPS 2024] 「ShareGPT4Video: Improving Video Understanding and Generation with Better Captions」の公式実装

    1,094+1直近 7 日のスター増減
  • TinyLLaVA_Factory@TinyLLaVA

    小規模の大規模マルチモーダルモデルのためのフレームワーク

    1,003+1直近 7 日のスター増減
  • 医用画像におけるマルチモーダル学習の応用に関するリソース集。

    975+1直近 7 日のスター増減
  • LLaVA-Plus-Codebase@LLaVA-VL

    LLaVA-Plus: スキルの利用方法をプラグインして学習する大規模言語およびビジョンアシスタント

    770+0直近 7 日のスター増減
  • MMMU@MMMU-Benchmark

    論文「MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI」の評価コードを含むリポジトリ

    593+1直近 7 日のスター増減
  • LLaVA-Mini@ictnlp

    LLaVA-Miniは、画像、高解像度画像、動画の理解を効率的にサポートする統合型の大規模マルチモーダルモデル(LMM)です。

    577+0直近 7 日のスター増減
← トピック一覧に戻る