メインコンテンツへスキップ
buildradar
Sign in
トピック · vision-language-pretraining

vision-language-pretraining

vision-language-pretraining がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
5
総スター数
37,849
平均スター数
7,570
シェア
0.00%

vision-language-pretraining と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、vision-language-pretraining がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • Janus@deepseek-ai

    Janus-Series: 統合型マルチモーダル理解および生成モデル

    17,763+6直近 7 日のスター増減
  • LAVIS@salesforce

    LAVIS - 言語・視覚知能のためのオールインワンライブラリ

    11,261-1直近 7 日のスター増減
  • DeepSeek-VL@deepseek-ai

    DeepSeek-VL: 実世界におけるビジョン・言語理解へ

    4,177+2直近 7 日のスター増減
  • Video-LLaMA@DAMO-NLP-SG

    [EMNLP 2023 Demo] Video-LLaMA: 動画理解のための指示チューニング済み音声・視覚言語モデル

    3,141+2直近 7 日のスター増減
  • Video-ChatGPT@mbzuai-oryx

    [ACL 2024 🔥] Video-ChatGPT は、動画について意味のある対話を生成できる動画対話モデルです。LLM の機能と、時空間動画表現に適応させた事前学習済みビジュアルエンコーダーを組み合わせています。また、動画ベースの対話モデル向けの厳格な「定量評価ベンチマーク」も導入しています。

    1,507+1直近 7 日のスター増減
← トピック一覧に戻る