multi-modality
multi-modality がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
multi-modality と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、multi-modality がタグ付けされたリポジトリ。
直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。
- #1
[NeurIPS'23 Oral] GPT-4Vレベルの能力、さらにはそれを超えることを目指したVisual Instruction Tuning (LLaVA)。
★ 25,005+9直近 7 日のスター増減 - #2
:sparkles::sparkles:マルチモーダル大規模言語モデルの最新の進歩
★ 17,994+8直近 7 日のスター増減 - #3
🏄 CLIPを用いた画像と文章のスケーラブルな埋め込み、推論、ランキング。
★ 12,835+0直近 7 日のスター増減 - #4
MOSS-TTS-Nanoは、MOSI.AIとOpenMOSSチームによるオープンソースの多言語軽量音声生成モデルです。わずか0.1Bのパラメータで、リアルタイム音声生成向けに設計されており、GPUなしでCPU単体で動作可能であり、ローカルデモ、Webサービス、軽量な製品統合に適したシンプルなデプロイメントスタックを維持しています。
★ 4,279+51直近 7 日のスター増減 - #5
🦦 Otter。OpenFlamingo(DeepMindのFlamingoのオープンソース版)をベースにしたマルチモーダルモデルで、MIMIC-ITでトレーニングされ、指示追従能力とコンテキスト内学習能力が向上しています。
★ 3,437+2直近 7 日のスター増減 - #6
InternLM-XComposer2.5-OmniLive:長期的なストリーミング映像と音声のインタラクションを実現する包括的なマルチモーダルシステム。
★ 2,925+1直近 7 日のスター増減 - #7
3D オブジェクト追跡に関するアルゴリズムと論文。
★ 1,028+2直近 7 日のスター増減 - #8★ 979+1直近 7 日のスター増減
- #9★ 729+2直近 7 日のスター増減
- #10★ 671+2直近 7 日のスター増減
- #11
Chatbot Arena がマルチモーダルと融合!Multi-Modality Arena では、画像を入力として提供しながら、視覚言語モデルを並行してベンチマークできます。MiniGPT-4、LLaMA-Adapter V2、LLaVA、BLIP-2 などをサポート!
★ 566+0直近 7 日のスター増減