メインコンテンツへスキップ
buildradar
Sign in
トピック · multi-modality

multi-modality

multi-modality がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
11
総スター数
70,438
平均スター数
6,403
シェア
0.00%

multi-modality と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、multi-modality がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • LLaVA@haotian-liu

    [NeurIPS'23 Oral] GPT-4Vレベルの能力、さらにはそれを超えることを目指したVisual Instruction Tuning (LLaVA)。

    25,005+9直近 7 日のスター増減
  • :sparkles::sparkles:マルチモーダル大規模言語モデルの最新の進歩

    17,994+8直近 7 日のスター増減
  • clip-as-service@jina-ai

    🏄 CLIPを用いた画像と文章のスケーラブルな埋め込み、推論、ランキング。

    12,835+0直近 7 日のスター増減
  • MOSS-TTS-Nano@OpenMOSS

    MOSS-TTS-Nanoは、MOSI.AIとOpenMOSSチームによるオープンソースの多言語軽量音声生成モデルです。わずか0.1Bのパラメータで、リアルタイム音声生成向けに設計されており、GPUなしでCPU単体で動作可能であり、ローカルデモ、Webサービス、軽量な製品統合に適したシンプルなデプロイメントスタックを維持しています。

    4,279+51直近 7 日のスター増減
  • Otter@EvolvingLMMs-Lab

    🦦 Otter。OpenFlamingo(DeepMindのFlamingoのオープンソース版)をベースにしたマルチモーダルモデルで、MIMIC-ITでトレーニングされ、指示追従能力とコンテキスト内学習能力が向上しています。

    3,437+2直近 7 日のスター増減
  • InternLM-XComposer@InternLM

    InternLM-XComposer2.5-OmniLive:長期的なストリーミング映像と音声のインタラクションを実現する包括的なマルチモーダルシステム。

    2,925+1直近 7 日のスター増減
  • 3D オブジェクト追跡に関するアルゴリズムと論文。

    1,028+2直近 7 日のスター増減
  • VisRAG@OpenBMB

    VLMによってサポートされる、パース処理不要のRAG

    979+1直近 7 日のスター増減
  • Long-RL@NVlabs

    Long-RL:強化学習の長シーケンスへのスケーリング(NeurIPS 2025)

    729+2直近 7 日のスター増減
  • MINIMA@LSXI7

    [CVPR 2025] MINIMA: モダリティ不変画像マッチング

    671+2直近 7 日のスター増減
  • Multi-Modality-Arena@OpenGVLab

    Chatbot Arena がマルチモーダルと融合!Multi-Modality Arena では、画像を入力として提供しながら、視覚言語モデルを並行してベンチマークできます。MiniGPT-4、LLaMA-Adapter V2、LLaVA、BLIP-2 などをサポート!

    566+0直近 7 日のスター増減
← トピック一覧に戻る