跳到主要內容
buildradar
Sign in
主題 · multi-modality

multi-modality

標記 multi-modality 主題、收錄中的開源專案,依星數排序。

專案數
11
總星數
70,463
平均星數
6,406
佔比
0.00%

常跟 multi-modality 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 multi-modality 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • LLaVA@haotian-liu

    [NeurIPS'23 Oral] Visual Instruction Tuning (LLaVA) 建構至 GPT-4V 級別能力及更高水平。

    25,014+9近 7 天星數變化
  • ✨✨最新的多模態大型語言模型進展

    17,996+2近 7 天星數變化
  • clip-as-service@jina-ai

    🏄 可擴展的影像與句子嵌入、推理與排序,使用 CLIP 技術

    12,835+0近 7 天星數變化
  • MOSS-TTS-Nano@OpenMOSS

    MOSS-TTS-Nano 是 MOSI.AI 和 OpenMOSS 团队的开源多语言小型语音生成模型。仅 0.1B 参数,旨在实现实时语音生成,可直接在 CPU 上运行,无需 GPU,部署堆栈保持简单,适合本地演示、Web 服务和轻量级产品集成。

    4,282+11近 7 天星數變化
  • Otter@EvolvingLMMs-Lab

    🦦 Otter,基於 OpenFlamingo(DeepMind 的 Flamingo 開源版本)的多模態模型,訓練於 MIMIC-IT,展示了改進的指令跟隨和上下文學習能力。

    3,438+2近 7 天星數變化
  • InternLM-XComposer@InternLM

    InternLM-XComposer2.5-OmniLive:一個全面的多模態系統,用於長期串流視頻與音頻互動

    2,925-1近 7 天星數變化
  • 3D 物件追蹤的演算法與論文

    1,028+1近 7 天星數變化
  • VisRAG@OpenBMB

    由 VLM 支援的無解析 RAG

    979-1近 7 天星數變化
  • Long-RL@NVlabs

    Long-RL:將 RL 擴展至長序列(NeurIPS 2025)

    730+1近 7 天星數變化
  • MINIMA@LSXI7

    [CVPR 2025] MINIMA:模態不變影像匹配

    672+3近 7 天星數變化
  • Multi-Modality-Arena@OpenGVLab

    Chatbot Arena 遇上多模態!Multi-Modality Arena 允許您在輸入影像的同時,並排評測視覺語言模型。支援 MiniGPT-4、LLaMA-Adapter V2、LLaVA、BLIP-2 等多種模型!

    566+0近 7 天星數變化
← 返回主題列表