跳到主要内容
buildradar
Sign in
主题 · multi-modality

multi-modality

标记 multi-modality 主题、收录中的开源项目,按星标数排序。

项目数
11
总星标数
70,463
平均星标数
6,406
占比
0.00%

常跟 multi-modality 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 multi-modality 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • LLaVA@haotian-liu

    [NeurIPS'23 Oral] Visual Instruction Tuning (LLaVA) 构建至 GPT-4V 级别能力及更高水平。

    25,014+9近 7 天星标变化
  • ✨✨最新的多模态大型语言模型进展

    17,996+2近 7 天星标变化
  • clip-as-service@jina-ai

    🏄 可扩展的图像与句子嵌入、推理与排序,使用 CLIP 技术

    12,835+0近 7 天星标变化
  • MOSS-TTS-Nano@OpenMOSS

    MOSS-TTS-Nano 是 MOSI.AI 和 OpenMOSS 团队的开源多语言小型语音生成模型。仅 0.1B 参数,旨在实现实时语音生成,可直接在 CPU 上运行,无需 GPU,部署堆栈保持简单,适合本地演示、Web 服务和轻量级产品集成。

    4,282+11近 7 天星标变化
  • Otter@EvolvingLMMs-Lab

    🦦 Otter,基于 OpenFlamingo(DeepMind 的 Flamingo 开源版本)的多模态模型,训练于 MIMIC-IT,展示了改进的指令跟随和上下文学习能力。

    3,438+2近 7 天星标变化
  • InternLM-XComposer@InternLM

    InternLM-XComposer2.5-OmniLive:一个全面的多模态系统,用于长期串流视频与音频互动

    2,925-1近 7 天星标变化
  • 3D 物体追踪的算法与论文

    1,028+1近 7 天星标变化
  • VisRAG@OpenBMB

    由 VLM 支持的无解析 RAG

    979-1近 7 天星标变化
  • Long-RL@NVlabs

    Long-RL:将 RL 扩展至长序列(NeurIPS 2025)

    730+1近 7 天星标变化
  • MINIMA@LSXI7

    [CVPR 2025] MINIMA:模态不变图像匹配

    672+3近 7 天星标变化
  • Multi-Modality-Arena@OpenGVLab

    Chatbot Arena 遇上多模态!Multi-Modality Arena 允许您在输入图像的同时,并排评测视觉语言模型。支持 MiniGPT-4、LLaMA-Adapter V2、LLaVA、BLIP-2 等多种模型!

    566+0近 7 天星标变化
← 返回主题列表