主题 · multi-modality
multi-modality
标记 multi-modality 主题、收录中的开源项目,按星标数排序。
项目数
11
总星标数
70,463
平均星标数
6,406
占比
0.00%
相关主题
常跟 multi-modality 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 multi-modality 主题的项目。
近 90 天内还没有新项目标记这个主题。
- #1★ 25,014+9近 7 天星标变化
- #2
✨✨最新的多模态大型语言模型进展
★ 17,996+2近 7 天星标变化 - #3
🏄 可扩展的图像与句子嵌入、推理与排序,使用 CLIP 技术
★ 12,835+0近 7 天星标变化 - #4
MOSS-TTS-Nano 是 MOSI.AI 和 OpenMOSS 团队的开源多语言小型语音生成模型。仅 0.1B 参数,旨在实现实时语音生成,可直接在 CPU 上运行,无需 GPU,部署堆栈保持简单,适合本地演示、Web 服务和轻量级产品集成。
★ 4,282+11近 7 天星标变化 - #5
🦦 Otter,基于 OpenFlamingo(DeepMind 的 Flamingo 开源版本)的多模态模型,训练于 MIMIC-IT,展示了改进的指令跟随和上下文学习能力。
★ 3,438+2近 7 天星标变化 - #6
InternLM-XComposer2.5-OmniLive:一个全面的多模态系统,用于长期串流视频与音频互动
★ 2,925-1近 7 天星标变化 - #7
3D 物体追踪的算法与论文
★ 1,028+1近 7 天星标变化 - #8★ 979-1近 7 天星标变化
- #9★ 730+1近 7 天星标变化
- #10★ 672+3近 7 天星标变化
- #11
Chatbot Arena 遇上多模态!Multi-Modality Arena 允许您在输入图像的同时,并排评测视觉语言模型。支持 MiniGPT-4、LLaMA-Adapter V2、LLaVA、BLIP-2 等多种模型!
★ 566+0近 7 天星标变化