跳到主要內容
buildradar
Sign in
主題 · multimodality

multimodality

標記 multimodality 主題、收錄中的開源專案,依星數排序。

專案數
11
總星數
11,712
平均星數
1,065
佔比
0.00%

常跟 multimodality 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 multimodality 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • Cradle@BAAI-Agents

    Cradle 框架是通用電腦控制(GCC)的首次嘗試。Cradle 透過在具備最低要求的標準化通用環境中提供強大的推理能力、自我改善與技能策劃,支援智慧體精通任何電腦任務。

    2,578+2近 7 天星數變化
  • RAG-Survey@hymie122

    收集 AIGC 領域 RAG 的精選論文。我們在論文「Retrieval-Augmented Generation for AI-Generated Content: A Survey」中提出了 RAG 基礎、增強與應用的分類法。

    1,789-1近 7 天星數變化
  • Ovis@ATH-MaaS

    一種新穎的多模態大型語言模型(MLLM)架構,旨在結構化對齊視覺與文字嵌入。

    1,514+2近 7 天星數變化
  • cornac@PreferredAI

    多模態推薦系統的比較框架

    1,053+0近 7 天星數變化
  • CLIP4Clip@ArrowLuo

    「CLIP4Clip: An Empirical Study of CLIP for End to End Video Clip Retrieval」的官方實作

    1,032+0近 7 天星數變化
  • FEDOT@aimclub

    自動化建模與機器學習框架 FEDOT

    711+1近 7 天星數變化
  • LLM2CLIP@microsoft

    LLM2CLIP 顯著提升了原本已屬頂尖的 CLIP 模型。

    688+1近 7 天星數變化
  • Woodpecker@VITA-MLLM

    ✨✨Woodpecker: 多模態大型語言模型的幻覺修正

    650+1近 7 天星數變化
  • MMMU@MMMU-Benchmark

    此儲存庫包含論文「MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI」的評估程式碼

    593+1近 7 天星數變化
  • GPT4RoI@jshilong

    (ECCVW 2025) GPT4RoI:基於感興趣區域 (Region-of-Interest) 的大型語言模型指令微調。

    556+1近 7 天星數變化
  • 精選基於 LLM 的多模態生成(影像、影片、3D 與音訊)論文列表。

    552+0近 7 天星數變化
← 返回主題列表