跳到主要內容
buildradar
Sign in
擁有者 · OpenGVLab

OpenGVLab

OpenGVLab 收錄中的開源專案,依星數排序。

共 17 個專案
  • InternVL@OpenGVLab

    [CVPR 2024 Oral] InternVL Family:一個先驅性的開源替代 GPT-4o 的多模態對話模型,接近 GPT-4o 的表現

    10,150+3近 7 天星數變化
  • LLaMA-Adapter@OpenGVLab

    [ICLR 2024] 在 1 小時內微調 LLaMA 以遵循指令,僅需 1.2M 參數

    5,915+1近 7 天星數變化
  • Ask-Anything@OpenGVLab

    [CVPR2024 Highlight][VideoChatGPT] ChatGPT 具備視訊理解功能!並支援 miniGPT4、StableLM、MOSS 等多種語言模型

    3,347+0近 7 天星數變化
  • InternGPT@OpenGVLab

    InternGPT (iGPT) 是一個開源演示平台,您可以輕鬆展示 AI 模型。現在支持 DragGAN、ChatGPT、ImageBind、多模態聊天如 GPT-4、SAM、互動圖像編輯等。試試 igpt.opengvlab.com(支持 DragGAN、ChatGPT、ImageBind、SAM 的線上 Demo 系統)

    3,205+0近 7 天星數變化
  • InternImage@OpenGVLab

    [CVPR 2023 Highlight] InternImage:利用可變形卷積探索大規模視覺基礎模型

    2,845+4近 7 天星數變化
  • InternVideo@OpenGVLab

    [ECCV2024] 用於多模態理解的影片基礎模型與資料

    2,374+5近 7 天星數變化
  • VisionLLM@OpenGVLab

    VisionLLM 系列

    1,154+0近 7 天星數變化
  • SAM-Med2D@OpenGVLab

    SAM-Med2D 的官方實作

    1,134+0近 7 天星數變化
  • ScaleCUA@OpenGVLab

    [ICLR 2026 Oral] ScaleCUA 是開源的電腦使用代理,能夠在跨平台環境(Windows、macOS、Ubuntu、Android)中運作。

    1,133+0近 7 天星數變化
  • VideoMamba@OpenGVLab

    [ECCV2024] VideoMamba: 用於高效影片理解的狀態空間模型

    1,125+0近 7 天星數變化
  • OmniQuant@OpenGVLab

    [ICLR2024 spotlight] OmniQuant 是一個簡單且強大的 LLM 量化技術。

    920+10近 7 天星數變化
  • VideoMAEv2@OpenGVLab

    [CVPR 2023] VideoMAE V2: 透過雙重遮罩擴展 Video Masked Autoencoders

    818+2近 7 天星數變化
  • DCNv4@OpenGVLab

    [CVPR 2024] Deformable Convolution v4

    746+0近 7 天星數變化
  • Multi-Modality-Arena@OpenGVLab

    Chatbot Arena 遇上多模態!Multi-Modality Arena 允許您在輸入影像的同時,並排評測視覺語言模型。支援 MiniGPT-4、LLaMA-Adapter V2、LLaVA、BLIP-2 等多種模型!

    566+0近 7 天星數變化
  • Vision-RWKV@OpenGVLab

    [ICLR 2025 Spotlight] Vision-RWKV:基於 RWKV 架構的高效且可擴展視覺感知模型

    556+0近 7 天星數變化
  • VideoChat-Flash@OpenGVLab

    [ICLR2026] VideoChat-Flash:用於長文本影片建模的階層式壓縮技術

    529+1近 7 天星數變化
  • all-seeing@OpenGVLab

    [ICLR 2024 & ECCV 2024] The All-Seeing 專案:邁向開放世界的全景視覺識別與理解及通用關係理解。

    506+0近 7 天星數變化
← 返回擁有者排行