OpenGVLab
OpenGVLab 收錄中的開源專案,依星數排序。
- #1★ 10,150+3近 7 天星數變化
- #2
[ICLR 2024] 在 1 小時內微調 LLaMA 以遵循指令,僅需 1.2M 參數
★ 5,915+1近 7 天星數變化 - #3
[CVPR2024 Highlight][VideoChatGPT] ChatGPT 具備視訊理解功能!並支援 miniGPT4、StableLM、MOSS 等多種語言模型
★ 3,347+0近 7 天星數變化 - #4
InternGPT (iGPT) 是一個開源演示平台,您可以輕鬆展示 AI 模型。現在支持 DragGAN、ChatGPT、ImageBind、多模態聊天如 GPT-4、SAM、互動圖像編輯等。試試 igpt.opengvlab.com(支持 DragGAN、ChatGPT、ImageBind、SAM 的線上 Demo 系統)
★ 3,205+0近 7 天星數變化 - #5
[CVPR 2023 Highlight] InternImage:利用可變形卷積探索大規模視覺基礎模型
★ 2,845+4近 7 天星數變化 - #6
[ECCV2024] 用於多模態理解的影片基礎模型與資料
★ 2,374+5近 7 天星數變化 - #7★ 1,154+0近 7 天星數變化
- #8★ 1,134+0近 7 天星數變化
- #9★ 1,133+0近 7 天星數變化
- #10
[ECCV2024] VideoMamba: 用於高效影片理解的狀態空間模型
★ 1,125+0近 7 天星數變化 - #11★ 920+10近 7 天星數變化
- #12
[CVPR 2023] VideoMAE V2: 透過雙重遮罩擴展 Video Masked Autoencoders
★ 818+2近 7 天星數變化 - #13★ 746+0近 7 天星數變化
- #14
Chatbot Arena 遇上多模態!Multi-Modality Arena 允許您在輸入影像的同時,並排評測視覺語言模型。支援 MiniGPT-4、LLaMA-Adapter V2、LLaVA、BLIP-2 等多種模型!
★ 566+0近 7 天星數變化 - #15
[ICLR 2025 Spotlight] Vision-RWKV:基於 RWKV 架構的高效且可擴展視覺感知模型
★ 556+0近 7 天星數變化 - #16
[ICLR2026] VideoChat-Flash:用於長文本影片建模的階層式壓縮技術
★ 529+1近 7 天星數變化 - #17
[ICLR 2024 & ECCV 2024] The All-Seeing 專案:邁向開放世界的全景視覺識別與理解及通用關係理解。
★ 506+0近 7 天星數變化