OpenGVLab
OpenGVLab의 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #1
[CVPR 2024 Oral] InternVL 패밀리: GPT-4o를 대체하는 선구적인 오픈소스 대안. GPT-4o에 준하는 성능을 가진 오픈소스 멀티모달 대화형 모델
★ 10,147+6최근 7일 스타 변화 - #2
[ICLR 2024] 1시간 및 120만 개의 파라미터 내에서 지시사항을 따르도록 LLaMA 파인튜닝
★ 5,914+0최근 7일 스타 변화 - #3
[CVPR2024 Highlight][VideoChatGPT] 비디오 이해 기능이 포함된 ChatGPT! miniGPT4, StableLM, MOSS 등 다양한 지원 언어 모델(LM) 포함.
★ 3,347+0최근 7일 스타 변화 - #4
InternGPT (iGPT)는 AI 모델을 쉽게 시각화할 수 있는 오픈소스 데모 플랫폼입니다. 이제 DragGAN, ChatGPT, ImageBind, GPT-4와 같은 멀티모달 채팅, SAM, 대화형 이미지 편집 등을 지원합니다. igpt.opengvlab.com에서 체험해 보세요.
★ 3,205+1최근 7일 스타 변화 - #5
[CVPR 2023 Highlight] InternImage: Deformable Convolution을 활용한 대규모 비전 파운데이션 모델 탐구
★ 2,841+2최근 7일 스타 변화 - #6
[ECCV2024] 멀티모달 이해를 위한 비디오 파운데이션 모델 및 데이터
★ 2,370+4최근 7일 스타 변화 - #7★ 1,154+1최근 7일 스타 변화
- #8★ 1,134+1최근 7일 스타 변화
- #9
[ICLR 2026 Oral] ScaleCUA는 크로스 플랫폼 환경(Windows, macOS, Ubuntu, Android)에서 동작할 수 있는 오픈소스 컴퓨터 사용 에이전트입니다.
★ 1,133+3최근 7일 스타 변화 - #10
[ECCV2024] VideoMamba: 효율적인 비디오 이해를 위한 상태 공간 모델
★ 1,125+1최근 7일 스타 변화 - #11★ 911+3최근 7일 스타 변화
- #12
[CVPR 2023] VideoMAE V2: 듀얼 마스킹을 통한 비디오 마스크드 오토인코더 확장
★ 816+2최근 7일 스타 변화 - #13★ 746+0최근 7일 스타 변화
- #14
챗봇 아레나가 멀티모달을 만나다! Multi-Modality Arena는 이미지를 입력으로 사용하여 비전-언어 모델을 나란히 비교하고 벤치마킹할 수 있게 해줍니다. MiniGPT-4, LLaMA-Adapter V2, LLaVA, BLIP-2 등 다양한 모델을 지원합니다!
★ 566+0최근 7일 스타 변화 - #15
[ICLR 2025 Spotlight] Vision-RWKV: RWKV 유사 아키텍처를 활용한 효율적이고 확장 가능한 시각적 인지
★ 556+0최근 7일 스타 변화 - #16
[ICLR2026] VideoChat-Flash: 롱컨텍스트 비디오 모델링을 위한 계층적 압축
★ 528+0최근 7일 스타 변화 - #17
[ICLR 2024 & ECCV 2024] The All-Seeing Projects: 오픈 월드의 범람식 시각 인식·이해 및 일반 관계 이해를 향하여
★ 506+0최근 7일 스타 변화