본문으로 건너뛰기
buildradar
Sign in
소유자 · OpenGVLab

OpenGVLab

OpenGVLab의 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 17개
  • InternVL@OpenGVLab

    [CVPR 2024 Oral] InternVL 패밀리: GPT-4o를 대체하는 선구적인 오픈소스 대안. GPT-4o에 준하는 성능을 가진 오픈소스 멀티모달 대화형 모델

    10,147+6최근 7일 스타 변화
  • LLaMA-Adapter@OpenGVLab

    [ICLR 2024] 1시간 및 120만 개의 파라미터 내에서 지시사항을 따르도록 LLaMA 파인튜닝

    5,914+0최근 7일 스타 변화
  • Ask-Anything@OpenGVLab

    [CVPR2024 Highlight][VideoChatGPT] 비디오 이해 기능이 포함된 ChatGPT! miniGPT4, StableLM, MOSS 등 다양한 지원 언어 모델(LM) 포함.

    3,347+0최근 7일 스타 변화
  • InternGPT@OpenGVLab

    InternGPT (iGPT)는 AI 모델을 쉽게 시각화할 수 있는 오픈소스 데모 플랫폼입니다. 이제 DragGAN, ChatGPT, ImageBind, GPT-4와 같은 멀티모달 채팅, SAM, 대화형 이미지 편집 등을 지원합니다. igpt.opengvlab.com에서 체험해 보세요.

    3,205+1최근 7일 스타 변화
  • InternImage@OpenGVLab

    [CVPR 2023 Highlight] InternImage: Deformable Convolution을 활용한 대규모 비전 파운데이션 모델 탐구

    2,841+2최근 7일 스타 변화
  • InternVideo@OpenGVLab

    [ECCV2024] 멀티모달 이해를 위한 비디오 파운데이션 모델 및 데이터

    2,370+4최근 7일 스타 변화
  • VisionLLM@OpenGVLab

    VisionLLM 시리즈

    1,154+1최근 7일 스타 변화
  • SAM-Med2D@OpenGVLab

    SAM-Med2D 공식 구현체

    1,134+1최근 7일 스타 변화
  • ScaleCUA@OpenGVLab

    [ICLR 2026 Oral] ScaleCUA는 크로스 플랫폼 환경(Windows, macOS, Ubuntu, Android)에서 동작할 수 있는 오픈소스 컴퓨터 사용 에이전트입니다.

    1,133+3최근 7일 스타 변화
  • VideoMamba@OpenGVLab

    [ECCV2024] VideoMamba: 효율적인 비디오 이해를 위한 상태 공간 모델

    1,125+1최근 7일 스타 변화
  • OmniQuant@OpenGVLab

    [ICLR2024 spotlight] OmniQuant은 LLM을 위한 간단하고 강력한 양자화 기술입니다.

    911+3최근 7일 스타 변화
  • VideoMAEv2@OpenGVLab

    [CVPR 2023] VideoMAE V2: 듀얼 마스킹을 통한 비디오 마스크드 오토인코더 확장

    816+2최근 7일 스타 변화
  • DCNv4@OpenGVLab

    [CVPR 2024] Deformable Convolution v4

    746+0최근 7일 스타 변화
  • Multi-Modality-Arena@OpenGVLab

    챗봇 아레나가 멀티모달을 만나다! Multi-Modality Arena는 이미지를 입력으로 사용하여 비전-언어 모델을 나란히 비교하고 벤치마킹할 수 있게 해줍니다. MiniGPT-4, LLaMA-Adapter V2, LLaVA, BLIP-2 등 다양한 모델을 지원합니다!

    566+0최근 7일 스타 변화
  • Vision-RWKV@OpenGVLab

    [ICLR 2025 Spotlight] Vision-RWKV: RWKV 유사 아키텍처를 활용한 효율적이고 확장 가능한 시각적 인지

    556+0최근 7일 스타 변화
  • VideoChat-Flash@OpenGVLab

    [ICLR2026] VideoChat-Flash: 롱컨텍스트 비디오 모델링을 위한 계층적 압축

    528+0최근 7일 스타 변화
  • all-seeing@OpenGVLab

    [ICLR 2024 & ECCV 2024] The All-Seeing Projects: 오픈 월드의 범람식 시각 인식·이해 및 일반 관계 이해를 향하여

    506+0최근 7일 스타 변화
← 소유자 랭킹으로