본문으로 건너뛰기
buildradar
Sign in
토픽 · large-multimodal-models

large-multimodal-models

large-multimodal-models 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
9
총 스타
10,371
평균 스타
1,152
비중
0.00%

같은 리포지토리에 large-multimodal-models 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 large-multimodal-models 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • VITA@VITA-MLLM

    ✨✨[NeurIPS 2025] VITA-1.5: GPT-4o 수준의 실시간 비전 및 음성 상호작용 지향

    2,532-1최근 7일 스타 변화
  • [ICCV 2025] Describe Anything 구현: 상세하고 지역화된 이미지 및 비디오 캡셔닝

    1,517+3최근 7일 스타 변화
  • 155개 이상의 시각-언어 모델(VLM/MLLM) 아키텍처를 엄선한 시각적 카탈로그: 멀티모달 AI 에이전트를 위한 논문, 다이어그램, 학습 레시피, 데이터셋 및 출시 타임라인.

    1,310+2최근 7일 스타 변화
  • ShareGPT4Video@ShareGPT4Omni

    [NeurIPS 2024] "ShareGPT4Video: Improving Video Understanding and Generation with Better Captions" 공식 구현체

    1,094+1최근 7일 스타 변화
  • TinyLLaVA_Factory@TinyLLaVA

    소규모 대형 멀티모달 모델 프레임워크

    1,003+1최근 7일 스타 변화
  • 의료 영상 분야의 멀티모달 학습 응용 사례 모음

    975+1최근 7일 스타 변화
  • LLaVA-Plus-Codebase@LLaVA-VL

    LLaVA-Plus: 플러그인을 통해 기술을 학습하고 사용하는 대규모 언어 및 비전 어시스턴트

    770+0최근 7일 스타 변화
  • MMMU@MMMU-Benchmark

    이 저장소는 "MMMU: 전문가 수준 AGI를 위한 대규모 다학제 멀티모달 이해 및 추론 벤치마크" 논문의 평가 코드를 포함합니다.

    593+1최근 7일 스타 변화
  • LLaVA-Mini@ictnlp

    LLaVA-Mini는 이미지, 고해상도 이미지 및 비디오 이해를 효율적으로 지원하는 통합 대규모 멀티모달 모델(LMM)입니다.

    577+0최근 7일 스타 변화
← 토픽 목록으로