본문으로 건너뛰기
buildradar
Sign in
소유자 · FoundationVision

FoundationVision

FoundationVision의 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 10개
  • VAR@FoundationVision

    [NeurIPS 2024 Best Paper Award][GPT beats diffusion🔥] [scaling laws in visual generation📈] 'Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction' 공식 구현체. 자가 회귀 이미지 생성을 위한 *초간단하고 사용자 친화적이면서도 최첨단인* 코드베이스!

    8,728-1최근 7일 스타 변화
  • ByteTrack@FoundationVision

    [ECCV 2022] ByteTrack: 모든 탐지 상자를 연결하여 다중 객체 추적

    6,662+4최근 7일 스타 변화
  • LlamaGen@FoundationVision

    자기회귀 모델이 Diffusion을 이기다: 🦙 확장 가능한 이미지 생성을 위한 Llama

    1,966+0최근 7일 스타 변화
  • Infinity@FoundationVision

    [CVPR 2025 Oral] Infinity ∞: 고해상도 이미지 생성을 위한 비트 단위 자기회귀 모델링 확장

    1,587+0최근 7일 스타 변화
  • GLEE@FoundationVision

    [CVPR2024 Highlight] GLEE: 대규모 이미지 및 비디오를 위한 일반 객체 파운데이션 모델

    1,170+0최근 7일 스타 변화
  • Waver@FoundationVision

    통합 텍스트-비디오(T2V) 및 이미지-비디오(I2V) 생성을 위한 업계 수준의 비디오 파운데이션 모델

    952+0최근 7일 스타 변화
  • InfinityStar@FoundationVision

    [NeurIPS 2025 Oral] Infinity⭐️: 시각적 생성을 위한 통합 시공간 자기회귀 모델링

    784+4최근 7일 스타 변화
  • Liquid@FoundationVision

    (IJCV 채택) Liquid: 확장 가능하고 통합된 멀티모달 생성 언어 모델.

    640+0최근 7일 스타 변화
  • Groma@FoundationVision

    [ECCV2024] 로컬라이즈된 시각적 토큰화를 갖춘 접지형 멀티모달 대규모 언어 모델

    586+0최근 7일 스타 변화
  • UniTok@FoundationVision

    [NeurIPS 2025 Spotlight] 시각적 생성 및 이해를 위한 통합 토크나이저

    529+0최근 7일 스타 변화
← 소유자 랭킹으로