본문으로 건너뛰기
buildradar
Sign in
토픽 · vision-transformer

vision-transformer

vision-transformer 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
45
총 스타
154,486
평균 스타
3,433
비중
0.01%

같은 리포지토리에 vision-transformer 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 vision-transformer 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • mmdetection@open-mmlab

    OpenMMLab 탐지 툴박스 및 벤치마크

    32,901+6최근 7일 스타 변화
  • LaTeX-OCR@lukas-blecher

    pix2tex: ViT를 사용하여 수식 이미지를 LaTeX 코드로 변환

    16,549+0최근 7일 스타 변화
  • Transformers-Tutorials@NielsRogge

    HuggingFace의 Transformers 라이브러리로 제작한 데모를 포함하는 저장소입니다.

    11,748+0최근 7일 스타 변화
  • VAR@FoundationVision

    [NeurIPS 2024 Best Paper Award][GPT beats diffusion🔥] [scaling laws in visual generation📈] 'Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction' 공식 구현체. 자가 회귀 이미지 생성을 위한 *초간단하고 사용자 친화적이면서도 최첨단인* 코드베이스!

    8,728-1최근 7일 스타 변화
  • omniparse@adithya-s-k

    GenAI 프레임워크와의 호환성 향상을 위해 문서부터 멀티미디어까지 모든 데이터 형식을 수집, 구문 분석 및 최적화

    7,823+4최근 7일 스타 변화
  • SwinIR@JingyunLiang

    SwinIR: Swin Transformer를 이용한 이미지 복원(공식 레포지토리)

    5,586+6최근 7일 스타 변화
  • mlx-vlm@Blaizzy

    MLX-VLM은 MLX를 사용하여 Mac에서 Vision Language Models (VLM)의 추론 및 파인튜닝을 수행하기 위한 패키지입니다.

    5,462+25최근 7일 스타 변화
  • 논문, 코드 및 관련 웹사이트를 포함하는 Vision Transformer/Attention에 대한 궁극적으로 포괄적인 논문 목록

    5,046-3최근 7일 스타 변화
  • Efficient-AI-Backbones@huawei-noah

    Huawei Noah's Ark Lab에서 개발한 GhostNet, TNT, MLP를 포함한 고효율 AI 백본

    4,419+1최근 7일 스타 변화
  • mmpretrain@open-mmlab

    OpenMMLab 사전 훈련 툴박스 및 벤치마크

    3,850-1최근 7일 스타 변화
  • modlens@liustack

    DeepSeek Harness를 위한 최초의 비전 플러그인이자, 모든 텍스트 전용 코딩 에이전트를 위한 비전 브리지입니다. 이미지를 붙여넣으면 구조화된 JSON 증거(OCR, 레이아웃, 시맨틱)를 얻을 수 있습니다.

    3,839+83최근 7일 스타 변화
  • scenic@google-research

    Scenic: 컴퓨터 비전 연구 등을 위한 Jax 라이브러리.

    3,821+0최근 7일 스타 변화
  • towhee@towhee-io

    Towhee는 신경망 데이터 처리 파이프라인을 빠르고 간단하게 만드는 데 특화된 프레임워크입니다.

    3,453-1최근 7일 스타 변화
  • efficientvit@mit-han-lab

    고해상도 생성 및 인식을 위한 효율적인 비전 파운데이션 모델

    3,356+1최근 7일 스타 변화
  • InternLM-XComposer@InternLM

    InternLM-XComposer2.5-OmniLive: 장기 스트리밍 비디오 및 오디오 상호작용을 위한 종합 멀티모달 시스템

    2,925-1최근 7일 스타 변화
  • EVA@baaivision

    EVA 시리즈: BAAI의 시각적 표현 판타지

    2,695+2최근 7일 스타 변화
  • InternVideo@OpenGVLab

    [ECCV2024] 멀티모달 이해를 위한 비디오 파운데이션 모델 및 데이터

    2,374+5최근 7일 스타 변화
  • MambaVision@NVlabs

    [CVPR 2025] MambaVision 공식 PyTorch 구현체: 하이브리드 Mamba-Transformer 비전 백본

    2,227+2최근 7일 스타 변화
  • ViTPose@ViTAE-Transformer

    [NeurIPS'22] "ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation" 및 [TPAMI'23] "ViTPose++: Vision Transformer for Generic Body Pose Estimation"의 공식 저장소

    2,139+0최근 7일 스타 변화
  • Transformer-Explainability@hila-chefer

    [CVPR 2021] Transformer 기반 네트워크의 분류를 시각화하는 새로운 방법인 Attention Visualization을 뛰어넘는 Transformer 해석 가능성을 위한 공식 PyTorch 구현.

    2,014+0최근 7일 스타 변화
  • EasyCV@alibaba

    컴퓨터 비전을 위한 올인원 툴킷

    1,955+1최근 7일 스타 변화
  • Cream@microsoft

    NAS 및 Vision Transformer 관련 연구 모음입니다.

    1,841+2최근 7일 스타 변화
  • lightly-train@lightly-ai

    비전 모델을 위한 올인원 학습(YOLO, ViTs, RT-DETR, DINOv3): 사전 학습, 파인튜닝, 증류.

    1,656+4최근 7일 스타 변화
  • ViT-Adapter@czczup

    [ICLR 2023 Spotlight] 밀집 예측을 위한 Vision Transformer Adapter.

    1,503+1최근 7일 스타 변화
  • 비전 및 언어 작업을 위한 파운데이션 모델 선별 목록

    1,177+0최근 7일 스타 변화
  • GeoSeg@WangLibo1995

    UNetFormer: 원격 탐사 도시 Scene 이미지의 효율적인 의미론적 분할을 위한 UNet 유사 transformer (ISPRS). 또한 위성, 항공 및 UAV 이미지 분할을 위한 다른 vision transformer와 CNN도 포함합니다.

    1,101+3최근 7일 스타 변화
  • ONE-PEACE@OFA-Sys

    비전, 오디오, 언어 모달리티를 아우르는 범용 표현 모델. 논문: ONE-PEACE: Exploring One General Representation Model Toward Unlimited Modalities

    1,060+0최근 7일 스타 변화
  • SpargeAttn@thu-ml

    [ICML2025] SpargeAttention: 모든 모델의 추론을 가속화하는 학습 없는 희소 어텐션(sparse attention).

    1,045+3최근 7일 스타 변화
  • :fire: :fire: :fire: 최근 컴퓨터 비전(CV) 관련 논문 목록

    973+1최근 7일 스타 변화
  • DAT@LeapLabTHU

    Vision Transformer with Deformable Attention (CVPR2022) 및 DAT++: Spatially Dynamic Vision Transformer with Deformable Attention 저장소입니다.

    942+0최근 7일 스타 변화
← 토픽 목록으로