vision-transformer
vision-transformer 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 vision-transformer 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 vision-transformer 태그가 달린 리포지토리예요.
최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.
- #1
OpenMMLab 탐지 툴박스 및 벤치마크
★ 32,901+6최근 7일 스타 변화 - #2★ 16,549+0최근 7일 스타 변화
- #3
HuggingFace의 Transformers 라이브러리로 제작한 데모를 포함하는 저장소입니다.
★ 11,748+0최근 7일 스타 변화 - #4
[NeurIPS 2024 Best Paper Award][GPT beats diffusion🔥] [scaling laws in visual generation📈] 'Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction' 공식 구현체. 자가 회귀 이미지 생성을 위한 *초간단하고 사용자 친화적이면서도 최첨단인* 코드베이스!
★ 8,728-1최근 7일 스타 변화 - #5★ 7,823+4최근 7일 스타 변화
- #6★ 5,586+6최근 7일 스타 변화
- #7★ 5,462+25최근 7일 스타 변화
- #8
논문, 코드 및 관련 웹사이트를 포함하는 Vision Transformer/Attention에 대한 궁극적으로 포괄적인 논문 목록
★ 5,046-3최근 7일 스타 변화 - #9
Huawei Noah's Ark Lab에서 개발한 GhostNet, TNT, MLP를 포함한 고효율 AI 백본
★ 4,419+1최근 7일 스타 변화 - #10
OpenMMLab 사전 훈련 툴박스 및 벤치마크
★ 3,850-1최근 7일 스타 변화 - #11
DeepSeek Harness를 위한 최초의 비전 플러그인이자, 모든 텍스트 전용 코딩 에이전트를 위한 비전 브리지입니다. 이미지를 붙여넣으면 구조화된 JSON 증거(OCR, 레이아웃, 시맨틱)를 얻을 수 있습니다.
★ 3,839+83최근 7일 스타 변화 - #12★ 3,821+0최근 7일 스타 변화
- #13★ 3,453-1최근 7일 스타 변화
- #14
고해상도 생성 및 인식을 위한 효율적인 비전 파운데이션 모델
★ 3,356+1최근 7일 스타 변화 - #15
InternLM-XComposer2.5-OmniLive: 장기 스트리밍 비디오 및 오디오 상호작용을 위한 종합 멀티모달 시스템
★ 2,925-1최근 7일 스타 변화 - #16★ 2,695+2최근 7일 스타 변화
- #17
[ECCV2024] 멀티모달 이해를 위한 비디오 파운데이션 모델 및 데이터
★ 2,374+5최근 7일 스타 변화 - #18
[CVPR 2025] MambaVision 공식 PyTorch 구현체: 하이브리드 Mamba-Transformer 비전 백본
★ 2,227+2최근 7일 스타 변화 - #19
[NeurIPS'22] "ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation" 및 [TPAMI'23] "ViTPose++: Vision Transformer for Generic Body Pose Estimation"의 공식 저장소
★ 2,139+0최근 7일 스타 변화 - #20
[CVPR 2021] Transformer 기반 네트워크의 분류를 시각화하는 새로운 방법인 Attention Visualization을 뛰어넘는 Transformer 해석 가능성을 위한 공식 PyTorch 구현.
★ 2,014+0최근 7일 스타 변화 - #21★ 1,955+1최근 7일 스타 변화
- #22★ 1,841+2최근 7일 스타 변화
- #23
비전 모델을 위한 올인원 학습(YOLO, ViTs, RT-DETR, DINOv3): 사전 학습, 파인튜닝, 증류.
★ 1,656+4최근 7일 스타 변화 - #24
[ICLR 2023 Spotlight] 밀집 예측을 위한 Vision Transformer Adapter.
★ 1,503+1최근 7일 스타 변화 - #25
비전 및 언어 작업을 위한 파운데이션 모델 선별 목록
★ 1,177+0최근 7일 스타 변화 - #26
UNetFormer: 원격 탐사 도시 Scene 이미지의 효율적인 의미론적 분할을 위한 UNet 유사 transformer (ISPRS). 또한 위성, 항공 및 UAV 이미지 분할을 위한 다른 vision transformer와 CNN도 포함합니다.
★ 1,101+3최근 7일 스타 변화 - #27
비전, 오디오, 언어 모달리티를 아우르는 범용 표현 모델. 논문: ONE-PEACE: Exploring One General Representation Model Toward Unlimited Modalities
★ 1,060+0최근 7일 스타 변화 - #28
[ICML2025] SpargeAttention: 모든 모델의 추론을 가속화하는 학습 없는 희소 어텐션(sparse attention).
★ 1,045+3최근 7일 스타 변화 - #29
:fire: :fire: :fire: 최근 컴퓨터 비전(CV) 관련 논문 목록
★ 973+1최근 7일 스타 변화 - #30
Vision Transformer with Deformable Attention (CVPR2022) 및 DAT++: Spatially Dynamic Vision Transformer with Deformable Attention 저장소입니다.
★ 942+0최근 7일 스타 변화