vit
Các kho mã nguồn mở đang theo dõi được gắn thẻ vit, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng vit trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ vit.
Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.
- #1★ 16.549+0Thay đổi số sao trong 7 ngày qua
- #2
Danh sách tài liệu nghiên cứu cực kỳ toàn diện về Vision Transformer/Attention, bao gồm các bài báo, mã nguồn và các trang web liên quan
★ 5.046-3Thay đổi số sao trong 7 ngày qua - #3
Bộ công cụ đánh giá mã nguồn mở cho các mô hình đa phương thức lớn (LMM), hỗ trợ hơn 220 LMM, hơn 80 benchmark
★ 4.375+13Thay đổi số sao trong 7 ngày qua - #4
[ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention đạt tốc độ xử lý nhanh hơn 2-5 lần so với FlashAttention, mà không làm giảm các chỉ số tổng thể trên các mô hình ngôn ngữ, hình ảnh và video.
★ 3.699+14Thay đổi số sao trong 7 ngày qua - #5
Towhee là một framework chuyên dụng giúp các đường ống xử lý dữ liệu thần kinh trở nên đơn giản và nhanh chóng.
★ 3.453-1Thay đổi số sao trong 7 ngày qua - #6
Biến bất kỳ máy tính hoặc thiết bị edge nào thành trung tâm điều khiển cho các dự án computer vision của bạn.
★ 2.431+2Thay đổi số sao trong 7 ngày qua - #7
[CVPR 2021] Bản triển khai chính thức trên PyTorch cho Transformer Interpretability Beyond Attention Visualization, một phương pháp mới để trực quan hóa việc phân loại bởi các mạng dựa trên Transformer.
★ 2.014+0Thay đổi số sao trong 7 ngày qua - #8
Danh sách tài liệu nghiên cứu về các công trình thị giác máy tính (CV) dựa trên Transformer gần đây.
★ 1.464+0Thay đổi số sao trong 7 ngày qua - #9
[ICML2025] SpargeAttention: Cơ chế chú ý thưa thớt không cần huấn luyện giúp tăng tốc suy luận của mọi mô hình.
★ 1.043+1Thay đổi số sao trong 7 ngày qua - #10
Adan: Thuật toán động lượng Nesterov thích ứng giúp tối ưu hóa các mô hình học sâu nhanh hơn
★ 822+0Thay đổi số sao trong 7 ngày qua - #11
Trích xuất đặc trưng video từ video thô bằng nhiều GPU. Hỗ trợ các khung hình luồng RAFT cũng như các mô hình S3D, I3D, R(2+1)D, VGGish, CLIP và TIMM.
★ 656+0Thay đổi số sao trong 7 ngày qua - #12
[CVPR 2025 Highlight] Mã nguồn và mô hình chính thức cho Encoder-only Mask Transformer (EoMT).
★ 620+0Thay đổi số sao trong 7 ngày qua