跳到主要內容
buildradar
Sign in
主題 · vision-transformer

vision-transformer

標記 vision-transformer 主題、收錄中的開源專案,依星數排序。

專案數
45
總星數
154,486
平均星數
3,433
佔比
0.01%

常跟 vision-transformer 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 vision-transformer 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • mmdetection@open-mmlab

    OpenMMLab 偵測工具箱與基準測試

    32,901+6近 7 天星數變化
  • LaTeX-OCR@lukas-blecher

    pix2tex:使用 ViT 將方程式圖片轉換為 LaTeX 代碼

    16,549+0近 7 天星數變化
  • Transformers-Tutorials@NielsRogge

    此倉庫包含我使用 HuggingFace 的 Transformers 庫製作的示例。

    11,748+0近 7 天星數變化
  • VAR@FoundationVision

    [NeurIPS 2024 最佳論文獎][GPT 打敗 diffusion🔥] [視覺生成的 scaling laws📈] 官方實作「Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction」——一個*超簡單、使用者友好且達到最先進水平*的自回歸影像生成程式碼庫

    8,728-1近 7 天星數變化
  • omniparse@adithya-s-k

    擷取、解析並優化任何資料格式 ➡️ 從文件到多媒體 ➡️ 提升與 GenAI 框架的相容性

    7,823+4近 7 天星數變化
  • SwinIR@JingyunLiang

    SwinIR:使用 Swin Transformer 的影像復原(官方倉庫)。

    5,586+6近 7 天星數變化
  • mlx-vlm@Blaizzy

    MLX-VLM 是一個在 Mac 上使用 MLX 進行 Vision Language Models (VLMs) 推理與微調的套件

    5,462+25近 7 天星數變化
  • 一份全面的 Vision Transformer/Attention 論文清單,包含論文、程式碼與相關網站

    5,046-3近 7 天星數變化
  • Efficient-AI-Backbones@huawei-noah

    高效 AI 主幹網絡,包括 GhostNet、TNT 與 MLP,由華為 Noah's Ark Lab 開發。

    4,419+1近 7 天星數變化
  • mmpretrain@open-mmlab

    OpenMMLab 預訓練工具箱與基準測試

    3,850-1近 7 天星數變化
  • modlens@liustack

    DeepSeek Harness 的第一個視覺插件,以及每個純文字編碼代理的視覺橋接。粘貼圖片,即可獲得結構化 JSON 證據(OCR、版面、語義)。 | 全網最強 DeepSeek Harness 外掛視覺插件,為 DeepSeek、GLM 等純文本模型外掛視覺能力,粘貼圖片即得結構化 JSON 證據(OCR、版面、語義)。

    3,839+83近 7 天星數變化
  • scenic@google-research

    Scenic:一個用於電腦視覺研究及更廣泛應用的Jax庫

    3,821+0近 7 天星數變化
  • towhee@towhee-io

    Towhee 是一个致力于简化神经数据处理流水线的框架

    3,453-1近 7 天星數變化
  • efficientvit@mit-han-lab

    高效的視覺基礎模型,用於高解析度生成與感知。

    3,356+1近 7 天星數變化
  • InternLM-XComposer@InternLM

    InternLM-XComposer2.5-OmniLive:一個全面的多模態系統,用於長期串流視頻與音頻互動

    2,925-1近 7 天星數變化
  • EVA@baaivision

    EVA 系列:來自 BAAI 的視覺表示幻想

    2,695+2近 7 天星數變化
  • InternVideo@OpenGVLab

    [ECCV2024] 用於多模態理解的影片基礎模型與資料

    2,374+5近 7 天星數變化
  • MambaVision@NVlabs

    [CVPR 2025] MambaVision 官方 PyTorch 實作:混合 Mamba-Transformer 視覺骨幹網路

    2,227+2近 7 天星數變化
  • ViTPose@ViTAE-Transformer

    [NeurIPS'22]「ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation」與 [TPAMI'23]「ViTPose++: Vision Transformer for Generic Body Pose Estimation」的官方儲存庫

    2,139+0近 7 天星數變化
  • Transformer-Explainability@hila-chefer

    [CVPR 2021] Transformer 專案超越注意力視覺化的官方 PyTorch 實作,這是一種基於 Transformer 網路將分類視覺化的新穎方法。

    2,014+0近 7 天星數變化
  • EasyCV@alibaba

    一個全方位的電腦視覺工具包

    1,955+1近 7 天星數變化
  • Cream@microsoft

    這是我們關於 NAS 與 Vision Transformer 工作的集合。

    1,841+2近 7 天星數變化
  • lightly-train@lightly-ai

    視覺模型的全方位訓練(YOLO、ViTs、RT-DETR、DINOv3):預訓練、微調、蒸餾。

    1,656+4近 7 天星數變化
  • ViT-Adapter@czczup

    [ICLR 2023 Spotlight] 用於密集預測的 Vision Transformer Adapter

    1,503+1近 7 天星數變化
  • 精選的視覺與語言任務基礎模型清單

    1,177+0近 7 天星數變化
  • GeoSeg@WangLibo1995

    UNetFormer:用於遙感城市場景影像高效語意分割的類 UNet transformer,ISPRS。同時包含用於衛星、航空影像及無人機影像分割的其他視覺 transformer 與 CNN。

    1,101+3近 7 天星數變化
  • ONE-PEACE@OFA-Sys

    跨視覺、音訊、語言模態的通用表示模型。論文:ONE-PEACE: Exploring One General Representation Model Toward Unlimited Modalities

    1,060+0近 7 天星數變化
  • SpargeAttn@thu-ml

    [ICML2025] SpargeAttention:一種無需訓練的稀疏注意力機制,可加速任何模型的推論。

    1,043+1近 7 天星數變化
  • :fire: :fire: :fire: 近期電腦視覺 (CV) 相關論文清單

    973+1近 7 天星數變化
  • semantic-segmentation@sithu31296

    基於 PyTorch 的 SOTA 語意分割模型

    942-1近 7 天星數變化
← 返回主題列表