跳到主要內容
buildradar
Sign in
主題 · attention

attention

標記 attention 主題、收錄中的開源專案,依星數排序。

專案數
28
總星數
192,785
平均星數
6,885
佔比
0.01%

常跟 attention 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 attention 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • 🧑‍🏫 60+ 深度學習論文實作與教學,附並排筆記 📝;包括 transformers(原版、xl、switch、feedback、vit 等)、optimizers(adam、adabelief、sophia 等)、GAN(cyclegan、stylegan2 等)、🎮 強化學習(ppo、dqn)、capsnet、蒸餾等 🧠

    67,389+21近 7 天星數變化
  • sglang@sgl-project

    SGLang 是針對大型語言模型與多模態模型的高效能服務框架

    33,538+791近 7 天星數變化
  • nlp-tutorial@graykode

    深度學習研究者的自然語言處理教學

    14,927+3近 7 天星數變化
  • OpenMythos@kyegomez

    從第一原理出發,利用現有研究文獻對 Claude Mythos 架構進行理論重建。

    14,867+14近 7 天星數變化
  • External-Attention-pytorch@xmu-xiaoma666

    🍀 用 PyTorch 實作的各種注意力機制、MLP、再參數化、卷積,助於深入理解論文

    12,185+1近 7 天星數變化
  • 使用 PyTorch 實作《Attention is All You Need》中的 Transformer 模型

    9,782-1近 7 天星數變化
  • flashinfer@flashinfer-ai

    FlashInfer:大型語言模型服務的核心函式庫

    6,321+38近 7 天星數變化
  • pytorch-seq2seq@bentrevett

    使用 PyTorch 與 TorchText 實作幾種序列到序列(seq2seq)模型的教學。

    5,708+1近 7 天星數變化
  • transformer@hyunwoongko

    Transformer:PyTorch 實作「Attention Is All You Need」

    4,651+3近 7 天星數變化
  • scenic@google-research

    Scenic:一個用於電腦視覺研究及更廣泛應用的Jax庫

    3,821+0近 7 天星數變化
  • SageAttention@thu-ml

    [ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention 在速度上比 FlashAttention 提升 2-5 倍,且不損失語言、影像與影片模型的端到端指標

    3,699+14近 7 天星數變化
  • YOLOv4-pytorch@argusswift

    這是 YOLOv4、專注力 YOLOv4 與基於 PASCAL VOC 和 COCO 的 mobilenet YOLOv4 的 PyTorch 儲存庫

    1,676+0近 7 天星數變化
  • 最佳多代理論文彙編

    1,664+6近 7 天星數變化
  • transfusion-pytorch@lucidrains

    MetaAI 的 Transfusion Pytorch 實作,「使用一個多模態模型預測下一個 Token 並擴散影像」

    1,398+3近 7 天星數變化
  • SimpleCVReproduction@pprp

    簡單 CV 專案的複現,包含注意力機制、分類、檢測、關鍵點檢測等。

    1,260-1近 7 天星數變化
  • tiny-vllm@jmaczan

    使用 C++ 與 CUDA 建構你自己的高效能 LLM 推理引擎 - vLLM 的精簡版

    1,094+15近 7 天星數變化
  • SpargeAttn@thu-ml

    [ICML2025] SpargeAttention:一種無需訓練的稀疏注意力機制,可加速任何模型的推論。

    1,046+3近 7 天星數變化
  • cudnn-frontend@NVIDIA

    cuDNN Frontend 是 NVIDIA 的現代化開源 cuDNN 函式庫入口,並提供日益增加的高效能開源核心集合。

    932+13近 7 天星數變化
  • rl4co@ai4co

    一個用於組合優化(CO)強化學習(RL)全方位功能的 PyTorch 函式庫

    900+1近 7 天星數變化
  • 實作 Deepseek 團隊在其「Native Sparse Attention」論文中提出的稀疏注意力模式

    813+1近 7 天星數變化
  • 多標籤文字分類,多標籤分類,文字分類,multi-label,classifier,text classification,BERT,seq2seq,attention,multi-label-classification

    805+0近 7 天星數變化
  • EEG-Conformer@eeyhsong

    [TNSRE 23] EEG Transformer 2.0. i. 用於 EEG 解碼的 Convolutional Transformer。ii. 新穎的視覺化技術 - 類別活化地形圖(Class Activation Topography)。

    760+0近 7 天星數變化
  • LongNet@kyegomez

    實作來自「LongNet: Scaling Transformers to 1,000,000,000 Tokens」的隨插即用 Attention

    726+0近 7 天星數變化
  • Deepdive-llama3-from-scratch@therealoliver

    逐步實現 llama3 推論、掌握核心概念、掌握過程推導、實作程式碼。

    630+0近 7 天星數變化
  • Keras beit,caformer,CMT,CoAtNet,convnext,davit,dino,efficientdet,edgenext,efficientformer,efficientnet,eva,fasternet,fastervit,fastvit,flexivit,gcvit,ghostnet,gpvit,hornet,hiera,iformer,inceptionnext,lcnet,levit,maxvit,mobilevit,moganet,nat,nfnets,pvt,swin,tinynet,tinyvit,uniformer,volo,vanillanet,yolor,yolov7,yolov8,yolox,gpt2,llama2, 別名 kecam

    626+0近 7 天星數變化
  • Transformers.jl@chengchingwen

    Transformer 模型的 Julia 實作

    570-1近 7 天星數變化
  • SAITS@WenjieDu

    論文「SAITS: Self-Attention-based Imputation for Time Series」的官方 PyTorch 實作。這是一個用於高效時間序列插補的快速且最先進(SOTA)深度學習神經網路模型(利用機器學習填補包含 NaN 缺失值的多變量不完整時間序列)。https://arxiv.org/abs/2202.08516

    513+1近 7 天星數變化
  • TransArch@MuLabPKU

    Design hardware-friendly model architectures and migrate existing LLMs with minimal performance loss

    502+1近 7 天星數變化
← 返回主題列表