attention
标记 attention 主题、收录中的开源项目,按星标数排序。
相关主题
常跟 attention 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 attention 主题的项目。
近 90 天内还没有新项目标记这个主题。
- #1
🧑🏫 60+ 深度学习论文实现与教程,附并排笔记 📝;包括 transformers(原版、xl、switch、feedback、vit 等)、optimizers(adam、adabelief、sophia 等)、GAN(cyclegan、stylegan2 等)、🎮 强化学习(ppo、dqn)、capsnet、蒸馏等 🧠
★ 67,389+21近 7 天星标变化 - #2★ 33,538+791近 7 天星标变化
- #3
深度学习研究者的自然语言处理教程
★ 14,927+3近 7 天星标变化 - #4
从第一原理出发,利用现有研究文献对 Claude Mythos 架构进行理论重建。
★ 14,867+14近 7 天星标变化 - #5
🍀 Pytorch 实现的各种 Attention 机制、MLP、Re-parameter、Convolution,有助于进一步理解论文
★ 12,185+1近 7 天星标变化 - #6
使用 PyTorch 实现《Attention is All You Need》中的 Transformer 模型
★ 9,782-1近 7 天星标变化 - #7
FlashInfer:大型语言模型服务的内核库
★ 6,321+38近 7 天星标变化 - #8
使用 PyTorch 与 TorchText 实作几种序列到序列(seq2seq)模型的教学。
★ 5,708+1近 7 天星标变化 - #9
Transformer:PyTorch 实作「Attention Is All You Need」
★ 4,651+3近 7 天星标变化 - #10★ 3,821+0近 7 天星标变化
- #11
[ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention 在速度上比 FlashAttention 提升 2-5 倍,且不损失语言、影像与影片模型的端到端指标
★ 3,699+14近 7 天星标变化 - #12
这是 YOLOv4、注意力 YOLOv4 以及基于 PASCAL VOC 和 COCO 的 mobilenet YOLOv4 的 PyTorch 仓库
★ 1,676+0近 7 天星标变化 - #13
最佳多智能体论文汇编
★ 1,664+6近 7 天星标变化 - #14
MetaAI 的 Transfusion Pytorch 实现,“使用一个多模态模型预测下一个 Token 并扩散图像”
★ 1,398+3近 7 天星标变化 - #15
简单 CV 项目的复现,包含注意力机制、分类、检测、关键点检测等。
★ 1,260-1近 7 天星标变化 - #16★ 1,100+15近 7 天星标变化
- #17
[ICML2025] SpargeAttention:一种无需训练的稀疏注意力机制,可加速任何模型的推理。
★ 1,047+4近 7 天星标变化 - #18
cuDNN Frontend 是 NVIDIA 的现代化开源 cuDNN 库入口,并提供日益增加的高性能开源核心集合。
★ 932+14近 7 天星标变化 - #19★ 900+1近 7 天星标变化
- #20
实现 Deepseek 团队在其“Native Sparse Attention”论文中提出的稀疏注意力模式
★ 813+1近 7 天星标变化 - #21
多标签文本分类,多标签分类,文本分类,multi-label,classifier,text classification,BERT,seq2seq,attention,multi-label-classification
★ 805+0近 7 天星标变化 - #22
[TNSRE 23] EEG Transformer 2.0. i. 用于 EEG 解码的 Convolutional Transformer。ii. 新颖的可视化技术 - 类别活化地形图(Class Activation Topography)。
★ 760+0近 7 天星标变化 - #23★ 727+0近 7 天星标变化
- #24
逐步实现 llama3 推理、掌握核心概念、掌握过程推导、实现代码。
★ 629+0近 7 天星标变化 - #25
Keras beit,caformer,CMT,CoAtNet,convnext,davit,dino,efficientdet,edgenext,efficientformer,efficientnet,eva,fasternet,fastervit,fastvit,flexivit,gcvit,ghostnet,gpvit,hornet,hiera,iformer,inceptionnext,lcnet,levit,maxvit,mobilevit,moganet,nat,nfnets,pvt,swin,tinynet,tinyvit,uniformer,volo,vanillanet,yolor,yolov7,yolov8,yolox,gpt2,llama2, 别名 kecam
★ 626+0近 7 天星标变化 - #26
Transformer 模型的 Julia 实现
★ 570-1近 7 天星标变化 - #27
论文「SAITS: Self-Attention-based Imputation for Time Series」的官方 PyTorch 实现。这是一个用于高效时间序列插补的快速且最先进(SOTA)深度学习神经网络模型(利用机器学习填补包含 NaN 缺失值的多变量不完整时间序列)。https://arxiv.org/abs/2202.08516
★ 513+1近 7 天星标变化 - #28
Design hardware-friendly model architectures and migrate existing LLMs with minimal performance loss
★ 502+1近 7 天星标变化