跳到主要内容
buildradar
登录

thu-ml/SpargeAttn

@thu-ml

[ICML2025] SpargeAttention:一种无需训练的稀疏注意力机制,可加速任何模型的推理。

星数
1,050
Fork 数
104
语言
Cuda
许可
Apache-2.0
最后推送
7个月前
Cudavideo-generationllmquantizationattentionvision-transformersparse-attentionvitai-infrainference-accelerationmlsyssageattention

还没有相关情报

radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。