跳到主要內容
buildradar
登入

thu-ml/SpargeAttn

@thu-ml

[ICML2025] SpargeAttention:一種無需訓練的稀疏注意力機制,可加速任何模型的推論。

星數
1,050
Fork 數
104
語言
Cuda
授權
Apache-2.0
最後推送
7 個月前
Cudavideo-generationllmquantizationattentionvision-transformersparse-attentionvitai-infrainference-accelerationmlsyssageattention

還沒有相關情報

radar 追蹤的來源裡還沒有出現過這個 repo。收集器照排程執行——等它涵蓋到這個 repo 再回來看看。