Zum Hauptinhalt springen
buildradar
Sign in

thu-ml/SpargeAttn

@thu-ml

[ICML2025] SpargeAttention: Eine trainingsfreie sparse Attention, die die Inferenz beliebiger Modelle beschleunigt.

Sterne
1.046
Forks
104
Sprache
Cuda
Lizenz
Apache-2.0
Letzter Push
vor 6 Monaten
Cudavideo-generationllmquantizationattentionvision-transformersparse-attentionvitai-infrainference-accelerationmlsyssageattention

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.