Thema · inference-acceleration
inference-acceleration
Erfasste Open-Source-Repos mit dem Tag inference-acceleration, sortiert nach Sternen.
Repos
4
Sterne gesamt
9.747
Sterne im Schnitt
2.437
Anteil
0,00%
Verwandte Themen
Themen, die häufig gemeinsam mit inference-acceleration am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit inference-acceleration getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
[ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention erzielt eine 2- bis 5-fache Beschleunigung im Vergleich zu FlashAttention, ohne Einbußen bei End-to-End-Metriken über Sprach-, Bild- und Videomodelle hinweg.
★ 3.699+14Sterne-Änderung der letzten 7 Tage - #2
TurboDiffusion: 100- bis 200-fache Beschleunigung für Video-Diffusion-Modelle
★ 3.634+6Sterne-Änderung der letzten 7 Tage - #3★ 1.371+2Sterne-Änderung der letzten 7 Tage
- #4
[ICML2025] SpargeAttention: Eine trainingsfreie sparse Attention, die die Inferenz beliebiger Modelle beschleunigt.
★ 1.045+1Sterne-Änderung der letzten 7 Tage