Zum Hauptinhalt springen
buildradar
Sign in
Thema · inference-acceleration

inference-acceleration

Erfasste Open-Source-Repos mit dem Tag inference-acceleration, sortiert nach Sternen.

Repos
4
Sterne gesamt
9.747
Sterne im Schnitt
2.437
Anteil
0,00%

Themen, die häufig gemeinsam mit inference-acceleration am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit inference-acceleration getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • SageAttention@thu-ml

    [ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention erzielt eine 2- bis 5-fache Beschleunigung im Vergleich zu FlashAttention, ohne Einbußen bei End-to-End-Metriken über Sprach-, Bild- und Videomodelle hinweg.

    3.699+14Sterne-Änderung der letzten 7 Tage
  • TurboDiffusion@thu-ml

    TurboDiffusion: 100- bis 200-fache Beschleunigung für Video-Diffusion-Modelle

    3.634+6Sterne-Änderung der letzten 7 Tage
  • TeaCache@ali-vilab

    Timestep Embedding Tells: Zeit für Caching bei Video-Diffusionsmodellen

    1.371+2Sterne-Änderung der letzten 7 Tage
  • SpargeAttn@thu-ml

    [ICML2025] SpargeAttention: Eine trainingsfreie sparse Attention, die die Inferenz beliebiger Modelle beschleunigt.

    1.045+1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen