Zum Hauptinhalt springen
buildradar
Sign in

NVlabs/Fast-dLLM

@NVlabs

Offizielle Implementierung von "Fast-dLLM: Training-free Acceleration of Diffusion LLM by Enabling KV Cache and Parallel Decoding"

Sterne
1.084
Forks
144
Sprache
Python
Lizenz
Apache-2.0
Letzter Push
vor 3 Monaten
Python

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.