Zum Hauptinhalt springen
buildradar
Sign in

FasterDecoding/Medusa

@FasterDecoding

Medusa: Einfaches Framework zur Beschleunigung der LLM-Generierung mit mehreren Decoding-Heads

Sterne
2.771
Forks
205
Sprache
Jupyter Notebook
Lizenz
Apache-2.0
Letzter Push
vor 2 Jahren
Jupyter Notebookllmllm-inference

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.