FasterDecoding/Medusa
@FasterDecodingMedusa: Einfaches Framework zur Beschleunigung der LLM-Generierung mit mehreren Decoding-Heads
Sterne
2.771
Forks
205
Sprache
Jupyter Notebook
Lizenz
Apache-2.0
Letzter Push
vor 2 Jahren
Verwandte Intel (0)
Noch keine verwandte Intel
Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.