Aller au contenu principal
buildradar
Sign in

FasterDecoding/Medusa

@FasterDecoding

Medusa : framework simple pour accélérer la génération LLM avec têtes de décodage multiples

Étoiles
2 771
Bifurcations
205
Langage
Jupyter Notebook
Licence
Apache-2.0
Dernier push
il y a 2 ans
Jupyter Notebookllmllm-inference

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.