Saltar al contenido principal
buildradar
Sign in

FasterDecoding/Medusa

@FasterDecoding

Medusa: Un framework simple para acelerar la generación de LLM con múltiples cabezales de decodificación

Estrellas
2771
Bifurcaciones
205
Lenguaje
Jupyter Notebook
Licencia
Apache-2.0
Último push
hace 2 años
Jupyter Notebookllmllm-inference

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.