Wenyueh/MinivLLM
@WenyuehBasado en Nano-vLLM, una replicación sencilla de vLLM con implementación autocontenida de paged attention y flash attention
Estrellas
1020
Bifurcaciones
172
Lenguaje
Python
Licencia
Apache-2.0
Último push
hace 2 semanas
Intel relacionado (0)
Aún no hay intel relacionado
Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.