Wenyueh/MinivLLM
@WenyuehBasé sur Nano-vLLM, une réplication simple de vLLM avec une implémentation autonome de paged attention et flash attention.
Étoiles
1 020
Bifurcations
172
Langage
Python
Licence
Apache-2.0
Dernier push
il y a 2 semaines
Intel associée (0)
Aucune intel associée pour le moment
Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.