patchy631/time-to-first-token
@patchy631Feuille de route de 10 semaines, à raison de 30 minutes par jour, sur l'inférence et l'optimisation de LLM : vLLM, SGLang, quantification, décodage spéculatif et benchmarking.
Étoiles
880
Bifurcations
103
Langage
HTML
Licence
Apache-2.0
Dernier push
il y a 3 semaines
Intel associée (0)
Aucune intel associée pour le moment
Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.