Aller au contenu principal
buildradar
Sign in

zhihu/ZhiLight

@zhihu

Un moteur d'accélération d'inférence LLM hautement optimisé pour Llama et ses variantes.

Étoiles
908
Bifurcations
104
Langage
C++
Licence
Apache-2.0
Dernier push
il y a 6 mois
C++llmcudagptllm-inferencepytorchllamainference-enginedeepseek-r1llm-servingmodel-serving

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.