Zum Hauptinhalt springen
buildradar
Sign in

zhihu/ZhiLight

@zhihu

Eine hochoptimierte LLM-Inferenz-Beschleunigungs-Engine für Llama und dessen Varianten.

Sterne
908
Forks
104
Sprache
C++
Lizenz
Apache-2.0
Letzter Push
vor 6 Monaten
C++llmcudagptllm-inferencepytorchllamainference-enginedeepseek-r1llm-servingmodel-serving

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.