Pular para o conteúdo principal
buildradar
Sign in

zhihu/ZhiLight

@zhihu

Um motor de aceleração de inferência de LLM altamente otimizado para Llama e suas variantes.

Estrelas
908
Bifurcações
104
Linguagem
C++
Licença
Apache-2.0
Último push
há 6 meses
C++llmcudagptllm-inferencepytorchllamainference-enginedeepseek-r1llm-servingmodel-serving

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.