vllm-project/vllm
@vllm-projectEin hocheffizientes und speichereffizientes Inferenz- und Serving-Engine für LLMs
Sterne
90.817
Forks
21.619
Sprache
Python
Lizenz
Apache-2.0
Letzter Push
vor 5 Tagen
Ein hocheffizientes und speichereffizientes Inferenz- und Serving-Engine für LLMs