vllm-project/vllm
@vllm-projectMesin inferensi dan serving ber-throughput tinggi serta hemat memori untuk LLM
Bintang
90.817
Fork
21.619
Bahasa
Python
Lisensi
Apache-2.0
Push terakhir
7 hari yang lalu
Mesin inferensi dan serving ber-throughput tinggi serta hemat memori untuk LLM