vllm-project/vllm
@vllm-projectUn moteur d'inférence et de service à haut débit et économe en mémoire pour les LLM
Stars
90 415
Forks
21 400
Language
Python
License
Apache-2.0
Last push
il y a 1 jour
Un moteur d'inférence et de service à haut débit et économe en mémoire pour les LLM