Aller au contenu principal
buildradar

vllm-project/vllm

@vllm-project

Un moteur d'inférence et de service à haut débit et économe en mémoire pour les LLM

Stars
90 415
Forks
21 400
Language
Python
License
Apache-2.0
Last push
il y a 1 jour
Pythonopenaillmcudagpttransformerpytorchdeepseekqwenllamainferencekimiqwen3tpullm-servingmodel-servingmoedeepseek-v3amdgpt-ossblackwell