Aller au contenu principal
buildradar
Sign in

1CatAI/1Cat-vLLM

@1CatAI

Fork de vLLM pour Tesla V100 (SM70) avec prise en charge d'AWQ 4-bit, processus de build CUDA 12.8, et déploiement validé de Qwen3.5 27B/35B sur V100 multi-GPU.

Étoiles
949
Bifurcations
188
Langage
Python
Licence
Apache-2.0
Dernier push
il y a 3 heures
Python

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.