1CatAI/1Cat-vLLM
@1CatAIFork de vLLM para Tesla V100 (SM70) con soporte para AWQ de 4 bits, flujo de compilación CUDA 12.8 y despliegue validado de Qwen3.5 27B/35B en V100 multi-GPU.
Estrellas
931
Bifurcaciones
184
Lenguaje
Python
Licencia
Apache-2.0
Último push
hace 13 horas
Intel relacionado (0)
Aún no hay intel relacionado
Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.