Saltar al contenido principal
buildradar
Sign in

1CatAI/1Cat-vLLM

@1CatAI

Fork de vLLM para Tesla V100 (SM70) con soporte para AWQ de 4 bits, flujo de compilación CUDA 12.8 y despliegue validado de Qwen3.5 27B/35B en V100 multi-GPU.

Estrellas
931
Bifurcaciones
184
Lenguaje
Python
Licencia
Apache-2.0
Último push
hace 13 horas
Python

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.