Repositorios de código abierto monitorizados de 1CatAI, ordenados por estrellas.
Fork de vLLM para Tesla V100 (SM70) con soporte para AWQ de 4 bits, flujo de compilación CUDA 12.8 y despliegue validado de Qwen3.5 27B/35B en V100 multi-GPU.