1CatAI/1Cat-vLLM
@1CatAIFork do vLLM para Tesla V100 (SM70) com suporte a AWQ de 4 bits, fluxo de build CUDA 12.8 e implantação validada de Qwen3.5 27B/35B em V100 com múltiplas GPUs.
Estrelas
931
Bifurcações
184
Linguagem
Python
Licença
Apache-2.0
Último push
há 23 horas
Intel relacionado (0)
Ainda não há intel relacionado
Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.