Dépôts open source suivis de 1CatAI, triés par étoiles.
Fork de vLLM pour Tesla V100 (SM70) avec prise en charge d'AWQ 4-bit, processus de build CUDA 12.8, et déploiement validé de Qwen3.5 27B/35B sur V100 multi-GPU.