1CatAI/1Cat-vLLM
@1CatAIBản fork vLLM cho Tesla V100 (SM70) với hỗ trợ AWQ 4-bit, quy trình build CUDA 12.8 và triển khai Qwen3.5 27B/35B đã được kiểm chứng trên V100 đa GPU.
Sao
949
Fork
188
Ngôn ngữ
Python
Giấy phép
Apache-2.0
Push gần nhất
1 giờ trước
Intel liên quan (0)
Chưa có intel liên quan
Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.