noonghunna/club-3090
@noonghunnaCác công thức cộng đồng để phục vụ LLM trên GPU CUDA RTX 3090/4090/5090. Đa engine (vLLM, llama.cpp, ik_llama) và không phụ thuộc mô hình. Hiện đang cung cấp cấu hình Qwen3.6-27B, Qwen3.6 35B, Gemma 4 26B, Gemma 4 31B cho 1 và 2 card.
Sao
2.166
Fork
134
Ngôn ngữ
Python
Giấy phép
Apache-2.0
Push gần nhất
1 tuần trước
Intel liên quan (0)
Chưa có intel liên quan
Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.