Chuyển tới nội dung chính
buildradar
Đăng nhập

noonghunna/club-3090

@noonghunna

Các công thức cộng đồng để phục vụ LLM trên GPU CUDA RTX 3090/4090/5090. Đa engine (vLLM, llama.cpp, ik_llama) và không phụ thuộc mô hình. Hiện đang cung cấp cấu hình Qwen3.6-27B, Qwen3.6 35B, Gemma 4 26B, Gemma 4 31B cho 1 và 2 card.

Sao
2.166
Fork
134
Ngôn ngữ
Python
Giấy phép
Apache-2.0
Push gần nhất
1 tuần trước
Python

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.