Chuyển tới nội dung chính
buildradar
Sign in

ModelCloud/GPTQModel

@ModelCloud

Bộ công cụ lượng tử hóa (nén) mô hình LLM hỗ trợ tăng tốc phần cứng cho GPU Nvidia, AMD, Intel và CPU Intel/AMD/Apple thông qua HF, vLLM và SGLang.

Sao
1.248
Fork
205
Ngôn ngữ
Python
Giấy phép
NOASSERTION
Push gần nhất
6 ngày trước
Pythonvllmtransformersquantizationsglangpeftoptimumgptq

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.