跳到主要內容
buildradar
Sign in

ModelCloud/GPTQModel

@ModelCloud

支援硬體加速的 LLM 模型量化(壓縮)工具包,可透過 HF、vLLM 及 SGLang 為 Nvidia、AMD、Intel GPU 以及 Intel/AMD/Apple CPU 提供加速支援。

星數
1,248
Fork 數
205
語言
Python
授權
NOASSERTION
最後推送
7 天前
Pythonvllmtransformersquantizationsglangpeftoptimumgptq

還沒有相關情報

radar 追蹤的來源裡還沒有出現過這個 repo。收集器照排程執行——等它涵蓋到這個 repo 再回來看看。