跳到主要内容
buildradar
Sign in

ModelCloud/GPTQModel

@ModelCloud

支持硬件加速的 LLM 模型量化(压缩)工具包,可通过 HF、vLLM 及 SGLang 为 Nvidia、AMD、Intel GPU 以及 Intel/AMD/Apple CPU 提供加速支持。

星数
1,248
Fork 数
205
语言
Python
许可
NOASSERTION
最后推送
7天前
Pythonvllmtransformersquantizationsglangpeftoptimumgptq

还没有相关情报

radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。