メインコンテンツへスキップ
buildradar
Sign in

ModelCloud/GPTQModel

@ModelCloud

HF、vLLM、SGLang を介して Nvidia、AMD、Intel GPU および Intel/AMD/Apple CPU のハードウェアアクセラレーションをサポートする LLM モデル量子化 (圧縮) ツールキット。

スター
1,248
フォーク
205
言語
Python
ライセンス
NOASSERTION
最終プッシュ
6 日前
Pythonvllmtransformersquantizationsglangpeftoptimumgptq

関連 Intel はまだありません

このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。