Aller au contenu principal
buildradar
Sign in

ModelCloud/GPTQModel

@ModelCloud

Boîte à outils de quantification (compression) de modèles LLM avec accélération matérielle pour GPU Nvidia, AMD, Intel et CPU Intel/AMD/Apple via HF, vLLM et SGLang.

Étoiles
1 248
Bifurcations
205
Langage
Python
Licence
NOASSERTION
Dernier push
il y a 5 jours
Pythonvllmtransformersquantizationsglangpeftoptimumgptq

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.