Saltar al contenido principal
buildradar
Sign in

ModelCloud/GPTQModel

@ModelCloud

Kit de herramientas de cuantización (compresión) de modelos LLM con soporte de aceleración por hardware para GPU Nvidia, AMD, Intel y CPU Intel/AMD/Apple a través de HF, vLLM y SGLang.

Estrellas
1248
Bifurcaciones
205
Lenguaje
Python
Licencia
NOASSERTION
Último push
hace 6 días
Pythonvllmtransformersquantizationsglangpeftoptimumgptq

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.