Lompat ke konten utama
buildradar
Sign in

ModelCloud/GPTQModel

@ModelCloud

Toolkit kuantisasi (kompresi) model LLM dengan dukungan akselerasi HW untuk GPU Nvidia, AMD, Intel, dan CPU Intel/AMD/Apple melalui HF, vLLM, dan SGLang.

Bintang
1.248
Fork
205
Bahasa
Python
Lisensi
NOASSERTION
Push terakhir
6 hari yang lalu
Pythonvllmtransformersquantizationsglangpeftoptimumgptq

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.