Lompat ke konten utama
buildradar
Sign in

intel/auto-round

@intel

Algoritma kuantisasi SOTA untuk inferensi LLM bit-rendah dengan akurasi tinggi, dioptimalkan secara mulus untuk CPU/XPU/CUDA, dengan dukungan berbagai tipe data dan kompatibilitas penuh dengan vLLM, SGLang, dan Transformers.

Bintang
1.599
Fork
171
Bahasa
Python
Lisensi
Apache-2.0
Push terakhir
6 hari yang lalu
Pythonvllmllmstransformersquantizationggufomnidiffuserssglangnvfp4int4vlmsmxfp4rounding

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.