Lompat ke konten utama
buildradar
Sign in

intel/neural-compressor

@intel

Kuantisasi LLM low-bit SOTA (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) & sparsity; teknik kompresi model terdepan pada PyTorch, TensorFlow, dan ONNX Runtime

Bintang
2.706
Fork
322
Bahasa
Python
Lisensi
Apache-2.0
Push terakhir
6 hari yang lalu
Pythonlarge-language-modelsquantizationknowledge-distillationsparsitypruningpost-training-quantizationawqsmoothquantint4quantization-aware-traininggptqfp4auto-tuningint8low-precisionmxformatsparsegpt

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.