NVIDIA/Model-Optimizer
@NVIDIAPustaka terpadu untuk teknik optimasi model SOTA seperti kuantisasi, distilasi, pruning, pencarian arsitektur saraf, speculative decoding, dll. Pustaka ini mengompresi model deep learning untuk kerangka kerja deployment hilir seperti TensorRT-LLM, TensorRT, vLLM, dll. guna mengoptimalkan kecepatan inferensi.
Bintang
3.697
Fork
578
Bahasa
Python
Lisensi
Apache-2.0
Push terakhir
4 hari yang lalu
Intel terkait (0)
Belum ada intel terkait
Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.