NVIDIA/Model-Optimizer
@NVIDIAThư viện thống nhất các kỹ thuật tối ưu hóa mô hình SOTA như lượng tử hóa, chưng cất, cắt tỉa, tìm kiếm kiến trúc thần kinh, giải mã dự đoán, v.v. Nó nén các mô hình deep learning cho các framework triển khai hạ nguồn như TensorRT-LLM, TensorRT, vLLM, v.v. để tối ưu hóa tốc độ suy luận.
Sao
3.697
Fork
578
Ngôn ngữ
Python
Giấy phép
Apache-2.0
Push gần nhất
5 ngày trước
Intel liên quan (0)
Chưa có intel liên quan
Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.