Chuyển tới nội dung chính
buildradar
Sign in

intel/neural-compressor

@intel

Lượng tử hóa LLM low-bit SOTA (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) & độ thưa (sparsity); các kỹ thuật nén mô hình hàng đầu trên PyTorch, TensorFlow và ONNX Runtime

Sao
2.706
Fork
322
Ngôn ngữ
Python
Giấy phép
Apache-2.0
Push gần nhất
6 ngày trước
Pythonlarge-language-modelsquantizationknowledge-distillationsparsitypruningpost-training-quantizationawqsmoothquantint4quantization-aware-traininggptqfp4auto-tuningint8low-precisionmxformatsparsegpt

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.