मुख्य सामग्री पर जाएँ
buildradar
Sign in

intel/neural-compressor

@intel

SOTA लो-बिट LLM क्वांटाइजेशन (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) और स्पार्सीटी; PyTorch, TensorFlow और ONNX Runtime पर अग्रणी मॉडल संपीड़न तकनीकें

स्टार
2,706
फ़ोर्क
322
भाषा
Python
लाइसेंस
Apache-2.0
आख़िरी push
6 दिन पहले
Pythonlarge-language-modelsquantizationknowledge-distillationsparsitypruningpost-training-quantizationawqsmoothquantint4quantization-aware-traininggptqfp4auto-tuningint8low-precisionmxformatsparsegpt

अभी कोई संबंधित intel नहीं

यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।