intel/neural-compressor
@intelSOTA लो-बिट LLM क्वांटाइजेशन (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) और स्पार्सीटी; PyTorch, TensorFlow और ONNX Runtime पर अग्रणी मॉडल संपीड़न तकनीकें
स्टार
2,706
फ़ोर्क
322
भाषा
Python
लाइसेंस
Apache-2.0
आख़िरी push
6 दिन पहले
संबंधित intel (0)
अभी कोई संबंधित intel नहीं
यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।