intel/neural-compressor
@intel领先的低比特大型语言模型(LLM)量化(INT8/FP8/MXFP8/INT4/MXFP4/NVFP4)与稀疏化技术;基于 PyTorch、TensorFlow 和 ONNX Runtime 的顶尖模型压缩技术
星数
2,706
Fork 数
322
语言
Python
许可
Apache-2.0
最后推送
1周前
相关情报(0)
还没有相关情报
radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。