post-training-quantization
Dépôts open source suivis étiquetés post-training-quantization, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de post-training-quantization sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés post-training-quantization.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
Quantification LLM faible bit SOTA (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) et sparsité ; techniques de compression de modèles de pointe pour PyTorch, TensorFlow et ONNX Runtime.
★ 2 706+0Évolution des étoiles sur les 7 derniers jours - #2
micronet, une bibliothèque de compression et de déploiement de modèles. Compression : 1. Quantification (QAT, High-Bit, Low-Bit/Ternary/Binary, PTQ 8-bit) ; 2. Élagage (normal, régulier, élagage de canaux de convolution de groupe) ; 3. Groupe.
★ 2 265-1Évolution des étoiles sur les 7 derniers jours - #3
TinyNeuralNetwork est un framework de compression de modèles d'apprentissage profond efficace et facile à utiliser.
★ 879-1Évolution des étoiles sur les 7 derniers jours - #4
[ICML 2024] SqueezeLLM : Quantification dense et éparse
★ 724+1Évolution des étoiles sur les 7 derniers jours