quantization-aware-training
Dépôts open source suivis étiquetés quantization-aware-training, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de quantization-aware-training sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés quantization-aware-training.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
Quantification LLM faible bit SOTA (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) et sparsité ; techniques de compression de modèles de pointe pour PyTorch, TensorFlow et ONNX Runtime.
★ 2 706+5Évolution des étoiles sur les 7 derniers jours - #2
micronet, une bibliothèque de compression et de déploiement de modèles. Compression : 1. Quantification (QAT, High-Bit, Low-Bit/Ternary/Binary, PTQ 8-bit) ; 2. Élagage (normal, régulier, élagage de canaux de convolution de groupe) ; 3. Groupe.
★ 2 266+0Évolution des étoiles sur les 7 derniers jours - #3
Framework de compression de réseaux de neurones pour une inférence OpenVINO™ optimisée.
★ 1 197+2Évolution des étoiles sur les 7 derniers jours - #4
TinyNeuralNetwork est un framework de compression de modèles d'apprentissage profond efficace et facile à utiliser.
★ 880+1Évolution des étoiles sur les 7 derniers jours