quantization-aware-training
Erfasste Open-Source-Repos mit dem Tag quantization-aware-training, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit quantization-aware-training am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit quantization-aware-training getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
SOTA Low-Bit-LLM-Quantisierung (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) und Sparsity; führende Modellkompressionstechniken für PyTorch, TensorFlow und ONNX Runtime
★ 2.706+5Sterne-Änderung der letzten 7 Tage - #2
micronet, eine Bibliothek für Modellkomprimierung und Deployment. Komprimierung: 1. Quantisierung: Quantization-Aware-Training (QAT), High-Bit (>2b) (DoReFa/Quantization and Training of Neural Networks for Efficient Integer-Arithmetic-Only Inference), Low-Bit (≤2b)/Ternär und Binär (TWN/BNN/XNOR-Net); Post-Training-Quantisierung (PTQ), 8-Bit (tensorrt); 2. Pruning: normales, reguläres und gruppenbasiertes Faltungskanal-Pruning; 3. grou
★ 2.265+0Sterne-Änderung der letzten 7 Tage - #3★ 1.197+2Sterne-Änderung der letzten 7 Tage
- #4
TinyNeuralNetwork ist ein effizientes und einfach zu bedienendes Framework zur Komprimierung von Deep-Learning-Modellen.
★ 880+1Sterne-Änderung der letzten 7 Tage