post-training-quantization
Erfasste Open-Source-Repos mit dem Tag post-training-quantization, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit post-training-quantization am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit post-training-quantization getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
SOTA Low-Bit-LLM-Quantisierung (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) und Sparsity; führende Modellkompressionstechniken für PyTorch, TensorFlow und ONNX Runtime
★ 2.706+0Sterne-Änderung der letzten 7 Tage - #2
micronet, eine Bibliothek für Modellkomprimierung und Deployment. Komprimierung: 1. Quantisierung: Quantization-Aware-Training (QAT), High-Bit (>2b) (DoReFa/Quantization and Training of Neural Networks for Efficient Integer-Arithmetic-Only Inference), Low-Bit (≤2b)/Ternär und Binär (TWN/BNN/XNOR-Net); Post-Training-Quantisierung (PTQ), 8-Bit (tensorrt); 2. Pruning: normales, reguläres und gruppenbasiertes Faltungskanal-Pruning; 3. grou
★ 2.265-1Sterne-Änderung der letzten 7 Tage - #3
TinyNeuralNetwork ist ein effizientes und einfach zu bedienendes Framework zur Komprimierung von Deep-Learning-Modellen.
★ 879-1Sterne-Änderung der letzten 7 Tage - #4
[ICML 2024] SqueezeLLM: Dense-and-Sparse Quantization
★ 724+1Sterne-Änderung der letzten 7 Tage