post-training-quantization
Repositórios de código aberto acompanhados marcados com post-training-quantization, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de post-training-quantization no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com post-training-quantization.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Quantização SOTA de LLM de baixo bit (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) e esparsidade; técnicas líderes de compressão de modelos em PyTorch, TensorFlow e ONNX Runtime.
★ 2.706+0Variação de estrelas nos últimos 7 dias - #2
micronet, uma biblioteca de compressão e implantação de modelos. Compressão: 1. Quantização: QAT, High-Bit (>2b), Low-Bit (≤2b)/Ternary e Binary (TWN/BNN/XNOR-Net); PTQ, 8-bit (tensorrt); 2. Poda: normal, regular e poda de canal convolucional em grupo.
★ 2.265-1Variação de estrelas nos últimos 7 dias - #3
TinyNeuralNetwork é um framework de compressão de modelos de deep learning eficiente e fácil de usar.
★ 879-1Variação de estrelas nos últimos 7 dias - #4
[ICML 2024] SqueezeLLM: Quantização densa e esparsa
★ 724+1Variação de estrelas nos últimos 7 dias