quantization-aware-training
Repositórios de código aberto acompanhados marcados com quantization-aware-training, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de quantization-aware-training no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com quantization-aware-training.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Quantização SOTA de LLM de baixo bit (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) e esparsidade; técnicas líderes de compressão de modelos em PyTorch, TensorFlow e ONNX Runtime.
★ 2.706+2Variação de estrelas nos últimos 7 dias - #2
micronet, uma biblioteca de compressão e implantação de modelos. Compressão: 1. Quantização: QAT, High-Bit (>2b), Low-Bit (≤2b)/Ternary e Binary (TWN/BNN/XNOR-Net); PTQ, 8-bit (tensorrt); 2. Poda: normal, regular e poda de canal convolucional em grupo.
★ 2.265-1Variação de estrelas nos últimos 7 dias - #3
Framework de compressão de redes neurais para inferência aprimorada com OpenVINO™
★ 1.197+4Variação de estrelas nos últimos 7 dias - #4
TinyNeuralNetwork é um framework de compressão de modelos de deep learning eficiente e fácil de usar.
★ 879+0Variação de estrelas nos últimos 7 dias