post-training-quantization
Repositorios de código abierto monitorizados etiquetados con post-training-quantization, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a post-training-quantization en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con post-training-quantization.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
Cuantización de LLM de pocos bits SOTA (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) y dispersión; técnicas líderes de compresión de modelos en PyTorch, TensorFlow y ONNX Runtime.
★ 2706+5Variación de estrellas de los últimos 7 días - #2
micronet, una biblioteca de compresión y despliegue de modelos. compresión: 1. cuantificación: entrenamiento consciente de la cuantificación (QAT), de bits altos (>2b) (DoReFa/Quantization and Training of Neural Networks for Efficient Integer-Arithmetic-Only Inference), de bits bajos (≤2b)/ternaria y binaria (TWN/BNN/XNOR-Net); cuantificación posterior al entrenamiento (PTQ), de 8 bits (tensorrt); 2. poda: poda de canales convolucionales normal, regular y por grupos; 3. gru
★ 2265+0Variación de estrellas de los últimos 7 días - #3
TinyNeuralNetwork es un framework de compresión de modelos de aprendizaje profundo eficiente y fácil de usar.
★ 880+1Variación de estrellas de los últimos 7 días - #4
[ICML 2024] SqueezeLLM: Cuantización densa y dispersa
★ 723+0Variación de estrellas de los últimos 7 días