quantization-aware-training
Repositorios de código abierto monitorizados etiquetados con quantization-aware-training, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a quantization-aware-training en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con quantization-aware-training.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
Cuantización de LLM de pocos bits SOTA (INT8/FP8/MXFP8/INT4/MXFP4/NVFP4) y dispersión; técnicas líderes de compresión de modelos en PyTorch, TensorFlow y ONNX Runtime.
★ 2706+0Variación de estrellas de los últimos 7 días - #2
micronet, una biblioteca de compresión y despliegue de modelos. compresión: 1. cuantificación: entrenamiento consciente de la cuantificación (QAT), de bits altos (>2b) (DoReFa/Quantization and Training of Neural Networks for Efficient Integer-Arithmetic-Only Inference), de bits bajos (≤2b)/ternaria y binaria (TWN/BNN/XNOR-Net); cuantificación posterior al entrenamiento (PTQ), de 8 bits (tensorrt); 2. poda: poda de canales convolucionales normal, regular y por grupos; 3. gru
★ 2265-1Variación de estrellas de los últimos 7 días - #3
Marco de compresión de redes neuronales para una inferencia mejorada con OpenVINO™.
★ 1197+4Variación de estrellas de los últimos 7 días - #4
TinyNeuralNetwork es un framework de compresión de modelos de aprendizaje profundo eficiente y fácil de usar.
★ 879-1Variación de estrellas de los últimos 7 días