inference-acceleration
Repositorios de código abierto monitorizados etiquetados con inference-acceleration, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a inference-acceleration en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con inference-acceleration.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
[ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention logra una aceleración de 2 a 5 veces en comparación con FlashAttention, sin perder métricas de extremo a extremo en modelos de lenguaje, imagen y video.
★ 3699+14Variación de estrellas de los últimos 7 días - #2
TurboDiffusion: Aceleración de 100 a 200 veces para modelos de difusión de video
★ 3634+6Variación de estrellas de los últimos 7 días - #3
Timestep Embedding Tells: Es hora de implementar caché para modelos de difusión de video.
★ 1371+2Variación de estrellas de los últimos 7 días - #4
[ICML2025] SpargeAttention: una atención dispersa sin entrenamiento que acelera la inferencia de cualquier modelo.
★ 1043+1Variación de estrellas de los últimos 7 días