inference-acceleration
Repositórios de código aberto acompanhados marcados com inference-acceleration, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de inference-acceleration no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com inference-acceleration.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
[ICLR2025, ICML2025, NeurIPS2025 Spotlight] O Quantized Attention alcança uma aceleração de 2 a 5 vezes em comparação ao FlashAttention, sem perda de métricas de ponta a ponta em modelos de linguagem, imagem e vídeo.
★ 3.699+14Variação de estrelas nos últimos 7 dias - #2
TurboDiffusion: aceleração de 100–200× para modelos de difusão de vídeo
★ 3.634+6Variação de estrelas nos últimos 7 dias - #3
Timestep Embedding Tells: É hora de fazer cache para o modelo de difusão de vídeo
★ 1.371+2Variação de estrelas nos últimos 7 dias - #4
[ICML2025] SpargeAttention: Uma atenção esparsa livre de treinamento que acelera a inferência de qualquer modelo.
★ 1.045+1Variação de estrelas nos últimos 7 dias