Pular para o conteúdo principal
buildradar
Sign in
Tópico · inference-acceleration

inference-acceleration

Repositórios de código aberto acompanhados marcados com inference-acceleration, ordenados por estrelas.

Repositórios
4
Total de estrelas
9.747
Média de estrelas
2.437
Participação
0,00%

Tópicos que aparecem com frequência ao lado de inference-acceleration no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com inference-acceleration.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • SageAttention@thu-ml

    [ICLR2025, ICML2025, NeurIPS2025 Spotlight] O Quantized Attention alcança uma aceleração de 2 a 5 vezes em comparação ao FlashAttention, sem perda de métricas de ponta a ponta em modelos de linguagem, imagem e vídeo.

    3.699+14Variação de estrelas nos últimos 7 dias
  • TurboDiffusion@thu-ml

    TurboDiffusion: aceleração de 100–200× para modelos de difusão de vídeo

    3.634+6Variação de estrelas nos últimos 7 dias
  • TeaCache@ali-vilab

    Timestep Embedding Tells: É hora de fazer cache para o modelo de difusão de vídeo

    1.371+2Variação de estrelas nos últimos 7 dias
  • SpargeAttn@thu-ml

    [ICML2025] SpargeAttention: Uma atenção esparsa livre de treinamento que acelera a inferência de qualquer modelo.

    1.045+1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos