본문으로 건너뛰기
buildradar
Sign in
토픽 · inference-acceleration

inference-acceleration

inference-acceleration 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
4
총 스타
9,747
평균 스타
2,437
비중
0.00%

같은 리포지토리에 inference-acceleration 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 inference-acceleration 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • SageAttention@thu-ml

    [ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention은 언어, 이미지, 비디오 모델 전반에서 엔드투엔드 메트릭 손실 없이 FlashAttention 대비 2~5배의 속도 향상을 달성합니다.

    3,699+14최근 7일 스타 변화
  • TurboDiffusion@thu-ml

    TurboDiffusion: 비디오 디퓨전 모델을 위한 100~200배 가속

    3,634+6최근 7일 스타 변화
  • TeaCache@ali-vilab

    타임스텝 임베딩의 역할: 비디오 디퓨전 모델에서 캐시할 시간임을 알림

    1,371+2최근 7일 스타 변화
  • SpargeAttn@thu-ml

    [ICML2025] SpargeAttention: 모든 모델의 추론을 가속화하는 학습 없는 희소 어텐션(sparse attention).

    1,043+1최근 7일 스타 변화
← 토픽 목록으로