본문으로 건너뛰기
buildradar
Sign in
토픽 · flash-attention

flash-attention

flash-attention 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
10
총 스타
58,661
평균 스타
5,866
비중
0.00%

같은 리포지토리에 flash-attention 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 flash-attention 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • Qwen@QwenLM

    Alibaba Cloud가 제안한 Qwen(통의천문) 채팅 및 사전 학습된 대규모 언어 모델의 공식 저장소.

    21,688+14최근 7일 스타 변화
  • LeetCUDA@xlite-dev

    초보자를 위한 PyTorch 기반 최신 CUDA 학습 노트, 200개 이상의 CUDA 커널, Tensor Cores, HGEMM, FA-2 MMA.

    11,875+25최근 7일 스타 변화
  • InternLM@InternLM

    InternLM 시리즈 공식 릴리스 (InternLM, InternLM2, InternLM2.5, InternLM3).

    7,277+4최근 7일 스타 변화
  • 중국어 LLaMA-2 & Alpaca-2 대형 언어 모델 2기 프로젝트 + 64K 초장문 컨텍스트 모델

    7,120+0최근 7일 스타 변화
  • Awesome-LLM-Inference@xlite-dev

    📚 코드와 함께 제공되는 엄선된 Awesome LLM/VLM 추론 논문 목록: Flash-Attention, Paged-Attention, WINT8/4, 병렬화 등 🎉

    5,482+3최근 7일 스타 변화
  • MoBA@MoonshotAI

    MoBA: 롱 컨텍스트 LLM을 위한 블록 어텐션의 혼합 (Mixture of Block Attention)

    2,174+1최근 7일 스타 변화
  • cudnn-frontend@NVIDIA

    cuDNN Frontend는 NVIDIA의 현대적인 오픈 소스 cuDNN 라이브러리 진입점이자 고성능 오픈 소스 커널의 성장하는 컬렉션입니다.

    929+11최근 7일 스타 변화
  • rcm@NVlabs

    대규모 양방향/자기회귀 비디오 확산 증류를 위한 선도적이고 통합된 알고리즘 및 인프라 rCM & Causal-rCM

    800+6최근 7일 스타 변화
  • 학습 가능하고 빠르며 메모리 효율적인 희소 어텐션(sparse attention)

    760+11최근 7일 스타 변화
  • tessera@zengxiao-he

    교사 모델에서 타일 모델까지 — 처음부터 구현한 LLM 증류 및 서빙 엔진: 커스텀 Triton/CUDA 커널, FSDP 증류, 페이징된 KV 연속 배치, 추측 디코딩, Rust 게이트웨이, JAX 오라클, 해석 가능성 도구를 포함합니다.

    566+30최근 7일 스타 변화
← 토픽 목록으로