flash-attention
Repositori open source terpantau bertanda flash-attention, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan flash-attention di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda flash-attention.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1
Repositori resmi Qwen (通义千问), model bahasa besar chat & pra-latih yang diusulkan oleh Alibaba Cloud.
★ 21.688+32Perubahan bintang dalam 7 hari terakhir - #2
Catatan belajar CUDA modern dengan PyTorch untuk pemula, 200+ CUDA Kernel, Tensor Cores, HGEMM, FA-2 MMA.
★ 11.875+39Perubahan bintang dalam 7 hari terakhir - #3★ 7.277+8Perubahan bintang dalam 7 hari terakhir
- #4
Proyek fase kedua model besar LLaMA-2 & Alpaca-2 bahasa Mandarin + model konteks super panjang 64K
★ 7.120+0Perubahan bintang dalam 7 hari terakhir - #5
Daftar pilihan makalah inferensi LLM/VLM dengan kode: Flash-Attention, Paged-Attention, WINT8/4, Paralelisme, dll.
★ 5.482+4Perubahan bintang dalam 7 hari terakhir - #6★ 2.174+5Perubahan bintang dalam 7 hari terakhir
- #7
Frontend cuDNN adalah titik masuk modern dan sumber terbuka milik NVIDIA ke perpustakaan cuDNN serta kumpulan kernel sumber terbuka performa tinggi yang terus berkembang.
★ 925+7Perubahan bintang dalam 7 hari terakhir - #8
rCM & Causal-rCM: Algoritma/Infrastruktur Utama dan Terpadu untuk Distilasi Difusi Video Dua Arah/Autoregresif dalam Skala Besar
★ 800+6Perubahan bintang dalam 7 hari terakhir - #9
Sparse attention yang dapat dilatih, cepat, dan efisien dalam penggunaan memori
★ 760+9Perubahan bintang dalam 7 hari terakhir - #10
Dari guru ke tile — mesin distilasi & penyajian LLM dari awal: kernel Triton/CUDA kustom, distilasi FSDP, batching kontinu paged-KV, dekoding spekulatif, gateway Rust, oracle JAX, dan alat interpretabilitas.
★ 566+46Perubahan bintang dalam 7 hari terakhir