cuda-kernels
Các kho mã nguồn mở đang theo dõi được gắn thẻ cuda-kernels, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng cuda-kernels trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ cuda-kernels.
Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.
- #1
Ghi chú học tập CUDA hiện đại với PyTorch dành cho người mới bắt đầu, hơn 200 CUDA Kernel, Tensor Cores, HGEMM, FA-2 MMA.
★ 11.875+25Thay đổi số sao trong 7 ngày qua - #2
Các mẫu dành cho nhà phát triển CUDA minh họa các tính năng trong CUDA Toolkit
★ 9.585+19Thay đổi số sao trong 7 ngày qua - #3★ 8.041+8Thay đổi số sao trong 7 ngày qua
- #4
Hệ sinh thái các thư viện và công cụ để viết và thực thi mã GPU nhanh hoàn toàn bằng Rust.
★ 5.334+3Thay đổi số sao trong 7 ngày qua - #5★ 2.829+16Thay đổi số sao trong 7 ngày qua
- #6★ 2.500+8Thay đổi số sao trong 7 ngày qua
- #7★ 1.933+0Thay đổi số sao trong 7 ngày qua
- #8★ 1.214-1Thay đổi số sao trong 7 ngày qua
- #9
Một thư viện học máy với API TypeScript và backend Rust. Tương thích CUDA và WebGPU. Được xây dựng để hiểu rõ cách hoạt động bên trong của các mô hình và framework ML.
★ 1.005+8Thay đổi số sao trong 7 ngày qua - #10
cuDNN Frontend là điểm truy cập hiện đại, mã nguồn mở của NVIDIA vào thư viện cuDNN và tập hợp ngày càng phát triển các kernel mã nguồn mở hiệu năng cao.
★ 931+11Thay đổi số sao trong 7 ngày qua - #11★ 925+1Thay đổi số sao trong 7 ngày qua
- #12
Công cụ suy luận LLM bằng Rust thuần + CUDA — không cần PyTorch, tương thích với OpenAI, hỗ trợ từ Qwen3 đến Kimi-K2.
★ 677+14Thay đổi số sao trong 7 ngày qua - #13
FlashRT là công cụ suy luận thời gian thực hiệu năng cao cho các tác vụ AI có độ trễ thấp và batch nhỏ. Tích hợp chủ đạo bao gồm điều khiển VLA sản xuất cho Pi0, Pi0.5, GROOT N1.6 và Pi0-FAST. Ngoài ra còn hỗ trợ LLM như qwen3.6-27B
★ 550+11Thay đổi số sao trong 7 ngày qua