Cuda
Các kho mã nguồn mở đang theo dõi lấy Cuda làm ngôn ngữ chính, sắp xếp theo số sao.
- #31raft@NVIDIA
RAFT chứa các thuật toán cơ bản được sử dụng rộng rãi và các nguyên hàm cho học máy và truy xuất thông tin. Các thuật toán này được tăng tốc bằng CUDA và tạo thành các khối xây dựng để dễ dàng viết các ứng dụng hiệu suất cao hơn.
★ 1.037+1Thay đổi số sao trong 7 ngày qua - #32cuopt@NVIDIA
Tối ưu hóa quyết định được tăng tốc bằng GPU
★ 1.032+11Thay đổi số sao trong 7 ngày qua - #33NKSR@nv-tlabs
[CVPR 2023 Highlight] Tái tạo bề mặt kernel bằng mạng neural.
★ 986+1Thay đổi số sao trong 7 ngày qua - #34CudaSift@Celebrandil
Bản cài đặt CUDA của SIFT dành cho GPU NVidia (1.2 ms trên GTX 1060)
★ 953+2Thay đổi số sao trong 7 ngày qua - #35nvbench@NVIDIA
Thư viện benchmark CUDA Kernel
★ 924+4Thay đổi số sao trong 7 ngày qua - #36multi-gpu-programming-models@NVIDIA
Các ví dụ minh họa những tùy chọn có sẵn để lập trình nhiều GPU trong một node hoặc một cluster
★ 911+0Thay đổi số sao trong 7 ngày qua - #37tron@NovaCodeu
Trình tạo mã ví đẹp USDT, mã đẹp TRX, mã nguồn GPU TRON, trình tạo mã ví TRON, trình tạo địa chỉ đẹp TRON.
★ 869+1Thay đổi số sao trong 7 ngày qua - #38lietorch@princeton-vl★ 853+2Thay đổi số sao trong 7 ngày qua
- #39cuvs@NVIDIA
cuVS - thư viện tìm kiếm vector và phân cụm trên GPU
★ 841+3Thay đổi số sao trong 7 ngày qua - #40GPUMD@brucefan1983
Động lực học phân tử trên đơn vị xử lý đồ họa (GPU)
★ 828+1Thay đổi số sao trong 7 ngày qua - #41NeuS2@19reborn
[ICCV 2023] Mã nguồn chính thức cho NeuS2
★ 736+1Thay đổi số sao trong 7 ngày qua - #42AMGX@NVIDIA
Thư viện giải phương trình tuyến tính đa lưới phân tán trên GPU
★ 690+3Thay đổi số sao trong 7 ngày qua - #43ai-infra-hpc@jinbooooom
Hướng dẫn HPC, bao gồm giao tiếp tập thể (MPI, NCCL), lập trình CUDA, vector hóa SIMD, giao tiếp RDMA, v.v.
★ 682+19Thay đổi số sao trong 7 ngày qua - #44radfoam@theialab
Triển khai gốc của "Radiant Foam: Real-Time Differentiable Ray Tracing".
★ 665+0Thay đổi số sao trong 7 ngày qua - #45unet.cu@clu0
Mô hình khuếch tán UNet viết bằng CUDA thuần
★ 663+0Thay đổi số sao trong 7 ngày qua - #46cuCollections@NVIDIA★ 661+0Thay đổi số sao trong 7 ngày qua
- #47recommenders-addons@tensorflow
Các tiện ích và công cụ bổ sung để mở rộng TensorFlow khi xây dựng hệ thống gợi ý, được đóng góp và duy trì bởi SIG Recommenders.
★ 636+1Thay đổi số sao trong 7 ngày qua - #48GPU@a-hamdi
100 ngày xây dựng các GPU kernel!
★ 629+1Thay đổi số sao trong 7 ngày qua - #49fast.cu@pranjalssh
Các kernel nhanh nhất được viết từ đầu
★ 615+4Thay đổi số sao trong 7 ngày qua - #50gpuRIR@DavidDiazGuerra
Thư viện Python mô phỏng Phản hồi xung phòng (RIR) với khả năng tăng tốc GPU
★ 611+1Thay đổi số sao trong 7 ngày qua - #51DiffPhysDrone@HenryHuYu
Đã được xuất bản trên Nature Machine Intelligence! Robot thực tế (quadrotor) đầu tiên dựa trên huấn luyện vật lý có thể tính đạo hàm.
★ 605+7Thay đổi số sao trong 7 ngày qua - #52cudahandbook@ArchaeaSoftware
Mã nguồn đi kèm với The CUDA Handbook
★ 598+0Thay đổi số sao trong 7 ngày qua - #53Parallel-Computing-Cuda-C@CisMine
Hướng dẫn học CUDA
★ 569+0Thay đổi số sao trong 7 ngày qua - #54DarkPose@ilovepose
Biểu diễn tọa độ nhận biết phân phối cho ước tính tư thế người.
★ 568+1Thay đổi số sao trong 7 ngày qua - #55cuda_hgemm@Bruce-Lee-LY
Một số phương pháp tối ưu hóa phép nhân ma trận bán chính xác (HGEMM) sử dụng tensor core với WMMA API và lệnh MMA PTX
★ 567+1Thay đổi số sao trong 7 ngày qua - #56qwen600@yassa9
Công cụ suy luận mini qwen3-0.6B tĩnh, chạy trên CUDA, không cần phụ thuộc
★ 559+0Thay đổi số sao trong 7 ngày qua - #57tiny-flash-attention@66RING
Hướng dẫn flash attention viết bằng python, triton, cuda, cutlass
★ 532+1Thay đổi số sao trong 7 ngày qua - #58megalodon@XuezheMax
Triển khai tham chiếu của mô hình Megalodon 7B.
★ 526+0Thay đổi số sao trong 7 ngày qua - #59mnist-cuda@Infatoshi★ 515+2Thay đổi số sao trong 7 ngày qua
- #60BasicCUDA@CalvinXKY
Hướng dẫn về CUDA và PyTorch
★ 507—Thay đổi số sao trong 7 ngày qua