Cuda
Repositórios de código aberto acompanhados que têm Cuda como linguagem principal, ordenados por estrelas.
- #31raft@NVIDIA
O RAFT contém algoritmos e primitivas fundamentais amplamente utilizados para aprendizado de máquina e recuperação de informações. Os algoritmos são acelerados por CUDA e formam blocos de construção para facilitar a escrita de aplicações de alto desempenho.
★ 1.037+1Variação de estrelas nos últimos 7 dias - #32cuopt@NVIDIA
Otimização de decisão acelerada por GPU
★ 1.032+11Variação de estrelas nos últimos 7 dias - #33NKSR@nv-tlabs
[CVPR 2023 Highlight] Reconstrução de Superfície por Kernel Neural
★ 986+1Variação de estrelas nos últimos 7 dias - #34CudaSift@Celebrandil
Uma implementação CUDA do SIFT para GPUs NVidia (1,2 ms em uma GTX 1060)
★ 953+2Variação de estrelas nos últimos 7 dias - #35nvbench@NVIDIA
Biblioteca de benchmarking de Kernel CUDA.
★ 924+4Variação de estrelas nos últimos 7 dias - #36multi-gpu-programming-models@NVIDIA
Exemplos que demonstram as opções disponíveis para programar múltiplas GPUs em um único nó ou cluster
★ 911+0Variação de estrelas nos últimos 7 dias - #37tron@NovaCodeu
Gerador de carteira USDT vanity, TRX vanity, código-fonte de vanity GPU Tron, gerador de carteira TRON vanity, gerador de endereços vanity Tron
★ 869+1Variação de estrelas nos últimos 7 dias - #38lietorch@princeton-vl★ 853+2Variação de estrelas nos últimos 7 dias
- #39cuvs@NVIDIA
cuVS - uma biblioteca para busca vetorial e agrupamento em GPU
★ 841+3Variação de estrelas nos últimos 7 dias - #40GPUMD@brucefan1983
Dinâmica molecular com Unidades de Processamento Gráfico (GPUs)
★ 828+1Variação de estrelas nos últimos 7 dias - #41NeuS2@19reborn
[ICCV 2023] Código oficial para o NeuS2
★ 736+1Variação de estrelas nos últimos 7 dias - #42AMGX@NVIDIA
Biblioteca de resolução linear multigrid distribuída em GPU
★ 690+3Variação de estrelas nos últimos 7 dias - #43ai-infra-hpc@jinbooooom
Tutorial de HPC, incluindo comunicação coletiva (MPI, NCCL), programação CUDA, vetorização SIMD, comunicação RDMA, etc.
★ 682+19Variação de estrelas nos últimos 7 dias - #44radfoam@theialab
Implementação original de "Radiant Foam: Real-Time Differentiable Ray Tracing"
★ 665+0Variação de estrelas nos últimos 7 dias - #45unet.cu@clu0
Modelo de difusão UNet em CUDA puro
★ 663+0Variação de estrelas nos últimos 7 dias - #46cuCollections@NVIDIA★ 661+0Variação de estrelas nos últimos 7 dias
- #47recommenders-addons@tensorflow
Utilitários e auxiliares adicionais para estender o TensorFlow ao construir sistemas de recomendação, contribuídos e mantidos pelo SIG Recommenders.
★ 636+1Variação de estrelas nos últimos 7 dias - #48GPU@a-hamdi
100 dias construindo kernels de GPU!
★ 629+1Variação de estrelas nos últimos 7 dias - #49fast.cu@pranjalssh
Kernels mais rápidos escritos do zero
★ 615+4Variação de estrelas nos últimos 7 dias - #50gpuRIR@DavidDiazGuerra
Biblioteca Python para simulação de Resposta ao Impulso de Sala (RIR) com aceleração por GPU
★ 611+1Variação de estrelas nos últimos 7 dias - #51DiffPhysDrone@HenryHuYu
Publicado na Nature Machine Intelligence! O primeiro robô real (quadricóptero) baseado em treinamento de física diferenciável.
★ 605+7Variação de estrelas nos últimos 7 dias - #52cudahandbook@ArchaeaSoftware
Código-fonte que acompanha o The CUDA Handbook.
★ 598+0Variação de estrelas nos últimos 7 dias - #53Parallel-Computing-Cuda-C@CisMine
Guia de aprendizado de CUDA
★ 569+0Variação de estrelas nos últimos 7 dias - #54DarkPose@ilovepose
Representação de coordenadas cientes da distribuição para estimativa de pose humana.
★ 568+1Variação de estrelas nos últimos 7 dias - #55cuda_hgemm@Bruce-Lee-LY
Vários métodos de otimização de multiplicação de matrizes gerais de meia precisão (HGEMM) usando tensor core com a API WMMA e a instrução MMA PTX.
★ 567+1Variação de estrelas nos últimos 7 dias - #56qwen600@yassa9
Mini motor de inferência estático e suckless para qwen3-0.6B, lote único (single batch) e exclusivo para CUDA.
★ 559+0Variação de estrelas nos últimos 7 dias - #57tiny-flash-attention@66RING
Tutorial de flash attention escrito em Python, Triton, CUDA e CUTLASS.
★ 532+1Variação de estrelas nos últimos 7 dias - #58megalodon@XuezheMax
Implementação de referência do modelo Megalodon 7B
★ 526+0Variação de estrelas nos últimos 7 dias - #59mnist-cuda@Infatoshi★ 515+2Variação de estrelas nos últimos 7 dias
- #60BasicCUDA@CalvinXKY
Um tutorial para CUDA e PyTorch
★ 507—Variação de estrelas nos últimos 7 dias