Pular para o conteúdo principal
Github-star-radar
Linguagem · Cuda

Cuda

Repositórios de código aberto acompanhados que têm Cuda como linguagem principal, ordenados por estrelas.

61 repositórios
  • raft@NVIDIA

    O RAFT contém algoritmos e primitivas fundamentais amplamente utilizados para aprendizado de máquina e recuperação de informações. Os algoritmos são acelerados por CUDA e formam blocos de construção para facilitar a escrita de aplicações de alto desempenho.

    1.037+1Variação de estrelas nos últimos 7 dias
  • cuopt@NVIDIA

    Otimização de decisão acelerada por GPU

    1.032+11Variação de estrelas nos últimos 7 dias
  • NKSR@nv-tlabs

    [CVPR 2023 Highlight] Reconstrução de Superfície por Kernel Neural

    986+1Variação de estrelas nos últimos 7 dias
  • CudaSift@Celebrandil

    Uma implementação CUDA do SIFT para GPUs NVidia (1,2 ms em uma GTX 1060)

    953+2Variação de estrelas nos últimos 7 dias
  • nvbench@NVIDIA

    Biblioteca de benchmarking de Kernel CUDA.

    924+4Variação de estrelas nos últimos 7 dias
  • Exemplos que demonstram as opções disponíveis para programar múltiplas GPUs em um único nó ou cluster

    911+0Variação de estrelas nos últimos 7 dias
  • tron@NovaCodeu

    Gerador de carteira USDT vanity, TRX vanity, código-fonte de vanity GPU Tron, gerador de carteira TRON vanity, gerador de endereços vanity Tron

    869+1Variação de estrelas nos últimos 7 dias
  • lietorch@princeton-vl
    853+2Variação de estrelas nos últimos 7 dias
  • cuvs@NVIDIA

    cuVS - uma biblioteca para busca vetorial e agrupamento em GPU

    841+3Variação de estrelas nos últimos 7 dias
  • GPUMD@brucefan1983

    Dinâmica molecular com Unidades de Processamento Gráfico (GPUs)

    828+1Variação de estrelas nos últimos 7 dias
  • NeuS2@19reborn

    [ICCV 2023] Código oficial para o NeuS2

    736+1Variação de estrelas nos últimos 7 dias
  • AMGX@NVIDIA

    Biblioteca de resolução linear multigrid distribuída em GPU

    690+3Variação de estrelas nos últimos 7 dias
  • ai-infra-hpc@jinbooooom

    Tutorial de HPC, incluindo comunicação coletiva (MPI, NCCL), programação CUDA, vetorização SIMD, comunicação RDMA, etc.

    682+19Variação de estrelas nos últimos 7 dias
  • radfoam@theialab

    Implementação original de "Radiant Foam: Real-Time Differentiable Ray Tracing"

    665+0Variação de estrelas nos últimos 7 dias
  • unet.cu@clu0

    Modelo de difusão UNet em CUDA puro

    663+0Variação de estrelas nos últimos 7 dias
  • cuCollections@NVIDIA
    661+0Variação de estrelas nos últimos 7 dias
  • recommenders-addons@tensorflow

    Utilitários e auxiliares adicionais para estender o TensorFlow ao construir sistemas de recomendação, contribuídos e mantidos pelo SIG Recommenders.

    636+1Variação de estrelas nos últimos 7 dias
  • GPU@a-hamdi

    100 dias construindo kernels de GPU!

    629+1Variação de estrelas nos últimos 7 dias
  • fast.cu@pranjalssh

    Kernels mais rápidos escritos do zero

    615+4Variação de estrelas nos últimos 7 dias
  • gpuRIR@DavidDiazGuerra

    Biblioteca Python para simulação de Resposta ao Impulso de Sala (RIR) com aceleração por GPU

    611+1Variação de estrelas nos últimos 7 dias
  • DiffPhysDrone@HenryHuYu

    Publicado na Nature Machine Intelligence! O primeiro robô real (quadricóptero) baseado em treinamento de física diferenciável.

    605+7Variação de estrelas nos últimos 7 dias
  • cudahandbook@ArchaeaSoftware

    Código-fonte que acompanha o The CUDA Handbook.

    598+0Variação de estrelas nos últimos 7 dias
  • Guia de aprendizado de CUDA

    569+0Variação de estrelas nos últimos 7 dias
  • DarkPose@ilovepose

    Representação de coordenadas cientes da distribuição para estimativa de pose humana.

    568+1Variação de estrelas nos últimos 7 dias
  • cuda_hgemm@Bruce-Lee-LY

    Vários métodos de otimização de multiplicação de matrizes gerais de meia precisão (HGEMM) usando tensor core com a API WMMA e a instrução MMA PTX.

    567+1Variação de estrelas nos últimos 7 dias
  • qwen600@yassa9

    Mini motor de inferência estático e suckless para qwen3-0.6B, lote único (single batch) e exclusivo para CUDA.

    559+0Variação de estrelas nos últimos 7 dias
  • Tutorial de flash attention escrito em Python, Triton, CUDA e CUTLASS.

    532+1Variação de estrelas nos últimos 7 dias
  • megalodon@XuezheMax

    Implementação de referência do modelo Megalodon 7B

    526+0Variação de estrelas nos últimos 7 dias
  • mnist-cuda@Infatoshi
    515+2Variação de estrelas nos últimos 7 dias
  • BasicCUDA@CalvinXKY

    Um tutorial para CUDA e PyTorch

    507Variação de estrelas nos últimos 7 dias
← Voltar para as linguagens