Aller au contenu principal
Github-star-radar
Langage · Cuda

Cuda

Dépôts open source suivis ayant Cuda pour langage principal, triés par étoiles.

61 dépôts
  • raft@NVIDIA

    RAFT contient des algorithmes et des primitives fondamentaux largement utilisés pour l'apprentissage automatique et la recherche d'informations. Les algorithmes sont accélérés par CUDA et constituent des blocs de construction pour faciliter l'écriture d'applications haute performance.

    1 037+1Évolution des étoiles sur les 7 derniers jours
  • cuopt@NVIDIA

    Optimisation de décision accélérée par GPU

    1 032+10Évolution des étoiles sur les 7 derniers jours
  • NKSR@nv-tlabs

    [CVPR 2023 Highlight] Reconstruction de surface par noyau neuronal (Neural Kernel Surface Reconstruction).

    986+1Évolution des étoiles sur les 7 derniers jours
  • CudaSift@Celebrandil

    Implémentation CUDA de SIFT pour les GPU NVidia (1,2 ms sur une GTX 1060)

    953+1Évolution des étoiles sur les 7 derniers jours
  • nvbench@NVIDIA

    Bibliothèque de benchmarking pour noyaux CUDA

    924+3Évolution des étoiles sur les 7 derniers jours
  • Exemples illustrant les options disponibles pour programmer plusieurs GPU sur un seul nœud ou un cluster

    911+1Évolution des étoiles sur les 7 derniers jours
  • tron@NovaCodeu

    Générateur d'adresses vanity pour portefeuilles USDT, Trx et TRON, avec code source GPU

    869+1Évolution des étoiles sur les 7 derniers jours
  • lietorch@princeton-vl
    853+2Évolution des étoiles sur les 7 derniers jours
  • cuvs@NVIDIA

    cuVS : une bibliothèque pour la recherche vectorielle et le clustering sur GPU.

    841+3Évolution des étoiles sur les 7 derniers jours
  • GPUMD@brucefan1983

    Dynamique moléculaire par unités de traitement graphique (GPU)

    828+2Évolution des étoiles sur les 7 derniers jours
  • NeuS2@19reborn

    [ICCV 2023] Code officiel pour NeuS2

    736+1Évolution des étoiles sur les 7 derniers jours
  • AMGX@NVIDIA

    Bibliothèque de solveur linéaire multigrille distribuée sur GPU

    690+3Évolution des étoiles sur les 7 derniers jours
  • ai-infra-hpc@jinbooooom

    Tutoriel HPC, incluant la communication collective (MPI, NCCL), la programmation CUDA, la vectorisation SIMD, la communication RDMA, etc.

    682+17Évolution des étoiles sur les 7 derniers jours
  • radfoam@theialab

    Implémentation originale de Radiant Foam: Real-Time Differentiable Ray Tracing.

    665+0Évolution des étoiles sur les 7 derniers jours
  • unet.cu@clu0

    Modèle de diffusion UNet en CUDA pur

    663+0Évolution des étoiles sur les 7 derniers jours
  • cuCollections@NVIDIA
    661+0Évolution des étoiles sur les 7 derniers jours
  • recommenders-addons@tensorflow

    Utilitaires et assistants supplémentaires pour étendre TensorFlow lors de la construction de systèmes de recommandation, contribués et maintenus par SIG Recommenders.

    636+1Évolution des étoiles sur les 7 derniers jours
  • GPU@a-hamdi

    100 jours de construction de noyaux GPU!

    629+1Évolution des étoiles sur les 7 derniers jours
  • fast.cu@pranjalssh

    Les kernels les plus rapides écrits de zéro

    615+7Évolution des étoiles sur les 7 derniers jours
  • gpuRIR@DavidDiazGuerra

    Bibliothèque Python pour la simulation de réponses impulsionnelles de salle (RIR) avec accélération GPU

    611+1Évolution des étoiles sur les 7 derniers jours
  • DiffPhysDrone@HenryHuYu

    Publié dans Nature Machine Intelligence ! Le premier vrai robot (quadricoptère) basé sur un entraînement par physique différentiable.

    605+7Évolution des étoiles sur les 7 derniers jours
  • cudahandbook@ArchaeaSoftware

    Code source accompagnant The CUDA Handbook.

    598+0Évolution des étoiles sur les 7 derniers jours
  • Guide d'apprentissage CUDA

    569+0Évolution des étoiles sur les 7 derniers jours
  • DarkPose@ilovepose

    Représentation de coordonnées consciente de la distribution pour l'estimation de pose humaine

    568+1Évolution des étoiles sur les 7 derniers jours
  • cuda_hgemm@Bruce-Lee-LY

    Plusieurs méthodes d'optimisation de la multiplication de matrices générales en demi-précision (HGEMM) utilisant les tensor cores avec l'API WMMA et l'instruction PTX MMA.

    567+1Évolution des étoiles sur les 7 derniers jours
  • qwen600@yassa9

    Moteur de mini-inférence statique, suckless, mono-lot (single batch) et exclusivement CUDA pour qwen3-0.6B

    559+0Évolution des étoiles sur les 7 derniers jours
  • Tutoriel sur flash attention écrit en python, triton, cuda et cutlass.

    532+1Évolution des étoiles sur les 7 derniers jours
  • megalodon@XuezheMax

    Implémentation de référence du modèle Megalodon 7B

    526+0Évolution des étoiles sur les 7 derniers jours
  • mnist-cuda@Infatoshi
    515+2Évolution des étoiles sur les 7 derniers jours
  • BasicCUDA@CalvinXKY

    A tutorial for CUDA&PyTorch

    507Évolution des étoiles sur les 7 derniers jours
← Retour aux langages