Cuda
Dépôts open source suivis ayant Cuda pour langage principal, triés par étoiles.
- #31raft@NVIDIA
RAFT contient des algorithmes et des primitives fondamentaux largement utilisés pour l'apprentissage automatique et la recherche d'informations. Les algorithmes sont accélérés par CUDA et constituent des blocs de construction pour faciliter l'écriture d'applications haute performance.
★ 1 037+1Évolution des étoiles sur les 7 derniers jours - #32cuopt@NVIDIA
Optimisation de décision accélérée par GPU
★ 1 032+10Évolution des étoiles sur les 7 derniers jours - #33NKSR@nv-tlabs
[CVPR 2023 Highlight] Reconstruction de surface par noyau neuronal (Neural Kernel Surface Reconstruction).
★ 986+1Évolution des étoiles sur les 7 derniers jours - #34CudaSift@Celebrandil
Implémentation CUDA de SIFT pour les GPU NVidia (1,2 ms sur une GTX 1060)
★ 953+1Évolution des étoiles sur les 7 derniers jours - #35nvbench@NVIDIA
Bibliothèque de benchmarking pour noyaux CUDA
★ 924+3Évolution des étoiles sur les 7 derniers jours - #36multi-gpu-programming-models@NVIDIA
Exemples illustrant les options disponibles pour programmer plusieurs GPU sur un seul nœud ou un cluster
★ 911+1Évolution des étoiles sur les 7 derniers jours - #37tron@NovaCodeu
Générateur d'adresses vanity pour portefeuilles USDT, Trx et TRON, avec code source GPU
★ 869+1Évolution des étoiles sur les 7 derniers jours - #38lietorch@princeton-vl★ 853+2Évolution des étoiles sur les 7 derniers jours
- #39cuvs@NVIDIA
cuVS : une bibliothèque pour la recherche vectorielle et le clustering sur GPU.
★ 841+3Évolution des étoiles sur les 7 derniers jours - #40GPUMD@brucefan1983
Dynamique moléculaire par unités de traitement graphique (GPU)
★ 828+2Évolution des étoiles sur les 7 derniers jours - #41NeuS2@19reborn
[ICCV 2023] Code officiel pour NeuS2
★ 736+1Évolution des étoiles sur les 7 derniers jours - #42AMGX@NVIDIA
Bibliothèque de solveur linéaire multigrille distribuée sur GPU
★ 690+3Évolution des étoiles sur les 7 derniers jours - #43ai-infra-hpc@jinbooooom
Tutoriel HPC, incluant la communication collective (MPI, NCCL), la programmation CUDA, la vectorisation SIMD, la communication RDMA, etc.
★ 682+17Évolution des étoiles sur les 7 derniers jours - #44radfoam@theialab
Implémentation originale de Radiant Foam: Real-Time Differentiable Ray Tracing.
★ 665+0Évolution des étoiles sur les 7 derniers jours - #45unet.cu@clu0
Modèle de diffusion UNet en CUDA pur
★ 663+0Évolution des étoiles sur les 7 derniers jours - #46cuCollections@NVIDIA★ 661+0Évolution des étoiles sur les 7 derniers jours
- #47recommenders-addons@tensorflow
Utilitaires et assistants supplémentaires pour étendre TensorFlow lors de la construction de systèmes de recommandation, contribués et maintenus par SIG Recommenders.
★ 636+1Évolution des étoiles sur les 7 derniers jours - #48GPU@a-hamdi
100 jours de construction de noyaux GPU!
★ 629+1Évolution des étoiles sur les 7 derniers jours - #49fast.cu@pranjalssh
Les kernels les plus rapides écrits de zéro
★ 615+7Évolution des étoiles sur les 7 derniers jours - #50gpuRIR@DavidDiazGuerra
Bibliothèque Python pour la simulation de réponses impulsionnelles de salle (RIR) avec accélération GPU
★ 611+1Évolution des étoiles sur les 7 derniers jours - #51DiffPhysDrone@HenryHuYu
Publié dans Nature Machine Intelligence ! Le premier vrai robot (quadricoptère) basé sur un entraînement par physique différentiable.
★ 605+7Évolution des étoiles sur les 7 derniers jours - #52cudahandbook@ArchaeaSoftware
Code source accompagnant The CUDA Handbook.
★ 598+0Évolution des étoiles sur les 7 derniers jours - #53Parallel-Computing-Cuda-C@CisMine
Guide d'apprentissage CUDA
★ 569+0Évolution des étoiles sur les 7 derniers jours - #54DarkPose@ilovepose
Représentation de coordonnées consciente de la distribution pour l'estimation de pose humaine
★ 568+1Évolution des étoiles sur les 7 derniers jours - #55cuda_hgemm@Bruce-Lee-LY
Plusieurs méthodes d'optimisation de la multiplication de matrices générales en demi-précision (HGEMM) utilisant les tensor cores avec l'API WMMA et l'instruction PTX MMA.
★ 567+1Évolution des étoiles sur les 7 derniers jours - #56qwen600@yassa9
Moteur de mini-inférence statique, suckless, mono-lot (single batch) et exclusivement CUDA pour qwen3-0.6B
★ 559+0Évolution des étoiles sur les 7 derniers jours - #57tiny-flash-attention@66RING
Tutoriel sur flash attention écrit en python, triton, cuda et cutlass.
★ 532+1Évolution des étoiles sur les 7 derniers jours - #58megalodon@XuezheMax
Implémentation de référence du modèle Megalodon 7B
★ 526+0Évolution des étoiles sur les 7 derniers jours - #59mnist-cuda@Infatoshi★ 515+2Évolution des étoiles sur les 7 derniers jours
- #60BasicCUDA@CalvinXKY
A tutorial for CUDA&PyTorch
★ 507—Évolution des étoiles sur les 7 derniers jours