Cuda
주 언어가 Cuda인 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #31raft@NVIDIA
RAFT는 머신러닝 및 정보 검색을 위한 기본적이고 널리 사용되는 알고리즘과 프리미티브를 포함합니다. 이 알고리즘들은 CUDA로 가속되며 고성능 애플리케이션을 더 쉽게 작성할 수 있는 구성 요소를 형성합니다.
★ 1,037+1최근 7일 스타 변화 - #32cuopt@NVIDIA
GPU 가속 결정 최적화
★ 1,032+11최근 7일 스타 변화 - #33NKSR@nv-tlabs
[CVPR 2023 Highlight] 뉴럴 커널 표면 재구성
★ 986+1최근 7일 스타 변화 - #34CudaSift@Celebrandil
NVIDIA GPU용 SIFT의 CUDA 구현 (GTX 1060에서 1.2ms)
★ 953+2최근 7일 스타 변화 - #35nvbench@NVIDIA
CUDA Kernel 벤치마킹 라이브러리
★ 924+4최근 7일 스타 변화 - #36multi-gpu-programming-models@NVIDIA
단일 노드 또는 클러스터에서 여러 GPU를 프로그래밍하기 위한 사용 가능한 옵션을 보여주는 예제
★ 911+0최근 7일 스타 변화 - #37tron@NovaCodeu
USDT 지갑 예쁜 주소 생성기, Trx 예쁜 주소, TRON GPU 기반 예쁜 주소 소스 코드, TRON 지갑 예쁜 주소 생성, TRON 주소 예쁜 주소 생성기
★ 869+1최근 7일 스타 변화 - #38lietorch@princeton-vl★ 853+2최근 7일 스타 변화
- #39cuvs@NVIDIA
cuVS - GPU 기반 벡터 검색 및 클러스터링 라이브러리
★ 841+3최근 7일 스타 변화 - #40GPUMD@brucefan1983
GPU 분자 동역학
★ 828+1최근 7일 스타 변화 - #41NeuS2@19reborn
[ICCV 2023] NeuS2 공식 코드
★ 736+1최근 7일 스타 변화 - #42AMGX@NVIDIA
GPU 기반 분산 멀티그리드 선형 솔버 라이브러리
★ 690+3최근 7일 스타 변화 - #43ai-infra-hpc@jinbooooom
HPC 튜토리얼: 집합 통신(MPI, NCCL), CUDA 프로그래밍, 벡터화 SIMD, RDMA 통신 등 포함
★ 682+19최근 7일 스타 변화 - #44radfoam@theialab
Radiant Foam: Real-Time Differentiable Ray Tracing 원본 구현체
★ 665+0최근 7일 스타 변화 - #45unet.cu@clu0
순수 CUDA로 구현된 UNet 확산 모델입니다.
★ 663+0최근 7일 스타 변화 - #46cuCollections@NVIDIA★ 661+0최근 7일 스타 변화
- #47recommenders-addons@tensorflow
SIG Recommenders에서 관리하는 추천 시스템 구축을 위한 TensorFlow 확장 유틸리티 및 헬퍼입니다.
★ 636+1최근 7일 스타 변화 - #48GPU@a-hamdi
GPU 커널 빌드 100일 챌린지!
★ 629+1최근 7일 스타 변화 - #49fast.cu@pranjalssh
처음부터 작성된 가장 빠른 커널
★ 615+4최근 7일 스타 변화 - #50gpuRIR@DavidDiazGuerra
GPU 가속을 지원하는 Room Impulse Response (RIR) 시뮬레이션용 Python 라이브러리
★ 611+1최근 7일 스타 변화 - #51DiffPhysDrone@HenryHuYu
Nature Machine Intelligence 게재! 미분 가능한 물리 기반 학습을 활용한 최초의 실제 로봇(쿼드로터)
★ 605+7최근 7일 스타 변화 - #52cudahandbook@ArchaeaSoftware
The CUDA Handbook에 포함된 소스 코드
★ 598+0최근 7일 스타 변화 - #53Parallel-Computing-Cuda-C@CisMine
CUDA 학습 가이드
★ 569+0최근 7일 스타 변화 - #54DarkPose@ilovepose
인체 자세 추정을 위한 분포 인식 좌표 표현
★ 568+1최근 7일 스타 변화 - #55cuda_hgemm@Bruce-Lee-LY
WMMA API 및 MMA PTX 명령어를 사용하여 Tensor Core를 활용한 반정밀도 일반 행렬 곱셈(HGEMM) 최적화 기법
★ 567+1최근 7일 스타 변화 - #56qwen600@yassa9
정적 suckless 단일 배치 CUDA 전용 qwen3-0.6B 미니 추론 엔진
★ 559+0최근 7일 스타 변화 - #57tiny-flash-attention@66RING
Python, Triton, CUDA, CUTLASS로 작성된 Flash Attention 튜토리얼입니다.
★ 532+1최근 7일 스타 변화 - #58megalodon@XuezheMax
Megalodon 7B 모델의 참조 구현
★ 526+0최근 7일 스타 변화 - #59mnist-cuda@Infatoshi★ 515+2최근 7일 스타 변화
- #60BasicCUDA@CalvinXKY
A tutorial for CUDA&PyTorch
★ 507—최근 7일 스타 변화