cuda
cuda 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #181
분산 PyTorch 학습 코드 작성을 위한 모범 사례 및 가이드
★ 631+2최근 7일 스타 변화 - #182★ 622+2최근 7일 스타 변화
- #183
LuisaCompute 기반의 고성능 크로스 플랫폼 몬테카를로 렌더러
★ 618+1최근 7일 스타 변화 - #184★ 616+0최근 7일 스타 변화
- #185
GPU 및 기타 가속기를 위한 AutoDock
★ 610+1최근 7일 스타 변화 - #186★ 604+0최근 7일 스타 변화
- #187
Windows, Linux, MacOS, Google TV, Stremio, Home Assistant 등을 쉽게 설정하기 위한 앱 및 가이드(WSL2, GPU 드라이버 및 개발 도구 포함). 사용자 경험과 생산성을 향상시킵니다.
★ 602+0최근 7일 스타 변화 - #188★ 599+17최근 7일 스타 변화
- #189★ 597+1최근 7일 스타 변화
- #190★ 594+1최근 7일 스타 변화
- #191★ 592+0최근 7일 스타 변화
- #192
NVIDIA NVSHMEM은 OpenSHMEM 기반의 NVIDIA GPU용 병렬 프로그래밍 인터페이스입니다. NVSHMEM은 프로그래머가 CUDA 커널 및 CUDA 스트림 내에서 단방향 통신을 수행할 수 있도록 하여 다중 프로세스 통신 및 조정 오버헤드를 크게 줄일 수 있습니다.
★ 585+4최근 7일 스타 변화 - #193
Python과 C++로 구축된 레이더 시뮬레이터
★ 576+3최근 7일 스타 변화 - #194★ 574+0최근 7일 스타 변화
- #195
신입 채용 및 인턴십을 위한 프로젝트로, LLama2/3 및 Qwen2.5를 지원하는 대규모 언어 모델 추론 프레임워크를 처음부터 직접 구현합니다.
★ 574+0최근 7일 스타 변화 - #196
거대 언어 모델의 성공적인 학습을 돕기 위한 방법론 오픈 컬렉션
★ 569+2최근 7일 스타 변화 - #197
WMMA API 및 MMA PTX 명령어를 사용하여 Tensor Core를 활용한 반정밀도 일반 행렬 곱셈(HGEMM) 최적화 기법
★ 568+0최근 7일 스타 변화 - #198
교사 모델에서 타일 모델까지 — 처음부터 구현한 LLM 증류 및 서빙 엔진: 커스텀 Triton/CUDA 커널, FSDP 증류, 페이징된 KV 연속 배치, 추측 디코딩, Rust 게이트웨이, JAX 오라클, 해석 가능성 도구를 포함합니다.
★ 566+0최근 7일 스타 변화 - #199
FlashRT는 소규모 배치 및 지연 시간에 민감한 AI 워크로드를 위한 고성능 실시간 추론 엔진입니다. Pi0, Pi0.5, GROOT N1.6 및 Pi0-FAST를 위한 프로덕션 VLA 제어를 지원하며, qwen3.6-27B와 같은 LLM도 지원합니다.
★ 562+14최근 7일 스타 변화 - #200★ 560+1최근 7일 스타 변화
- #201
LLM algorithm practice lab with theory, solutions, and test cases.《大模型算法与系统教程》面向大模型入门到进阶的算法实战教程,覆盖原理讲解、答案解析、测试用例与 CUDA/Triton 实战。
★ 559+20최근 7일 스타 변화 - #202
Linux에서 NVIDIA GPU의 VRAM을 스왑 공간으로 사용합니다. 메모리 업그레이드가 불가능한 노트북을 위해 설계되었으며, SSD 스왑 대신 8GB VRAM을 활용할 수 있습니다.
★ 555+4최근 7일 스타 변화 - #203★ 552+2최근 7일 스타 변화
- #204
docker-compose를 사용하는 Slurm 클러스터
★ 544+2최근 7일 스타 변화 - #205★ 532+0최근 7일 스타 변화
- #206
PyTorch를 이용한 Holistically-Nested Edge Detection 재구현
★ 525+0최근 7일 스타 변화 - #207★ 518+0최근 7일 스타 변화
- #208★ 518-1최근 7일 스타 변화
- #209
하드웨어 GPU 가속 GUI 앱을 지원하는 Ubuntu Desktop용 Docker 이미지입니다. 클라우드 VM처럼 SSH나 원격 데스크톱을 통해 컨테이너에 접근할 수 있습니다.
★ 515+0최근 7일 스타 변화 - #210
CUDA, cuda-python, cuBLAS, cuDNN, CUTLASS, TensorRT, TensorRT-LLM, Triton, TVM, MLIR, PTX 및 고성능 컴퓨팅(HPC) 관련 우수 프로젝트 목록
★ 512+0최근 7일 스타 변화