본문으로 건너뛰기
buildradar
로그인
토픽 · cuda

cuda

cuda 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 216개
  • 분산 PyTorch 학습 코드 작성을 위한 모범 사례 및 가이드

    631+2최근 7일 스타 변화
  • ginkgo@ginkgo-project

    수치 선형 대수 소프트웨어 패키지

    622+2최근 7일 스타 변화
  • LuisaRender@LuisaGroup

    LuisaCompute 기반의 고성능 크로스 플랫폼 몬테카를로 렌더러

    618+1최근 7일 스타 변화
  • FastFold@hpcaitech

    GPU 클러스터에서 AlphaFold 학습 및 추론 최적화

    616+0최근 7일 스타 변화
  • AutoDock-GPU@ccsb-scripps

    GPU 및 기타 가속기를 위한 AutoDock

    610+1최근 7일 스타 변화
  • attorch@BobMcDear

    OpenAI의 Triton을 사용하여 Python으로 작성된 PyTorch 신경망 모듈의 하위 집합

    604+0최근 7일 스타 변화
  • personal-os-setup@AmineDjeghri

    Windows, Linux, MacOS, Google TV, Stremio, Home Assistant 등을 쉽게 설정하기 위한 앱 및 가이드(WSL2, GPU 드라이버 및 개발 도구 포함). 사용자 경험과 생산성을 향상시킵니다.

    602+0최근 7일 스타 변화
  • yzma@hybridgroup

    하드웨어 가속을 사용하여 로컬 추론을 위해 llama.cpp를 직접 통합한 Go 애플리케이션입니다.

    599+17최근 7일 스타 변화
  • yalm@andrewkchan

    Yet Another Language Model: I/O를 제외한 라이브러리 의존성 없이 C++/CUDA로 구현한 LLM 추론 엔진

    597+1최근 7일 스타 변화
  • pymde@cvxgrp

    PyTorch를 이용한 최소 왜곡 임베딩

    594+1최근 7일 스타 변화
  • dace@spcl

    DaCe - 데이터 중심 병렬 프로그래밍

    592+0최근 7일 스타 변화
  • nvshmem@NVIDIA

    NVIDIA NVSHMEM은 OpenSHMEM 기반의 NVIDIA GPU용 병렬 프로그래밍 인터페이스입니다. NVSHMEM은 프로그래머가 CUDA 커널 및 CUDA 스트림 내에서 단방향 통신을 수행할 수 있도록 하여 다중 프로세스 통신 및 조정 오버헤드를 크게 줄일 수 있습니다.

    585+4최근 7일 스타 변화
  • radarsimpy@radarsimx

    Python과 C++로 구축된 레이더 시뮬레이터

    576+3최근 7일 스타 변화
  • jitify@NVIDIA

    CUDA 런타임 컴파일(NVRTC) 사용을 간소화하는 단일 헤더 C++ 라이브러리

    574+0최근 7일 스타 변화
  • KuiperLLama@zjhellofss

    신입 채용 및 인턴십을 위한 프로젝트로, LLama2/3 및 Qwen2.5를 지원하는 대규모 언어 모델 추론 프레임워크를 처음부터 직접 구현합니다.

    574+0최근 7일 스타 변화
  • llm_training_handbook@huggingface

    거대 언어 모델의 성공적인 학습을 돕기 위한 방법론 오픈 컬렉션

    569+2최근 7일 스타 변화
  • cuda_hgemm@Bruce-Lee-LY

    WMMA API 및 MMA PTX 명령어를 사용하여 Tensor Core를 활용한 반정밀도 일반 행렬 곱셈(HGEMM) 최적화 기법

    568+0최근 7일 스타 변화
  • tessera@zengxiao-he

    교사 모델에서 타일 모델까지 — 처음부터 구현한 LLM 증류 및 서빙 엔진: 커스텀 Triton/CUDA 커널, FSDP 증류, 페이징된 KV 연속 배치, 추측 디코딩, Rust 게이트웨이, JAX 오라클, 해석 가능성 도구를 포함합니다.

    566+0최근 7일 스타 변화
  • FlashRT@flashrt-project

    FlashRT는 소규모 배치 및 지연 시간에 민감한 AI 워크로드를 위한 고성능 실시간 추론 엔진입니다. Pi0, Pi0.5, GROOT N1.6 및 Pi0-FAST를 위한 프로덕션 VLA 제어를 지원하며, qwen3.6-27B와 같은 LLM도 지원합니다.

    562+14최근 7일 스타 변화
  • qwen600@yassa9

    정적 suckless 단일 배치 CUDA 전용 qwen3-0.6B 미니 추론 엔진

    560+1최근 7일 스타 변화
  • llm-algo-leetcode@datawhalechina

    LLM algorithm practice lab with theory, solutions, and test cases.《大模型算法与系统教程》面向大模型入门到进阶的算法实战教程,覆盖原理讲解、答案解析、测试用例与 CUDA/Triton 实战。

    559+20최근 7일 스타 변화
  • nbd-vram@c0deJedi

    Linux에서 NVIDIA GPU의 VRAM을 스왑 공간으로 사용합니다. 메모리 업그레이드가 불가능한 노트북을 위해 설계되었으며, SSD 스왑 대신 8GB VRAM을 활용할 수 있습니다.

    555+4최근 7일 스타 변화
  • relion@3dem

    극저온 전자 현미경(cryo-electron microscopy)을 위한 이미지 처리 소프트웨어

    552+2최근 7일 스타 변화
  • slurm-docker-cluster@giovtorres

    docker-compose를 사용하는 Slurm 클러스터

    544+2최근 7일 스타 변화
  • cu@gorgonia

    CUDA Driver API에 대한 관용적인 인터페이스를 제공하는 cu 패키지

    532+0최근 7일 스타 변화
  • pytorch-hed@sniklaus

    PyTorch를 이용한 Holistically-Nested Edge Detection 재구현

    525+0최근 7일 스타 변화
  • plotoptix@rnd-team-dev

    OptiX 9.1 프레임워크 기반의 Python 데이터 시각화 및 레이 트레이싱 도구입니다.

    518+0최근 7일 스타 변화
  • INSTA@Zielon

    INSTA - 실시간 볼류메트릭 헤드 아바타 [CVPR2023]

    518-1최근 7일 스타 변화
  • 하드웨어 GPU 가속 GUI 앱을 지원하는 Ubuntu Desktop용 Docker 이미지입니다. 클라우드 VM처럼 SSH나 원격 데스크톱을 통해 컨테이너에 접근할 수 있습니다.

    515+0최근 7일 스타 변화
  • CUDA, cuda-python, cuBLAS, cuDNN, CUTLASS, TensorRT, TensorRT-LLM, Triton, TVM, MLIR, PTX 및 고성능 컴퓨팅(HPC) 관련 우수 프로젝트 목록

    512+0최근 7일 스타 변화
← 토픽 목록으로