본문으로 건너뛰기
buildradar
로그인
토픽 · cuda

cuda

cuda 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 216개
  • rust-cuda@Rust-GPU

    Rust로만 빠르고 안전한 GPU 코드를 작성하고 실행하기 위한 라이브러리 및 도구 생태계

    5,334+0최근 7일 스타 변화
  • cuml@NVIDIA

    NVIDIA cuML: GPU 가속 머신러닝

    5,269+0최근 7일 스타 변화
  • kaolin@NVIDIAGameWorks

    3D 딥러닝 연구 가속화를 위한 PyTorch 라이브러리

    5,163+0최근 7일 스타 변화
  • nccl@NVIDIA

    다중 GPU 집단 통신을 위한 최적화된 프리미티브

    5,041+0최근 7일 스타 변화
  • arrayfire@arrayfire

    ArrayFire: 범용 GPU 라이브러리

    4,903+0최근 7일 스타 변화
  • CTranslate2@OpenNMT

    Transformer 모델을 위한 빠른 추론 엔진

    4,658+0최근 7일 스타 변화
  • Tengine@OAID

    임베디드 기기를 위한 가볍고 고성능인 모듈형 추론 엔진 Tengine

    4,533+0최근 7일 스타 변화
  • tiny-cuda-nn@NVlabs

    번개처럼 빠른 C++/CUDA 신경망 프레임워크

    4,530+0최근 7일 스타 변화
  • hip@ROCm

    HIP: 이식성을 위한 C++ 이기종 연산 인터페이스

    4,395+0최근 7일 스타 변화
  • iree@iree-org

    재타겟팅이 가능한 MLIR 기반 머신러닝 컴파일러 및 런타임 툴킷입니다.

    3,914+0최근 7일 스타 변화
  • SageAttention@thu-ml

    [ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention은 언어, 이미지, 비디오 모델 전반에서 엔드투엔드 메트릭 손실 없이 FlashAttention 대비 2~5배의 속도 향상을 달성합니다.

    3,699+0최근 7일 스타 변화
  • 단일 네이티브 애플리케이션에서 3D Gaussian Splatting 씬을 학습, 검사, 편집, 자동화 및 내보내기합니다.

    3,645+0최근 7일 스타 변화
  • Hopper, Ada, Blackwell GPU에서 8비트 및 4비트 부동소수점(FP8 및 FP4) 정밀도를 활용하는 것을 포함하여 NVIDIA GPU에서 Transformer 모델을 가속화하고, 학습 및 추론 모두에서 더 나은 성능과 낮은 메모리 사용량을 제공하는 라이브러리

    3,518+0최근 7일 스타 변화
  • viseron@roflcoopter

    셀프 호스팅, 로컬 전용 NVR 및 AI 컴퓨터 비전 소프트웨어. 객체 감지, 모션 감지, 얼굴 인식 등의 기능을 통해 집, 사무실 또는 모니터링하려는 기타 장소를 주시할 수 있는 기능을 제공합니다.

    3,468+0최근 7일 스타 변화
  • lygia@patriciogonzalezvivo

    LYGIA는 성능과 유연성을 위해 설계된 세분화된 다중 언어(GLSL, HLSL, Metal, WGSL, WEGL 및 CUDA) 셰이더 라이브러리입니다.

    3,423+0최근 7일 스타 변화
  • Remotery@Celtoys

    단일 C 파일, 원격 웹 뷰어가 포함된 실시간 CPU/GPU 프로파일러

    3,312+0최근 7일 스타 변화
  • CUDA에서 일부 알고리즘을 최적화하는 방법.

    3,242+0최근 7일 스타 변화
  • jittor@Jittor

    Jittor는 JIT 컴파일 및 메타 연산자 기반의 고성능 딥러닝 프레임워크입니다.

    3,232+0최근 7일 스타 변화
  • lc0@LeelaChessZero

    GPU 가속 및 광범위한 하드웨어를 지원하는 오픈소스 신경망 체스 엔진

    3,197+0최근 7일 스타 변화
  • skills@NVIDIA

    NVIDIA 제품용 Agent Skills — Claude Code, Codex 및 기타 코딩 에이전트에 설치하여 Physical AI, 로보틱스, 시뮬레이션, CUDA, RAG 워크플로를 엔드투엔드로 실행

    3,180+0최근 7일 스타 변화
  • cuda-oxide@NVlabs

    cuda-oxide는 안전하고 관용적인 Rust로 (SIMT) GPU 커널을 작성할 수 있게 해주는 실험적인 Rust-to-CUDA 컴파일러입니다. DSL이나 외부 언어 바인딩 없이 표준 Rust 코드를 직접 PTX로 컴파일합니다.

    3,118+0최근 7일 스타 변화
  • aresdb@uber

    GPU 기반의 실시간 분석 스토리지 및 쿼리 엔진

    3,076+0최근 7일 스타 변화
  • heavydb@heavyai

    HeavyDB (구 MapD/OmniSciDB)

    3,059+0최근 7일 스타 변화
  • ramalama@containers

    RamaLama는 모든 소스에서 AI 모델의 로컬 서빙을 단순화하고 익숙한 컨테이너 명령어를 통해 프로덕션 환경에서 추론에 활용할 수 있도록 지원하는 오픈소스 개발자 도구입니다.

    3,031+0최근 7일 스타 변화
  • TensorRT@pytorch

    TensorRT를 사용하는 NVIDIA GPU용 PyTorch/TorchScript/FX 컴파일러

    2,989+0최근 7일 스타 변화
  • ao@pytorch

    학습 및 추론을 위한 PyTorch 기본 양자화

    2,961+0최근 7일 스타 변화
  • MinkowskiEngine@NVIDIA

    Minkowski Engine은 고차원 희소 텐서를 위한 자동 미분 신경망 라이브러리입니다.

    2,957+0최근 7일 스타 변화
  • NVIDIA GPU Operator는 Kubernetes에서 GPU를 생성, 구성 및 관리합니다

    2,857+0최근 7일 스타 변화
  • lucebox@Luce-Org

    소비자용 및 이기종 하드웨어를 위한 LLM 추측적 추론 서버

    2,829+0최근 7일 스타 변화
  • futhark@diku-dk

    :boom::computer::boom: 데이터 병렬 함수형 프로그래밍 언어

    2,794+0최근 7일 스타 변화
← 토픽 목록으로