cuda
cuda 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #91
오픈 소스 지속적 추론 벤치마크 연구 플랫폼 — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 및 곧 출시될™ TPUv6e/v7/Trainium2/3
★ 1,667+0최근 7일 스타 변화 - #92★ 1,666+0최근 7일 스타 변화
- #93★ 1,631+0최근 7일 스타 변화
- #94
ThunderSVM: GPU 및 CPU를 지원하는 고속 SVM 라이브러리
★ 1,622+0최근 7일 스타 변화 - #95★ 1,616+0최근 7일 스타 변화
- #96
PyTorch를 사용하여 단일 이미지에서 3D Ken Burns 효과를 구현한 것
★ 1,570+0최근 7일 스타 변화 - #97
GPU 커널 자동 연구. PyTorch 모델을 제공하고 잠자고 일어나면 최적화된 Triton 커널이 완성됩니다.
★ 1,556+0최근 7일 스타 변화 - #98
UCCL은 GPU를 위한 효율적인 통신 라이브러리로, 집합 통신, P2P (예: KV 캐시 전송, RL 가중치 전송) 및 EP (예: GPU 구동)를 포함합니다.
★ 1,512+0최근 7일 스타 변화 - #99★ 1,500+0최근 7일 스타 변화
- #100
🔥🔥🔥 YOLOv8, YOLOv8-Pose, YOLOv8-Seg, YOLOv8-Cls, YOLOv7, YOLOv6, YOLOv5, YOLONAS용 TensorRT......🚀🚀🚀 CUDA IS ALL YOU NEED. 🍎🍎🍎
★ 1,461+0최근 7일 스타 변화 - #101★ 1,444+0최근 7일 스타 변화
- #102
강력한 Chatterbox TTS 모델을 자체 호스팅하세요. 이 서버는 사용자 친화적인 Web UI, 유연한 API 엔드포인트(OpenAI 호환 포함), 사전 정의된 목소리, 목소리 복제, 대규모 오디오북 수준의 텍스트 처리를 제공합니다. NVIDIA (CUDA), AMD (ROCm) 및 CPU에서 가속화되어 실행됩니다.
★ 1,440+0최근 7일 스타 변화 - #103★ 1,426+0최근 7일 스타 변화
- #104
OpenMP, Cuda, OpenCL 백엔드를 통해 CPU, GPU 및 임베디드 기기를 지원하며, 딥러닝에 초점을 맞춘 빠르고 직관적이며 이식성 높은 Nim 텐서 라이브러리
★ 1,406+0최근 7일 스타 변화 - #105★ 1,360+0최근 7일 스타 변화
- #106★ 1,326+0최근 7일 스타 변화
- #107
https://wavespeed.ai/ NVIDIA GPU에서 HuggingFace Diffusers를 위한 최고의 추론 성능 최적화 프레임워크.
★ 1,304+0최근 7일 스타 변화 - #108★ 1,270+0최근 7일 스타 변화
- #109★ 1,269+0최근 7일 스타 변화
- #110★ 1,217+0최근 7일 스타 변화
- #111
비자유 코덱이 포함된 정적 FFmpeg를 OSX 및 Linux에서 쉽게 빌드할 수 있는 스크립트입니다.
★ 1,215+0최근 7일 스타 변화 - #112
Intel® oneAPI 툴킷 샘플 코드
★ 1,160+0최근 7일 스타 변화 - #113
SGLang-Omni는 TTS, ASR, 음성 및 옴니 모델을 위한 고성능 서빙을 지원합니다.
★ 1,159+56최근 7일 스타 변화 - #114★ 1,150+0최근 7일 스타 변화
- #115★ 1,132+0최근 7일 스타 변화
- #116
빠른 Clojure 매트릭스 라이브러리
★ 1,128+0최근 7일 스타 변화 - #117★ 1,104+10최근 7일 스타 변화
- #118★ 1,097+0최근 7일 스타 변화
- #119★ 1,063+1최근 7일 스타 변화
- #120
스트림 아키텍처 기반의 고성능 렌더링 프레임워크
★ 1,044+1최근 7일 스타 변화