Cuda
Cuda を第一言語とする追跡中のオープンソースリポジトリを、スター数順に表示します。
- #31raft@NVIDIA
RAFT は、機械学習と情報検索のための広く使用されている基本的なアルゴリズムとプリミティブを含んでいます。アルゴリズムは CUDA で加速されており、高性能なアプリケーションをより簡単に記述するための構成要素となります。
★ 1,037+1直近 7 日のスター増減 - #32cuopt@NVIDIA
GPU アクセラレーションによる決定最適化
★ 1,032+10直近 7 日のスター増減 - #33NKSR@nv-tlabs
[CVPR 2023 Highlight] ニューラルカーネル表面再構成
★ 986+1直近 7 日のスター増減 - #34CudaSift@Celebrandil
NVIDIA 製 GPU 向け SIFT の CUDA 実装(GTX 1060 で 1.2 ms)
★ 953+1直近 7 日のスター増減 - #35nvbench@NVIDIA
CUDAカーネルベンチマークライブラリ
★ 924+3直近 7 日のスター増減 - #36multi-gpu-programming-models@NVIDIA
単一ノードまたはクラスター内の複数のGPUをプログラミングするための利用可能なオプションを示すサンプル
★ 911+1直近 7 日のスター増減 - #37tron@NovaCodeu
USDTウォレットのプレミアムアドレス生成ツール、TRXプレミアムアドレス、TRONウォレットのGPUプレミアムアドレスソースコード、TRONアドレスプレミアムアドレス生成器
★ 869+1直近 7 日のスター増減 - #38lietorch@princeton-vl★ 853+2直近 7 日のスター増減
- #39cuvs@NVIDIA
cuVS - GPU上でベクトル検索とクラスタリングを行うためのライブラリ
★ 841+3直近 7 日のスター増減 - #40GPUMD@brucefan1983
GPU分子動力学シミュレーション
★ 828+2直近 7 日のスター増減 - #41NeuS2@19reborn
[ICCV 2023] NeuS2 の公式コード
★ 736+1直近 7 日のスター増減 - #42AMGX@NVIDIA
GPU 向けの分散マルチグリッド線形ソルバーライブラリ
★ 690+3直近 7 日のスター増減 - #43ai-infra-hpc@jinbooooom
HPCチュートリアル:集合通信(MPI、NCCL)、CUDAプログラミング、ベクトル化SIMD、RDMA通信などを網羅
★ 682+17直近 7 日のスター増減 - #44radfoam@theialab
「Radiant Foam: Real-Time Differentiable Ray Tracing」のオリジナル実装
★ 665+0直近 7 日のスター増減 - #45unet.cu@clu0
純粋な CUDA で実装された UNet 拡散モデル
★ 663+0直近 7 日のスター増減 - #46cuCollections@NVIDIA★ 661+0直近 7 日のスター増減
- #47recommenders-addons@tensorflow
SIG Recommenders が提供および保守する、レコメンデーションシステム構築時に TensorFlow を拡張するための追加ユーティリティおよびヘルパー。
★ 636+1直近 7 日のスター増減 - #48GPU@a-hamdi
GPUカーネル構築100日チャレンジ!
★ 629+1直近 7 日のスター増減 - #49fast.cu@pranjalssh
ゼロからスクラッチで書かれた最速のカーネル
★ 615+7直近 7 日のスター増減 - #50gpuRIR@DavidDiazGuerra
GPU アクセラレーションに対応した、ルームインパルス応答(RIR)シミュレーション用 Python ライブラリ
★ 611+1直近 7 日のスター増減 - #51DiffPhysDrone@HenryHuYu
Nature Machine Intelligenceに掲載!微分可能物理学のトレーニングに基づいた世界初の現実のロボット(クアッドローター)。
★ 605+7直近 7 日のスター増減 - #52cudahandbook@ArchaeaSoftware
The CUDA Handbookのサンプルソースコード
★ 598+0直近 7 日のスター増減 - #53Parallel-Computing-Cuda-C@CisMine
CUDA学習ガイド
★ 569+0直近 7 日のスター増減 - #54DarkPose@ilovepose
姿勢推定のための分布認識型座標表現
★ 568+1直近 7 日のスター増減 - #55cuda_hgemm@Bruce-Lee-LY
WMMA API と MMA PTX 命令を使用した Tensor Core による半精度汎用行列乗算 (HGEMM) のいくつかの最適化手法
★ 567+1直近 7 日のスター増減 - #56qwen600@yassa9
静的でsucklessな単一バッチのCUDA専用qwen3-0.6Bミニ推論エンジン
★ 559+0直近 7 日のスター増減 - #57tiny-flash-attention@66RING
python、triton、cuda、cutlassで書かれたflash attentionチュートリアル
★ 532+1直近 7 日のスター増減 - #58megalodon@XuezheMax
Megalodon 7Bモデルのリファレンス実装。
★ 526+0直近 7 日のスター増減 - #59mnist-cuda@Infatoshi★ 515+2直近 7 日のスター増減
- #60BasicCUDA@CalvinXKY
A tutorial for CUDA&PyTorch
★ 507—直近 7 日のスター増減