メインコンテンツへスキップ
buildradar
ログイン
トピック · cuda

cuda

cuda がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

216 件のリポジトリ
  • 分散 PyTorch トレーニングコードの記述に関するベストプラクティスとガイド

    631+2直近 7 日のスター増減
  • ginkgo@ginkgo-project

    数値線形代数ソフトウェアパッケージ

    622+2直近 7 日のスター増減
  • LuisaRender@LuisaGroup

    LuisaComputeをベースにした高性能クロスプラットフォーム・モンテカルロ・レンダラー

    618+1直近 7 日のスター増減
  • FastFold@hpcaitech

    GPUクラスターにおけるAlphaFoldのトレーニングと推論の最適化

    616+0直近 7 日のスター増減
  • AutoDock-GPU@ccsb-scripps

    GPU およびその他のアクセラレータ向け AutoDock

    610+1直近 7 日のスター増減
  • attorch@BobMcDear

    OpenAI の Triton を使用して Python で書かれた、PyTorch のニューラルネットワークモジュールのサブセット

    604+0直近 7 日のスター増減
  • personal-os-setup@AmineDjeghri

    Windows、Linux、MacOS、Google TV、Stremio、Home Assistant などを簡単に設定するためのアプリとガイド(WSL2、GPU ドライバ、開発ツールを含む)。UX と生産性を向上させます。

    602+0直近 7 日のスター増減
  • yzma@hybridgroup

    独自の知性を持つ Go - ハードウェアアクセラレーションを使用したローカル推論のために llama.cpp を直接統合する Go アプリケーション

    599+17直近 7 日のスター増減
  • yalm@andrewkchan

    もう一つの言語モデル:C++/CUDA による LLM 推論(入出力以外のライブラリなし)

    597+1直近 7 日のスター増減
  • pymde@cvxgrp

    PyTorchによる最小歪み埋め込み(Minimum-distortion embedding)。

    594+1直近 7 日のスター増減
  • dace@spcl

    DaCe - データ中心型並行プログラミング

    592+0直近 7 日のスター増減
  • nvshmem@NVIDIA

    NVIDIA NVSHMEM は、OpenSHMEM をベースにした NVIDIA GPU 向けの並列プログラミングインターフェースです。NVSHMEM は、プログラマが CUDA カーネル内や CUDA ストリーム上で片方向通信を実行できるようにすることで、マルチプロセスの通信および調整オーバーヘッドを大幅に削減できます。

    584+4直近 7 日のスター増減
  • radarsimpy@radarsimx

    Python と C++ で構築されたレーダーシミュレーター

    576+3直近 7 日のスター増減
  • jitify@NVIDIA

    CUDA Runtime Compilation (NVRTC) の使用を簡素化するシングルヘッダー C++ ライブラリ

    574+0直近 7 日のスター増減
  • KuiperLLama@zjhellofss

    キャンパス採用やインターンシップに最適なプロジェクト。ゼロから手を動かして、LLaMA2/3およびQwen2.5をサポートする大規模言語モデル(LLM)推論フレームワークを実装します。

    573+0直近 7 日のスター増減
  • llm_training_handbook@huggingface

    大規模言語モデルの正常な学習を支援する手法のオープンなコレクション

    569+2直近 7 日のスター増減
  • cuda_hgemm@Bruce-Lee-LY

    WMMA API と MMA PTX 命令を使用した Tensor Core による半精度汎用行列乗算 (HGEMM) のいくつかの最適化手法

    568+0直近 7 日のスター増減
  • tessera@zengxiao-he

    教師モデルからタイルまで — フルスクラッチのLLM蒸留・サービングエンジン:カスタムTriton/CUDAカーネル、FSDP蒸留、ページ化KV連続バッチ処理、推測デコーディング、Rustゲートウェイ、JAXオラクル、および解釈可能性ツール。

    566+0直近 7 日のスター増減
  • qwen600@yassa9

    静的でsucklessな単一バッチのCUDA専用qwen3-0.6Bミニ推論エンジン

    560+1直近 7 日のスター増減
  • FlashRT@flashrt-project

    FlashRTは、小バッチかつ低レイテンシが求められるAIワークロード向けの高性能リアルタイム推論エンジンです。主な統合機能として、Pi0、Pi0.5、GROOT N1.6、Pi0-FASTのプロダクションVLA制御をサポートします。また、qwen3.6-27BなどのLLMもサポートしています。

    555+14直近 7 日のスター増減
  • nbd-vram@c0deJedi

    Linux 上で NVIDIA GPU の VRAM をスワップ領域として使用する。メモリがオンボードでアップグレードできないノートPC向け。RTX カードの 8GB の VRAM が遊んでいて SSD にスワップされている場合に、その VRAM を有効活用するツール

    555+4直近 7 日のスター増減
  • llm-algo-leetcode@datawhalechina

    LLM algorithm practice lab with theory, solutions, and test cases.《大模型算法与系统教程》面向大模型入门到进阶的算法实战教程,覆盖原理讲解、答案解析、测试用例与 CUDA/Triton 实战。

    554+20直近 7 日のスター増減
  • relion@3dem

    クライオ電子顕微鏡用の画像処理ソフトウェア

    551+2直近 7 日のスター増減
  • slurm-docker-cluster@giovtorres

    docker-composeを使用したSlurmクラスター

    544+2直近 7 日のスター増減
  • cu@gorgonia

    CUDA Driver API へのイディオム的なインターフェースを提供する cu パッケージ

    532+0直近 7 日のスター増減
  • pytorch-hed@sniklaus

    PyTorch による Holistically-Nested Edge Detection の再実装。

    525+0直近 7 日のスター増減
  • plotoptix@rnd-team-dev

    OptiX 9.1フレームワークに基づくPythonでのデータ可視化とレイトレーシング

    518+0直近 7 日のスター増減
  • INSTA@Zielon

    INSTA - インスタントボリュメトリックヘッドアバター [CVPR2023]

    518-1直近 7 日のスター増減
  • ハードウェア GPU アクセラレーションによる GUI アプリをサポートする Ubuntu Desktop 用 Docker イメージ。クラウド VM のように、SSH またはリモートデスクトップでコンテナにアクセスできます。

    514+0直近 7 日のスター増減
  • 🚀🚀🚀 優れた公開 CUDA、cuda-python、cuBLAS、cuDNN、CUTLASS、TensorRT、TensorRT-LLM、Triton、TVM、MLIR、PTX、およびハイパフォーマンス計算(HPC)プロジェクトのリストです。

    512+0直近 7 日のスター増減
← トピック一覧に戻る