メインコンテンツへスキップ
buildradar
ログイン
トピック · cuda

cuda

cuda がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

216 件のリポジトリ
  • tt-metal@tenstorrent

    :metal: TT-NN演算子ライブラリおよびTT-Metalium低水準カーネルプログラミングモデル。

    1,655+0直近 7 日のスター増減
  • gpu-hot@psalias2006

    🔥 リアルタイムNVIDIA GPUダッシュボード

    1,625+0直近 7 日のスター増減
  • thundersvm@Xtra-Computing

    ThunderSVM: GPU および CPU 向けの高速な SVM ライブラリ

    1,622+0直近 7 日のスター増減
  • mnn-llm@wangzhaode

    MNN をベースにした LLM デプロイプロジェクト。このプロジェクトは MNN に統合されました。

    1,617+0直近 7 日のスター増減
  • InferenceX@SemiAnalysisAI

    オープンソースの継続的推論ベンチマーク研究プラットフォーム — Kimi K3 2.8T、MiniMax M3、DeepSeekv4、GLM5 - GB200 NVL72対MI355X対B200対GB300 NVL72、まもなく™ TPUv6e/v7/Trainium2/3 に対応

    1,613+0直近 7 日のスター増減
  • 3d-ken-burns@sniklaus

    PyTorchを使用した単一画像からの3D Ken Burnsエフェクトの実装

    1,569+0直近 7 日のスター増減
  • autokernel@RightNow-AI

    GPU カーネルの自動リサーチ。任意の PyTorch モデルを渡して眠れば、最適化された Triton カーネルになって目覚めます。

    1,545+0直近 7 日のスター増減
  • uccl@uccl-project

    UCCLはGPU向けの効率的な通信ライブラリであり、集合通信、P2P(KVキャッシュ転送、RLウェイト転送など)、EP(GPU駆動など)をカバーします。

    1,502+0直近 7 日のスター増減
  • TornadoVM@beehive-lab

    Javaで書き、GPUで動かす。高速。

    1,492+0直近 7 日のスター増減
  • TensorRTによるYOLOv8、YOLOv8-Pose、YOLOv8-Seg、YOLOv8-Cls、YOLOv7、YOLOv6、YOLOv5、YOLONAS等の実装。CUDA IS ALL YOU NEED。

    1,460+0直近 7 日のスター増減
  • MatX@NVIDIA

    Python ライクな構文を持つ、効率的な C++20 GPU 数値計算ライブラリ

    1,444+0直近 7 日のスター増減
  • 強力なChatterbox TTSモデルをセルフホストします。ユーザーフレンドリーなWeb UI、柔軟なAPIエンドポイント(OpenAI互換を含む)、プリセット音声、音声クローン、大規模なオーディオブック規模のテキスト処理を提供します。NVIDIA (CUDA)、AMD (ROCm)、CPUで高速実行可能です。

    1,427+0直近 7 日のスター増減
  • CUDA.jl@JuliaGPU

    JuliaでのCUDAプログラミング

    1,426+0直近 7 日のスター増減
  • Arraymancer@mratsim

    OpenMP、Cuda、OpenCLバックエンドを介してCPU、GPU、組み込みデバイス向けにディープラーニングを重視した、Nim製の高速で使いやすくポータブルなテンソルライブラリ

    1,407+0直近 7 日のスター増減
  • flux@bytedance

    GPU上のテンソル/エキスパート並列処理に向けた、通信オーバーラップ対応の高速ライブラリ

    1,358+0直近 7 日のスター増減
  • LuxCore@LuxCoreRender

    LuxCore のソースリポジトリ

    1,323+0直近 7 日のスター増減
  • stable-fast@chengzeyi

    https://wavespeed.ai/ NVIDIA GPU 上の HuggingFace Diffusers 向け最高推論パフォーマンス最適化フレームワーク

    1,304+0直近 7 日のスター増減
  • stdgpu@stotko

    stdgpu: GPU上で効率的なSTLライクなデータ構造を実現

    1,270+0直近 7 日のスター増減
  • graphvite@DeepGraphLearning

    GraphVite: 汎用かつ高パフォーマンスなグラフ埋め込みシステム

    1,269+0直近 7 日のスター増減
  • ffmpeg-build-script@markus-perl

    非フリーのコーデックを含む静的な FFmpeg を OSX および Linux 上で簡単にビルドできるスクリプト

    1,215+0直近 7 日のスター増減
  • cudarc@chelsea0x3b

    CUDAツールキットの安全なRustラッパー

    1,214+0直近 7 日のスター増減
  • oneAPI-samples@oneapi-src

    Intel® oneAPI Toolkits のサンプル集

    1,162+0直近 7 日のスター増減
  • pyopencl@inducer

    Python 向けの OpenCL 統合と便利な機能

    1,150+0直近 7 日のスター増減
  • juice@fff-rs

    ハッカーのための機械学習エンジン

    1,131+0直近 7 日のスター増減
  • neanderthal@uncomplicate

    高速な Clojure Matrix ライブラリ

    1,128+0直近 7 日のスター増減
  • sglang-omni@sgl-project

    SGLang-Omni は、TTS、ASR、音声、およびオムニモデルの高性能なサービングを実現します。

    1,118+56直近 7 日のスター増減
  • tiny-vllm@jmaczan

    C++とCUDAで高性能なLLM推論エンジンを構築する - vLLMの軽量版

    1,100+10直近 7 日のスター増減
  • gunrock@gunrock

    プログラマブルなCUDA/C++ GPUグラフ解析

    1,096+0直近 7 日のスター増減
  • cupoch@neka-nat

    GPU コンピューティングを活用したロボティクス。

    1,064+1直近 7 日のスター増減
  • LuisaCompute@LuisaGroup

    ストリームアーキテクチャ上の高性能レンダリングフレームワーク

    1,044+1直近 7 日のスター増減
← トピック一覧に戻る