cuda
cuda がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #91★ 1,655+0直近 7 日のスター増減
- #92★ 1,625+0直近 7 日のスター増減
- #93
ThunderSVM: GPU および CPU 向けの高速な SVM ライブラリ
★ 1,622+0直近 7 日のスター増減 - #94★ 1,617+0直近 7 日のスター増減
- #95
オープンソースの継続的推論ベンチマーク研究プラットフォーム — Kimi K3 2.8T、MiniMax M3、DeepSeekv4、GLM5 - GB200 NVL72対MI355X対B200対GB300 NVL72、まもなく™ TPUv6e/v7/Trainium2/3 に対応
★ 1,613+0直近 7 日のスター増減 - #96
PyTorchを使用した単一画像からの3D Ken Burnsエフェクトの実装
★ 1,569+0直近 7 日のスター増減 - #97
GPU カーネルの自動リサーチ。任意の PyTorch モデルを渡して眠れば、最適化された Triton カーネルになって目覚めます。
★ 1,545+0直近 7 日のスター増減 - #98★ 1,502+0直近 7 日のスター増減
- #99★ 1,492+0直近 7 日のスター増減
- #100
TensorRTによるYOLOv8、YOLOv8-Pose、YOLOv8-Seg、YOLOv8-Cls、YOLOv7、YOLOv6、YOLOv5、YOLONAS等の実装。CUDA IS ALL YOU NEED。
★ 1,460+0直近 7 日のスター増減 - #101★ 1,444+0直近 7 日のスター増減
- #102
強力なChatterbox TTSモデルをセルフホストします。ユーザーフレンドリーなWeb UI、柔軟なAPIエンドポイント(OpenAI互換を含む)、プリセット音声、音声クローン、大規模なオーディオブック規模のテキスト処理を提供します。NVIDIA (CUDA)、AMD (ROCm)、CPUで高速実行可能です。
★ 1,427+0直近 7 日のスター増減 - #103★ 1,426+0直近 7 日のスター増減
- #104
OpenMP、Cuda、OpenCLバックエンドを介してCPU、GPU、組み込みデバイス向けにディープラーニングを重視した、Nim製の高速で使いやすくポータブルなテンソルライブラリ
★ 1,407+0直近 7 日のスター増減 - #105★ 1,358+0直近 7 日のスター増減
- #106★ 1,323+0直近 7 日のスター増減
- #107
https://wavespeed.ai/ NVIDIA GPU 上の HuggingFace Diffusers 向け最高推論パフォーマンス最適化フレームワーク
★ 1,304+0直近 7 日のスター増減 - #108★ 1,270+0直近 7 日のスター増減
- #109★ 1,269+0直近 7 日のスター増減
- #110
非フリーのコーデックを含む静的な FFmpeg を OSX および Linux 上で簡単にビルドできるスクリプト
★ 1,215+0直近 7 日のスター増減 - #111★ 1,214+0直近 7 日のスター増減
- #112
Intel® oneAPI Toolkits のサンプル集
★ 1,162+0直近 7 日のスター増減 - #113★ 1,150+0直近 7 日のスター増減
- #114★ 1,131+0直近 7 日のスター増減
- #115
高速な Clojure Matrix ライブラリ
★ 1,128+0直近 7 日のスター増減 - #116
SGLang-Omni は、TTS、ASR、音声、およびオムニモデルの高性能なサービングを実現します。
★ 1,118+56直近 7 日のスター増減 - #117★ 1,100+10直近 7 日のスター増減
- #118★ 1,096+0直近 7 日のスター増減
- #119★ 1,064+1直近 7 日のスター増減
- #120
ストリームアーキテクチャ上の高性能レンダリングフレームワーク
★ 1,044+1直近 7 日のスター増減