Aller au contenu principal
buildradar
Sign in
Sujet · cuda-kernels

cuda-kernels

Dépôts open source suivis étiquetés cuda-kernels, triés par étoiles.

Dépôts
13
Total d'étoiles
47 369
Étoiles en moyenne
3 644
Part
0,00%

Sujets qui apparaissent souvent aux côtés de cuda-kernels sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés cuda-kernels.

Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.

  • LeetCUDA@xlite-dev

    Notes d'apprentissage modernes sur CUDA avec PyTorch pour débutants, incluant plus de 200 noyaux CUDA, Tensor Cores, HGEMM, FA-2 MMA.

    11 875+39Évolution des étoiles sur les 7 derniers jours
  • cuda-samples@NVIDIA

    Exemples pour les développeurs CUDA démontrant les fonctionnalités du CUDA Toolkit.

    9 585+30Évolution des étoiles sur les 7 derniers jours
  • lmdeploy@InternLM

    LMDeploy est une boîte à outils pour la compression, le déploiement et la mise en service de LLM.

    8 041+16Évolution des étoiles sur les 7 derniers jours
  • rust-cuda@Rust-GPU

    Écosystème de bibliothèques et d'outils pour écrire et exécuter du code GPU rapide entièrement en Rust.

    5 334+3Évolution des étoiles sur les 7 derniers jours
  • lucebox@Luce-Org

    Serveur d'inférence spéculative LLM pour matériel grand public et hétérogène

    2 829+38Évolution des étoiles sur les 7 derniers jours
  • cccl@NVIDIA

    Bibliothèques de calcul pour cœurs CUDA

    2 500+10Évolution des étoiles sur les 7 derniers jours
  • dfdx@chelsea0x3b

    Deep learning en Rust, avec des tenseurs et réseaux de neurones vérifiés par forme.

    1 933+1Évolution des étoiles sur les 7 derniers jours
  • cudarc@chelsea0x3b

    Wrapper Rust sécurisé pour le toolkit CUDA.

    1 214+1Évolution des étoiles sur les 7 derniers jours
  • framework@mni-ml

    Une bibliothèque de machine learning avec une API TypeScript et un backend Rust. Compatible CUDA et WebGPU. Conçue pour comprendre le fonctionnement interne des frameworks et modèles de ML.

    1 005+4Évolution des étoiles sur les 7 derniers jours
  • cudnn-frontend@NVIDIA

    cuDNN Frontend est le point d'entrée moderne et open-source de NVIDIA vers la bibliothèque cuDNN et une collection croissante de noyaux open-source haute performance.

    929+7Évolution des étoiles sur les 7 derniers jours
  • nvbench@NVIDIA

    Bibliothèque de benchmarking pour noyaux CUDA

    925+1Évolution des étoiles sur les 7 derniers jours
  • pegainfer@pegainfer-project

    Moteur d'inférence LLM en Rust pur et CUDA — sans PyTorch, compatible avec OpenAI, servant Qwen3 vers Kimi-K2.

    673+13Évolution des étoiles sur les 7 derniers jours
  • FlashRT@flashrt-project

    FlashRT est un moteur d'inférence haute performance en temps réel pour les charges de travail IA à faible lot et sensibles à la latence. L'intégration phare concerne le contrôle VLA en production pour Pi0, Pi0.5, GROOT N1.6 et Pi0-FAST. Il prend également en charge les LLM tels que qwen3.6-27B.

    546+9Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets