gpu
Dépôts open source suivis étiquetés gpu, triés par étoiles.
- #121★ 1 664+2Évolution des étoiles sur les 7 derniers jours
- #122
Bibliothèque d'opérateurs TT-NN et modèle de programmation de noyau bas niveau TT-Metalium.
★ 1 655+11Évolution des étoiles sur les 7 derniers jours - #123
Listes de ressources pour les professeurs adjoints et les doctorants.
★ 1 646+0Évolution des étoiles sur les 7 derniers jours - #124★ 1 625+0Évolution des étoiles sur les 7 derniers jours
- #125
ThunderSVM : Une bibliothèque SVM rapide sur GPU et CPU
★ 1 622+0Évolution des étoiles sur les 7 derniers jours - #126
Plateforme de recherche de benchmark d'inférence continue open source — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 et bientôt™ TPUv6e/v7/Trainium2/3
★ 1 613+33Évolution des étoiles sur les 7 derniers jours - #127★ 1 600+79Évolution des étoiles sur les 7 derniers jours
- #128★ 1 577+1Évolution des étoiles sur les 7 derniers jours
- #129
Bibliothèque graphique 2D légère pour GPU modernes, offrant un rendu haute performance de texte, d'images et de vecteurs sur les principales plateformes.
★ 1 576+1Évolution des étoiles sur les 7 derniers jours - #130
Un runtime rapide et convivial pour l'inférence de transformers (Bert, Albert, GPT2, Decoders, etc.) sur CPU et GPU.
★ 1 550+1Évolution des étoiles sur les 7 derniers jours - #131
Auto-recherche pour les noyaux GPU. Fournissez n'importe quel modèle PyTorch, allez dormir, et réveillez-vous avec des noyaux Triton optimisés.
★ 1 545+7Évolution des étoiles sur les 7 derniers jours - #132
Bibliothèque de traçage rapide de nouvelle génération fonctionnant sur WGPU avec le moteur de rendu pygfx.
★ 1 524+0Évolution des étoiles sur les 7 derniers jours - #133
UCCL est une bibliothèque de communication efficace pour GPU, couvrant les collectifs, le P2P (ex: transfert de cache KV, transfert de poids RL) et l'EP (ex: piloté par GPU).
★ 1 502+3Évolution des étoiles sur les 7 derniers jours - #134
Bibliothèque de calcul accéléré par GPU pour exécuter des simulations physiques et d'autres calculs GPGPU dans un navigateur web.
★ 1 483+0Évolution des étoiles sur les 7 derniers jours - #135
Package de SLAM visuel et d'odométrie basé sur cuVSLAM accéléré par NVIDIA
★ 1 454+5Évolution des étoiles sur les 7 derniers jours - #136
Une bibliothèque de calcul numérique GPU efficace en C++20 avec une syntaxe proche de Python
★ 1 444+0Évolution des étoiles sur les 7 derniers jours - #137
Runtime de calcul graphique Intel® pour oneAPI Level Zero et pilote OpenCL™.
★ 1 434+2Évolution des étoiles sur les 7 derniers jours - #138★ 1 426+2Évolution des étoiles sur les 7 derniers jours
- #139
Logiciel Julia pour une dynamique des fluides rapide, flexible et adaptée aux océans sur CPU et GPU.
★ 1 412+0Évolution des étoiles sur les 7 derniers jours - #140
Pilotes Mesa3D pré-compilés pour Windows.
★ 1 410+3Évolution des étoiles sur les 7 derniers jours - #141
Calcul du nombre de jetons par seconde et des besoins en mémoire GPU pour tout LLM. Prend en charge la quantification llama.cpp/ggml/bnb/QLoRA.
★ 1 406+0Évolution des étoiles sur les 7 derniers jours - #142★ 1 367+2Évolution des étoiles sur les 7 derniers jours
- #143
Bibliothèque rapide de chevauchement de communication pour le parallélisme de tenseurs/experts sur GPU.
★ 1 358+3Évolution des étoiles sur les 7 derniers jours - #144
Extension pour Scikit-learn permettant d'accélérer facilement vos applications Scikit-learn
★ 1 356+0Évolution des étoiles sur les 7 derniers jours - #145★ 1 319+0Évolution des étoiles sur les 7 derniers jours
- #146
🔥 Un agent IA autonome qui exécute vos expériences de deep learning 24h/24 et 7j/7 pendant que vous dormez. Surveillance à coût zéro, architecture Leader-Worker, mémoire à taille constante.
★ 1 288+3Évolution des étoiles sur les 7 derniers jours - #147★ 1 270+0Évolution des étoiles sur les 7 derniers jours
- #148
GraphVite : un système de plongement de graphes général et haute performance
★ 1 269+0Évolution des étoiles sur les 7 derniers jours - #149
Exemples de programmes créés avec Modal.
★ 1 264+2Évolution des étoiles sur les 7 derniers jours - #150
KernelBench : Les LLM peuvent-ils écrire des noyaux GPU ? - Benchmark et boîte à outils avec Torch vers CUDA (et autres DSL)
★ 1 227+7Évolution des étoiles sur les 7 derniers jours