gpu
Repositorios de código abierto monitorizados etiquetados con gpu, ordenados por estrellas.
- #121★ 1664+2Variación de estrellas de los últimos 7 días
- #122
Biblioteca de operadores TT-NN y modelo de programación de kernels de bajo nivel TT-Metalium.
★ 1655+11Variación de estrellas de los últimos 7 días - #123
Listas impresionantes para profesores asistentes con contrato y estudiantes de doctorado.
★ 1646+0Variación de estrellas de los últimos 7 días - #124★ 1625+0Variación de estrellas de los últimos 7 días
- #125
ThunderSVM: una biblioteca de SVM rápida para GPU y CPU.
★ 1622+0Variación de estrellas de los últimos 7 días - #126
Plataforma de investigación de benchmarks de inferencia continua de código abierto — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 y próximamente™ TPUv6e/v7/Trainium2/3
★ 1613+33Variación de estrellas de los últimos 7 días - #127★ 1600+79Variación de estrellas de los últimos 7 días
- #128★ 1577+1Variación de estrellas de los últimos 7 días
- #129
Una biblioteca de gráficos 2D ligera para GPUs modernas, que ofrece renderizado de alto rendimiento para texto, imágenes y vectores en las principales plataformas
★ 1576+1Variación de estrellas de los últimos 7 días - #130
Un entorno de ejecución rápido y fácil de usar para la inferencia de transformers (Bert, Albert, GPT2, Decoders, etc.) en CPU y GPU.
★ 1550+1Variación de estrellas de los últimos 7 días - #131
Investigación automática para kernels de GPU. Proporciónale cualquier modelo de PyTorch, vete a dormir y despierta con kernels de Triton optimizados.
★ 1545+7Variación de estrellas de los últimos 7 días - #132
Biblioteca de trazado rápido de próxima generación que se ejecuta en WGPU utilizando el motor de renderizado pygfx
★ 1524+0Variación de estrellas de los últimos 7 días - #133
UCCL es una biblioteca de comunicación eficiente para GPUs, que cubre colectivos, P2P (por ejemplo, transferencia de caché KV, transferencia de pesos RL) y EP (por ejemplo, impulsado por GPU).
★ 1502+3Variación de estrellas de los últimos 7 días - #134
Una biblioteca de computación acelerada por GPU para ejecutar simulaciones de física y otros cálculos GPGPU en un navegador web.
★ 1483+0Variación de estrellas de los últimos 7 días - #135
Paquete de SLAM/odometría visual basado en cuVSLAM acelerado por NVIDIA
★ 1454+5Variación de estrellas de los últimos 7 días - #136
Una biblioteca eficiente de computación numérica en GPU para C++20 con sintaxis similar a Python.
★ 1444+0Variación de estrellas de los últimos 7 días - #137
Runtime de computación gráfica de Intel® para oneAPI Level Zero y controlador OpenCL™
★ 1434+2Variación de estrellas de los últimos 7 días - #138★ 1426+2Variación de estrellas de los últimos 7 días
- #139
🌊 Software en Julia para dinámica de fluidos rápida, amigable y flexible en CPUs y GPUs
★ 1412+0Variación de estrellas de los últimos 7 días - #140
Controladores Mesa3D precompilados para Windows
★ 1410+3Variación de estrellas de los últimos 7 días - #141
Calcula tokens/s y los requisitos de memoria GPU para cualquier LLM. Soporta cuantización llama.cpp/ggml/bnb/QLoRA.
★ 1406+0Variación de estrellas de los últimos 7 días - #142★ 1367+2Variación de estrellas de los últimos 7 días
- #143
Una biblioteca rápida de superposición de comunicación para paralelismo de tensores/expertos en GPUs.
★ 1358+3Variación de estrellas de los últimos 7 días - #144
Extensión para Scikit-learn que ofrece una forma sencilla de acelerar tus aplicaciones de Scikit-learn
★ 1356+0Variación de estrellas de los últimos 7 días - #145★ 1319+0Variación de estrellas de los últimos 7 días
- #146
🔥 Un agente de IA autónomo que ejecuta tus experimentos de aprendizaje profundo las 24 horas del día, los 7 días de la semana, mientras duermes. Monitoreo de costo cero, arquitectura líder-trabajador y memoria de tamaño constante.
★ 1288+3Variación de estrellas de los últimos 7 días - #147★ 1270+0Variación de estrellas de los últimos 7 días
- #148
GraphVite: un sistema de representación de grafos (graph embedding) general y de alto rendimiento
★ 1269+0Variación de estrellas de los últimos 7 días - #149
Ejemplos de programas construidos con Modal
★ 1264+2Variación de estrellas de los últimos 7 días - #150
KernelBench: ¿Pueden los LLMs escribir kernels de GPU? - Benchmark + Kit de herramientas con Torch -> CUDA (+ más DSLs)
★ 1227+7Variación de estrellas de los últimos 7 días