cuda
Repositorios de código abierto monitorizados etiquetados con cuda, ordenados por estrellas.
- #31
Ecosistema de bibliotecas y herramientas para escribir y ejecutar código GPU rápido completamente en Rust.
★ 5334+0Variación de estrellas de los últimos 7 días - #32★ 5269+0Variación de estrellas de los últimos 7 días
- #33
Una librería de PyTorch para acelerar la investigación en aprendizaje profundo 3D.
★ 5163+0Variación de estrellas de los últimos 7 días - #34★ 5041+0Variación de estrellas de los últimos 7 días
- #35★ 4903+0Variación de estrellas de los últimos 7 días
- #36
Motor de inferencia rápido para modelos Transformer
★ 4658+0Variación de estrellas de los últimos 7 días - #37
Tengine es un motor de inferencia ligero, modular y de alto rendimiento para dispositivos integrados
★ 4533+0Variación de estrellas de los últimos 7 días - #38
Framework de redes neuronales en C++/CUDA ultrarrápido
★ 4530+0Variación de estrellas de los últimos 7 días - #39★ 4395+0Variación de estrellas de los últimos 7 días
- #40
Un compilador de machine learning reorientable basado en MLIR y kit de herramientas de tiempo de ejecución.
★ 3914+0Variación de estrellas de los últimos 7 días - #41
[ICLR2025, ICML2025, NeurIPS2025 Spotlight] Quantized Attention logra una aceleración de 2 a 5 veces en comparación con FlashAttention, sin perder métricas de extremo a extremo en modelos de lenguaje, imagen y video.
★ 3699+0Variación de estrellas de los últimos 7 días - #42
Entrena, inspecciona, edita, automatiza y exporta escenas de 3D Gaussian Splatting desde una sola aplicación nativa.
★ 3645+0Variación de estrellas de los últimos 7 días - #43
Una biblioteca para acelerar modelos Transformer en GPUs de NVIDIA, incluyendo el uso de precisión de punto flotante de 8 y 4 bits (FP8 y FP4) en GPUs Hopper, Ada y Blackwell, para ofrecer un mejor rendimiento con menor uso de memoria tanto en entrenamiento como en inferencia.
★ 3518+0Variación de estrellas de los últimos 7 días - #44
Software de NVR y visión artificial por IA autoalojado y exclusivamente local. Con funciones como detección de objetos, detección de movimiento, reconocimiento facial y más, te brinda el poder de vigilar tu hogar, oficina o cualquier otro lugar que desees monitorear.
★ 3468+0Variación de estrellas de los últimos 7 días - #45
LYGIA, una librería de shaders granular y multi-lenguaje (GLSL, HLSL, Metal, WGSL, WEGL y CUDA) diseñada para ofrecer rendimiento y flexibilidad
★ 3423+0Variación de estrellas de los últimos 7 días - #46★ 3312+0Variación de estrellas de los últimos 7 días
- #47
Cómo optimizar algunos algoritmos en CUDA.
★ 3242+0Variación de estrellas de los últimos 7 días - #48
Jittor es un marco de aprendizaje profundo de alto rendimiento basado en compilación JIT y metaoperadores.
★ 3232+0Variación de estrellas de los últimos 7 días - #49
Motor de ajedrez basado en redes neuronales de código abierto con aceleración por GPU y amplio soporte de hardware.
★ 3197+0Variación de estrellas de los últimos 7 días - #50
Habilidades de agentes para productos de NVIDIA: instálalas en Claude Code, Codex y otros agentes de codificación para ejecutar flujos de trabajo de IA física, robótica, simulación, CUDA y RAG de extremo a extremo.
★ 3180+0Variación de estrellas de los últimos 7 días - #51
cuda-oxide es un compilador experimental de Rust a CUDA que te permite escribir kernels de GPU (SIMT) en un Rust seguro (o casi) e idiomático. Compila código Rust estándar directamente a PTX: sin DSL, sin enlaces a lenguajes externos, solo Rust.
★ 3118+0Variación de estrellas de los últimos 7 días - #52★ 3076+0Variación de estrellas de los últimos 7 días
- #53★ 3059+0Variación de estrellas de los últimos 7 días
- #54
RamaLama es una herramienta de desarrollo de código abierto que simplifica el alojamiento local de modelos de IA desde cualquier fuente y facilita su uso para inferencia en producción, todo mediante el lenguaje familiar de los contenedores.
★ 3031+0Variación de estrellas de los últimos 7 días - #55★ 2989+0Variación de estrellas de los últimos 7 días
- #56★ 2961+0Variación de estrellas de los últimos 7 días
- #57
Minkowski Engine es una biblioteca de redes neuronales de diferenciación automática para tensores dispersos de alta dimensión
★ 2957+0Variación de estrellas de los últimos 7 días - #58
NVIDIA GPU Operator crea, configura y gestiona GPUs en Kubernetes
★ 2857+0Variación de estrellas de los últimos 7 días - #59★ 2829+0Variación de estrellas de los últimos 7 días
- #60
:boom::computer::boom: Un lenguaje de programación funcional y paralelo a nivel de datos
★ 2794+0Variación de estrellas de los últimos 7 días