Pular para o conteúdo principal
buildradar
Entrar
Tópico · cuda

cuda

Repositórios de código aberto acompanhados marcados com cuda, ordenados por estrelas.

216 repositórios
  • rust-cuda@Rust-GPU

    Ecossistema de bibliotecas e ferramentas para escrever e executar código GPU rápido inteiramente em Rust.

    5.334+0Variação de estrelas nos últimos 7 dias
  • cuml@NVIDIA

    NVIDIA cuML: Aprendizado de máquina acelerado por GPU

    5.269+0Variação de estrelas nos últimos 7 dias
  • kaolin@NVIDIAGameWorks

    Uma biblioteca PyTorch para acelerar pesquisas em Deep Learning 3D

    5.163+0Variação de estrelas nos últimos 7 dias
  • nccl@NVIDIA

    Primitivas otimizadas para comunicação coletiva multi-GPU

    5.041+0Variação de estrelas nos últimos 7 dias
  • arrayfire@arrayfire

    ArrayFire: uma biblioteca de GPU de propósito geral.

    4.903+0Variação de estrelas nos últimos 7 dias
  • CTranslate2@OpenNMT

    Motor de inferência rápida para modelos Transformer.

    4.658+0Variação de estrelas nos últimos 7 dias
  • Tengine@OAID

    Tengine é um motor de inferência leve, de alto desempenho e modular para dispositivos embarcados.

    4.533+0Variação de estrelas nos últimos 7 dias
  • tiny-cuda-nn@NVlabs

    Framework de rede neural em C++/CUDA extremamente rápido

    4.530+0Variação de estrelas nos últimos 7 dias
  • hip@ROCm

    HIP: Interface de computação heterogênea em C++ para portabilidade

    4.395+0Variação de estrelas nos últimos 7 dias
  • iree@iree-org

    Um compilador de machine learning baseado em MLIR retargetable e toolkit de runtime.

    3.914+0Variação de estrelas nos últimos 7 dias
  • SageAttention@thu-ml

    [ICLR2025, ICML2025, NeurIPS2025 Spotlight] O Quantized Attention alcança uma aceleração de 2 a 5 vezes em comparação ao FlashAttention, sem perda de métricas de ponta a ponta em modelos de linguagem, imagem e vídeo.

    3.699+0Variação de estrelas nos últimos 7 dias
  • Treine, inspecione, edite, automatize e exporte cenas de 3D Gaussian Splatting a partir de uma única aplicação nativa.

    3.645+0Variação de estrelas nos últimos 7 dias
  • Uma biblioteca para acelerar modelos Transformer em GPUs NVIDIA, incluindo o uso de precisão de ponto flutuante de 8 bits e 4 bits (FP8 e FP4) em GPUs Hopper, Ada e Blackwell, proporcionando melhor desempenho com menor uso de memória tanto no treinamento quanto na inferência.

    3.518+0Variação de estrelas nos últimos 7 dias
  • viseron@roflcoopter

    Software de NVR e Visão Computacional por IA auto-hospedado e local. Com recursos como detecção de objetos, detecção de movimento, reconhecimento facial e mais, ele oferece o poder de monitorar sua casa, escritório ou qualquer outro lugar que desejar.

    3.468+0Variação de estrelas nos últimos 7 dias
  • lygia@patriciogonzalezvivo

    LYGIA, uma biblioteca de shaders granular e multilíngue (GLSL, HLSL, Metal, WGSL, WEGL e CUDA) projetada para desempenho e flexibilidade.

    3.423+0Variação de estrelas nos últimos 7 dias
  • Remotery@Celtoys

    Arquivo C único, Profiler de CPU/GPU em tempo real com visualizador web remoto

    3.312+0Variação de estrelas nos últimos 7 dias
  • Como otimizar algoritmos em CUDA.

    3.242+0Variação de estrelas nos últimos 7 dias
  • jittor@Jittor

    Jittor é um framework de deep learning de alto desempenho baseado em compilação JIT e meta-operadores.

    3.232+0Variação de estrelas nos últimos 7 dias
  • lc0@LeelaChessZero

    Motor de xadrez de rede neural de código aberto com aceleração de GPU e amplo suporte de hardware.

    3.197+0Variação de estrelas nos últimos 7 dias
  • skills@NVIDIA

    Habilidades de agente para produtos NVIDIA — instale no Claude Code, Codex e outros agentes de codificação para executar fluxos de trabalho de IA Física, robótica, simulação, CUDA e RAG de ponta a ponta.

    3.180+0Variação de estrelas nos últimos 7 dias
  • cuda-oxide@NVlabs

    cuda-oxide é um compilador experimental de Rust para CUDA que permite escrever kernels de GPU (SIMT) em Rust idiomático e seguro. Ele compila código Rust padrão diretamente para PTX — sem DSLs ou bindings de linguagens estrangeiras, apenas Rust.

    3.118+0Variação de estrelas nos últimos 7 dias
  • aresdb@uber

    Um mecanismo de consulta e armazenamento de análise em tempo real alimentado por GPU.

    3.076+0Variação de estrelas nos últimos 7 dias
  • heavydb@heavyai

    HeavyDB (anteriormente MapD/OmniSciDB)

    3.059+0Variação de estrelas nos últimos 7 dias
  • ramalama@containers

    RamaLama é uma ferramenta de código aberto para desenvolvedores que simplifica a hospedagem local de modelos de IA de qualquer fonte e facilita seu uso para inferência em produção, tudo através da linguagem familiar de containers.

    3.031+0Variação de estrelas nos últimos 7 dias
  • TensorRT@pytorch

    Compilador PyTorch/TorchScript/FX para GPUs NVIDIA usando TensorRT

    2.989+0Variação de estrelas nos últimos 7 dias
  • ao@pytorch

    Quantização nativa em PyTorch para treinamento e inferência.

    2.961+0Variação de estrelas nos últimos 7 dias
  • MinkowskiEngine@NVIDIA

    Minkowski Engine é uma biblioteca de rede neural com diferenciação automática para tensores esparsos de alta dimensão

    2.957+0Variação de estrelas nos últimos 7 dias
  • O NVIDIA GPU Operator cria, configura e gerencia GPUs no Kubernetes

    2.857+0Variação de estrelas nos últimos 7 dias
  • lucebox@Luce-Org

    Servidor de inferência especulativa de LLM para hardware de consumo e heterogêneo

    2.829+0Variação de estrelas nos últimos 7 dias
  • futhark@diku-dk

    Uma linguagem de programação funcional com paralelismo de dados

    2.794+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos