Pular para o conteúdo principal
buildradar
Sign in
Tópico · cuda-kernels

cuda-kernels

Repositórios de código aberto acompanhados marcados com cuda-kernels, ordenados por estrelas.

Repositórios
13
Total de estrelas
47.369
Média de estrelas
3.644
Participação
0,00%

Tópicos que aparecem com frequência ao lado de cuda-kernels no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com cuda-kernels.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • LeetCUDA@xlite-dev

    Notas de estudo modernas de CUDA com PyTorch para iniciantes, mais de 200 kernels CUDA, Tensor Cores, HGEMM, FA-2 MMA.

    11.875+25Variação de estrelas nos últimos 7 dias
  • cuda-samples@NVIDIA

    Exemplos para desenvolvedores CUDA que demonstram recursos do CUDA Toolkit

    9.585+19Variação de estrelas nos últimos 7 dias
  • lmdeploy@InternLM

    LMDeploy é um toolkit para compressão, implantação e serviço de LLMs.

    8.041+8Variação de estrelas nos últimos 7 dias
  • rust-cuda@Rust-GPU

    Ecossistema de bibliotecas e ferramentas para escrever e executar código GPU rápido inteiramente em Rust.

    5.334+3Variação de estrelas nos últimos 7 dias
  • lucebox@Luce-Org

    Servidor de inferência especulativa de LLM para hardware de consumo e heterogêneo

    2.829+16Variação de estrelas nos últimos 7 dias
  • cccl@NVIDIA

    Bibliotecas de Computação do Núcleo CUDA

    2.500+8Variação de estrelas nos últimos 7 dias
  • dfdx@chelsea0x3b

    Deep learning em Rust, com tensores verificados por forma e redes neurais

    1.933+0Variação de estrelas nos últimos 7 dias
  • cudarc@chelsea0x3b

    Wrapper seguro em Rust para o toolkit CUDA

    1.214-1Variação de estrelas nos últimos 7 dias
  • framework@mni-ml

    Biblioteca de aprendizado de máquina com API em TypeScript e back-end em Rust. Compatível com CUDA e WebGPU. Criada para entender o funcionamento interno de frameworks e modelos de ML.

    1.005+8Variação de estrelas nos últimos 7 dias
  • cudnn-frontend@NVIDIA

    O frontend do cuDNN é o ponto de entrada moderno e de código aberto da NVIDIA para a biblioteca cuDNN e uma coleção crescente de kernels de código aberto de alto desempenho.

    931+11Variação de estrelas nos últimos 7 dias
  • nvbench@NVIDIA

    Biblioteca de benchmarking de Kernel CUDA.

    925+1Variação de estrelas nos últimos 7 dias
  • pegainfer@pegainfer-project

    Mecanismo de inferência de LLM em Pure Rust + CUDA — sem PyTorch, compatível com OpenAI, serve de Qwen3 a Kimi-K2

    677+14Variação de estrelas nos últimos 7 dias
  • FlashRT@flashrt-project

    FlashRT é um motor de inferência em tempo real de alto desempenho para cargas de trabalho de IA de lote pequeno e sensíveis à latência. A integração principal é o controle VLA de produção para Pi0, Pi0.5, GROOT N1.6 e Pi0-FAST. Também suporta LLM, por exemplo, qwen3.6-27B

    550+11Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos