Pular para o conteúdo principal
buildradar
Entrar
Tópico · cuda

cuda

Repositórios de código aberto acompanhados marcados com cuda, ordenados por estrelas.

216 repositórios
  • tt-metal@tenstorrent

    Biblioteca de operadores TT-NN e modelo de programação de kernel de baixo nível TT-Metalium.

    1.655+0Variação de estrelas nos últimos 7 dias
  • gpu-hot@psalias2006

    🔥 Painel de monitoramento de GPU NVIDIA em tempo real.

    1.625+0Variação de estrelas nos últimos 7 dias
  • thundersvm@Xtra-Computing

    ThunderSVM: Uma Biblioteca SVM Rápida em GPUs e CPUs

    1.622+0Variação de estrelas nos últimos 7 dias
  • mnn-llm@wangzhaode

    Projeto de implantação de LLM baseado em MNN. Este projeto foi mesclado ao MNN.

    1.617+0Variação de estrelas nos últimos 7 dias
  • InferenceX@SemiAnalysisAI

    Plataforma de pesquisa de benchmark de inferência contínua de código aberto — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 e em breve™ TPUv6e/v7/Trainium2/3

    1.613+0Variação de estrelas nos últimos 7 dias
  • 3d-ken-burns@sniklaus

    Uma implementação do efeito Ken Burns 3D a partir de uma única imagem usando PyTorch.

    1.569+0Variação de estrelas nos últimos 7 dias
  • autokernel@RightNow-AI

    Pesquisa automática para kernels de GPU. Forneça qualquer modelo PyTorch, vá dormir e acorde com kernels Triton otimizados.

    1.545+0Variação de estrelas nos últimos 7 dias
  • uccl@uccl-project

    UCCL é uma biblioteca de comunicação eficiente para GPUs, abrangendo coletivos, P2P (ex: transferência de cache KV, transferência de pesos de RL) e EP (ex: orientado por GPU)

    1.502+0Variação de estrelas nos últimos 7 dias
  • TornadoVM@beehive-lab

    Escreva em Java. Execute em GPUs. Rápido

    1.492+0Variação de estrelas nos últimos 7 dias
  • TensorRT para YOLOv8, YOLOv8-Pose, YOLOv8-Seg, YOLOv8-Cls, YOLOv7, YOLOv6, YOLOv5, YOLONAS. CUDA é tudo o que você precisa.

    1.460+0Variação de estrelas nos últimos 7 dias
  • MatX@NVIDIA

    Uma biblioteca eficiente de computação numérica em GPU C++20 com sintaxe semelhante a Python

    1.444+0Variação de estrelas nos últimos 7 dias
  • Auto-hospede o poderoso modelo de TTS Chatterbox. Este servidor oferece uma interface web amigável, endpoints de API flexíveis (incluindo compatibilidade com OpenAI), vozes predefinidas, clonagem de voz e processamento de texto em escala de audiolivros. Executa com aceleração em NVIDIA (CUDA), AMD (ROCm) e CPU.

    1.427+0Variação de estrelas nos últimos 7 dias
  • CUDA.jl@JuliaGPU

    Programação CUDA em Julia.

    1.426+0Variação de estrelas nos últimos 7 dias
  • Arraymancer@mratsim

    Uma biblioteca de tensores rápida, ergonômica e portátil em Nim com foco em aprendizado profundo para CPU, GPU e dispositivos embarcados via backends OpenMP, Cuda e OpenCL

    1.407+0Variação de estrelas nos últimos 7 dias
  • flux@bytedance

    Uma biblioteca rápida de sobreposição de comunicação para paralelismo de tensores/especialistas em GPUs.

    1.358+0Variação de estrelas nos últimos 7 dias
  • LuxCore@LuxCoreRender

    Repositório de código-fonte do LuxCore

    1.323+0Variação de estrelas nos últimos 7 dias
  • stable-fast@chengzeyi

    https://wavespeed.ai/ O melhor framework de otimização de desempenho de inferência para HuggingFace Diffusers em GPUs NVIDIA.

    1.304+0Variação de estrelas nos últimos 7 dias
  • stdgpu@stotko

    stdgpu: estruturas de dados eficientes semelhantes à STL na GPU.

    1.270+0Variação de estrelas nos últimos 7 dias
  • graphvite@DeepGraphLearning

    GraphVite: Um sistema de Graph Embedding geral e de alto desempenho

    1.269+0Variação de estrelas nos últimos 7 dias
  • ffmpeg-build-script@markus-perl

    O script de compilação do FFmpeg fornece uma maneira fácil de compilar um FFmpeg estático no OSX e Linux com codecs não livres incluídos.

    1.215+0Variação de estrelas nos últimos 7 dias
  • cudarc@chelsea0x3b

    Wrapper seguro em Rust para o toolkit CUDA

    1.214+0Variação de estrelas nos últimos 7 dias
  • oneAPI-samples@oneapi-src

    Exemplos para Intel® oneAPI Toolkits

    1.162+0Variação de estrelas nos últimos 7 dias
  • pyopencl@inducer

    Integração OpenCL para Python, com recursos adicionais.

    1.150+0Variação de estrelas nos últimos 7 dias
  • juice@fff-rs

    O motor de aprendizado de máquina do hacker

    1.131+0Variação de estrelas nos últimos 7 dias
  • neanderthal@uncomplicate

    Biblioteca de matrizes rápida para Clojure

    1.128+0Variação de estrelas nos últimos 7 dias
  • sglang-omni@sgl-project

    O SGLang-Omni capacita o atendimento de alto desempenho para modelos TTS, ASR, de fala e onidirecionais.

    1.118+56Variação de estrelas nos últimos 7 dias
  • tiny-vllm@jmaczan

    Construa seu próprio motor de inferência LLM de alto desempenho em C++ e CUDA - uma versão reduzida do vLLM.

    1.100+10Variação de estrelas nos últimos 7 dias
  • gunrock@gunrock

    Análise de grafos em GPU programável com CUDA/C++.

    1.096+0Variação de estrelas nos últimos 7 dias
  • cupoch@neka-nat

    Robótica com computação em GPU

    1.064+1Variação de estrelas nos últimos 7 dias
  • LuisaCompute@LuisaGroup

    Framework de renderização de alto desempenho em arquiteturas de streaming

    1.044+1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos