Pular para o conteúdo principal
buildradar
Entrar
Tópico · cuda

cuda

Repositórios de código aberto acompanhados marcados com cuda, ordenados por estrelas.

216 repositórios
  • Melhores práticas e guias sobre como escrever código de treinamento distribuído em PyTorch

    631+2Variação de estrelas nos últimos 7 dias
  • ginkgo@ginkgo-project

    Pacote de software de álgebra linear numérica

    622+2Variação de estrelas nos últimos 7 dias
  • LuisaRender@LuisaGroup

    Renderizador de Monte Carlo multiplataforma de alto desempenho baseado em LuisaCompute

    618+1Variação de estrelas nos últimos 7 dias
  • FastFold@hpcaitech

    Otimizando o treinamento e inferência do AlphaFold em clusters de GPU

    616+0Variação de estrelas nos últimos 7 dias
  • AutoDock-GPU@ccsb-scripps

    AutoDock para GPUs e outros aceleradores

    610+1Variação de estrelas nos últimos 7 dias
  • attorch@BobMcDear

    Um subconjunto de módulos de redes neurais do PyTorch, escrito em Python usando o Triton da OpenAI.

    604+0Variação de estrelas nos últimos 7 dias
  • personal-os-setup@AmineDjeghri

    Um aplicativo e guia para configurar facilmente Windows, Linux, MacOS, Google TV, Stremio, Home Assistant e mais (incluindo WSL2, drivers de GPU e ferramentas de desenvolvimento). Melhore sua UX e produtividade.

    602+0Variação de estrelas nos últimos 7 dias
  • yzma@hybridgroup

    Vá com sua própria inteligência - Aplicativos Go que integram diretamente o llama.cpp para inferência local usando aceleração de hardware.

    599+17Variação de estrelas nos últimos 7 dias
  • yalm@andrewkchan

    Yet Another Language Model: inferência de LLM em C++/CUDA, sem bibliotecas além de I/O.

    597+1Variação de estrelas nos últimos 7 dias
  • pymde@cvxgrp

    Incorporação com distorção mínima usando PyTorch

    594+1Variação de estrelas nos últimos 7 dias
  • dace@spcl

    DaCe - Programação Paralela Centrada em Dados

    592+0Variação de estrelas nos últimos 7 dias
  • nvshmem@NVIDIA

    O NVIDIA NVSHMEM é uma interface de programação paralela para GPUs NVIDIA baseada em OpenSHMEM. O NVSHMEM pode reduzir significativamente a comunicação entre múltiplos processos e os custos de coordenação, permitindo que os programadores realizem comunicação unilateral a partir de kernels CUDA e em streams CUDA.

    585+4Variação de estrelas nos últimos 7 dias
  • radarsimpy@radarsimx

    Simulador de radar construído com Python e C++

    576+3Variação de estrelas nos últimos 7 dias
  • KuiperLLama@zjhellofss

    Projeto para recrutamento e estágios, guiando você na implementação do zero de um framework de inferência de LLM com suporte a Llama2/3 e Qwen2.5.

    574+0Variação de estrelas nos últimos 7 dias
  • jitify@NVIDIA

    Uma biblioteca C++ de cabeçalho único para simplificar o uso do CUDA Runtime Compilation (NVRTC).

    574+0Variação de estrelas nos últimos 7 dias
  • llm_training_handbook@huggingface

    Uma coleção aberta de metodologias para auxiliar no treinamento bem-sucedido de grandes modelos de linguagem.

    569+2Variação de estrelas nos últimos 7 dias
  • cuda_hgemm@Bruce-Lee-LY

    Vários métodos de otimização de multiplicação de matrizes gerais de meia precisão (HGEMM) usando tensor core com a API WMMA e a instrução MMA PTX.

    568+0Variação de estrelas nos últimos 7 dias
  • tessera@zengxiao-he

    From teacher to tiles — a from-scratch LLM distillation & serving engine: custom Triton/CUDA kernels, FSDP distillation, paged-KV continuous batching, speculative decoding, a Rust gateway, a JAX oracle, and interpretability tooling.

    566+0Variação de estrelas nos últimos 7 dias
  • FlashRT@flashrt-project

    FlashRT é um motor de inferência em tempo real de alto desempenho para cargas de trabalho de IA de lote pequeno e sensíveis à latência. A integração principal é o controle VLA de produção para Pi0, Pi0.5, GROOT N1.6 e Pi0-FAST. Também suporta LLM, por exemplo, qwen3.6-27B

    562+14Variação de estrelas nos últimos 7 dias
  • qwen600@yassa9

    Mini motor de inferência estático e suckless para qwen3-0.6B, lote único (single batch) e exclusivo para CUDA.

    560+1Variação de estrelas nos últimos 7 dias
  • llm-algo-leetcode@datawhalechina

    Laboratório de prática de algoritmos de LLM com teoria, soluções e casos de teste. Um tutorial prático de algoritmos para grandes modelos voltado do iniciante ao avançado, cobrindo explicações de princípios, resoluções, casos de teste e prática com CUDA/Triton.

    559+20Variação de estrelas nos últimos 7 dias
  • nbd-vram@c0deJedi

    Use a VRAM da sua GPU NVIDIA como espaço de swap no Linux. Desenvolvido para notebooks com memória soldada e sem opção de upgrade. Se você tem uma placa RTX com 8 GB de VRAM ociosa e seu sistema está fazendo swap no SSD, isso coloca essa VRAM para funcionar.

    555+4Variação de estrelas nos últimos 7 dias
  • relion@3dem

    Software de processamento de imagens para criomicroscopia eletrônica

    552+2Variação de estrelas nos últimos 7 dias
  • slurm-docker-cluster@giovtorres

    Um cluster Slurm usando docker-compose

    544+2Variação de estrelas nos últimos 7 dias
  • cu@gorgonia

    O pacote cu fornece uma interface idiomática para a API do driver CUDA.

    532+0Variação de estrelas nos últimos 7 dias
  • pytorch-hed@sniklaus

    Uma reimplementação de Holistically-Nested Edge Detection em PyTorch.

    525+0Variação de estrelas nos últimos 7 dias
  • plotoptix@rnd-team-dev

    Data visualisation and ray tracing in Python based on OptiX 9.1 framework.

    518+0Variação de estrelas nos últimos 7 dias
  • INSTA@Zielon

    INSTA - Avatares de Cabeça Volumétricos Instantâneos [CVPR2023]

    518-1Variação de estrelas nos últimos 7 dias
  • Imagem Docker para Ubuntu Desktop com suporte a aplicativos GUI acelerados por GPU de hardware. Você pode acessar o Container com ssh ou área de trabalho remota, exatamente como uma VM em Nuvem.

    515+0Variação de estrelas nos últimos 7 dias
  • Servidor de inferência de linguagem de código aberto, local e auto-hospedado altamente otimizado com suporte a ASR/STT, TTS e LLM via WebRTC, REST e WS

    512+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos