Pular para o conteúdo principal
buildradar
Entrar

noonghunna/club-3090

@noonghunna

Receitas da comunidade para servir LLMs em GPUs CUDA RTX 3090/4090/5090. Multi-engine (vLLM, llama.cpp, ik_llama) e agnóstico a modelos. Atualmente inclui configurações para Qwen3.6-27B, Qwen3.6 35B, Gemma 4 26B e Gemma 4 31B para 1 e 2 placas.

Estrelas
2.166
Bifurcações
134
Linguagem
Python
Licença
Apache-2.0
Último push
há 1 semana
Python

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.