Proprietário · noonghunna
noonghunna
Repositórios de código aberto acompanhados de noonghunna, ordenados por estrelas.
1 repositório
- #1
Receitas da comunidade para servir LLMs em GPUs CUDA RTX 3090/4090/5090. Multi-engine (vLLM, llama.cpp, ik_llama) e agnóstico a modelos. Atualmente inclui configurações para Qwen3.6-27B, Qwen3.6 35B, Gemma 4 26B e Gemma 4 31B para 1 e 2 placas.
★ 2.224+58Variação de estrelas nos últimos 7 dias