noonghunna/club-3090
@noonghunnaRecetas de la comunidad para servir LLMs en GPUs CUDA RTX 3090/4090/5090. Multimotor (vLLM, llama.cpp, ik_llama) y agnóstico respecto al modelo. Actualmente incluye configuraciones de Qwen3.6-27B, Qwen3.6 35B, Gemma 4 26B y Gemma 4 31B para 1 y 2 tarjetas.
Estrellas
2166
Bifurcaciones
134
Lenguaje
Python
Licencia
Apache-2.0
Último push
hace 1 semana
Intel relacionado (0)
Aún no hay intel relacionado
Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.