Propietario · noonghunna
noonghunna
Repositorios de código abierto monitorizados de noonghunna, ordenados por estrellas.
1 repositorio
- #1
Recetas de la comunidad para servir LLMs en GPUs CUDA RTX 3090/4090/5090. Multimotor (vLLM, llama.cpp, ik_llama) y agnóstico respecto al modelo. Actualmente incluye configuraciones de Qwen3.6-27B, Qwen3.6 35B, Gemma 4 26B y Gemma 4 31B para 1 y 2 tarjetas.
★ 2224+58Variación de estrellas de los últimos 7 días