noonghunna/club-3090
@noonghunnaRTX 3090/4090/5090 CUDA GPU पर LLM सर्व करने के लिए कम्युनिटी रेसिपी। मल्टी-इंजन (vLLM, llama.cpp, ik_llama) और मॉडल-अज्ञेय। वर्तमान में 1× और 2× कार्ड के लिए Qwen3.6-27B Qwen3.6 35B Gemma 4 26B Gemma 4 31B कॉन्फ़िगरेशन प्रदान कर रहा है।
स्टार
2,224
फ़ोर्क
140
भाषा
Python
लाइसेंस
Apache-2.0
आख़िरी push
9 घंटे पहले
संबंधित intel (0)
अभी कोई संबंधित intel नहीं
यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।