मुख्य सामग्री पर जाएँ
buildradar
साइन इन करें

noonghunna/club-3090

@noonghunna

RTX 3090/4090/5090 CUDA GPU पर LLM सर्व करने के लिए कम्युनिटी रेसिपी। मल्टी-इंजन (vLLM, llama.cpp, ik_llama) और मॉडल-अज्ञेय। वर्तमान में 1× और 2× कार्ड के लिए Qwen3.6-27B Qwen3.6 35B Gemma 4 26B Gemma 4 31B कॉन्फ़िगरेशन प्रदान कर रहा है।

स्टार
2,224
फ़ोर्क
140
भाषा
Python
लाइसेंस
Apache-2.0
आख़िरी push
9 घंटे पहले
Python

अभी कोई संबंधित intel नहीं

यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।