मुख्य सामग्री पर जाएँ
buildradar
साइन इन करें

syv-ai/qwen38-27b-rtx3090

@syv-ai

vLLM के साथ सिंगल RTX 3090 पर Qwen3.8-27B: 64 समवर्ती पर ~1,000 tok/s (int8 tensor-core GEMMs, fp16 DeltaNet state), डिफ़ॉल्ट सैंपलिंग पर ~114 tok/s सिंगल-यूज़र / ~124 ग्रीडी (MTP ड्राफ्ट, own-output draft vocab, कैलिब्रेटेड int4 lm_head, split-KV verify attention), 150k-262k संदर्भ; पैच, रीक्वांट स्क्रिप्ट, बेंचमार्क

स्टार
1,299
फ़ोर्क
181
भाषा
Python
लाइसेंस
Apache-2.0
आख़िरी push
12 घंटे पहले
Pythonllm-inferencevllmlocal-llmqwenquantizationkv-cachespeculative-decodingqwen3rtx-3090

अभी कोई संबंधित intel नहीं

यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।