Wenyueh/MinivLLM
@WenyuehNano-vLLM पर आधारित, vLLM का एक सरल रेप्लिकेशन जिसमें सेल्फ-कंटेन्ड paged attention और flash attention इम्प्लीमेंटेशन शामिल है
स्टार
1,020
फ़ोर्क
172
भाषा
Python
लाइसेंस
Apache-2.0
आख़िरी push
2 सप्ताह पहले
संबंधित intel (0)
अभी कोई संबंधित intel नहीं
यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।