मुख्य सामग्री पर जाएँ
buildradar
Sign in

FasterDecoding/Medusa

@FasterDecoding

Medusa: एकाधिक डिकोडिंग हेड के साथ LLM जनरेशन को तेज करने के लिए सरल फ्रेमवर्क

स्टार
2,771
फ़ोर्क
205
भाषा
Jupyter Notebook
लाइसेंस
Apache-2.0
आख़िरी push
2 वर्ष पहले
Jupyter Notebookllmllm-inference

अभी कोई संबंधित intel नहीं

यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।