मुख्य सामग्री पर जाएँ
buildradar
साइन इन करें

jishengpeng/WavTokenizer

@jishengpeng

[ICLR 2025] ऑडियो लैंग्वेज मॉडलिंग के लिए 40/75 टोकन प्रति सेकंड के साथ SOTA डिस्क्रीट एकॉस्टिक कोडेक मॉडल

स्टार
1,319
फ़ोर्क
116
भाषा
Python
लाइसेंस
MIT
आख़िरी push
2 वर्ष पहले
Pythontext-to-speechgpt4osemanticcodecdacacousticspeech-representationaudio-representationencodecmusic-representation-learningsoundstreamspeech-language-model

अभी कोई संबंधित intel नहीं

यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।