Lompat ke konten utama
buildradar
Masuk

jishengpeng/WavTokenizer

@jishengpeng

[ICLR 2025] Model codec akustik diskret SOTA dengan 40/75 token per detik untuk pemodelan bahasa audio

Bintang
1.319
Fork
116
Bahasa
Python
Lisensi
MIT
Push terakhir
2 tahun yang lalu
Pythontext-to-speechgpt4osemanticcodecdacacousticspeech-representationaudio-representationencodecmusic-representation-learningsoundstreamspeech-language-model

Belum ada intel terkait

Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.