Pular para o conteúdo principal
buildradar
Entrar

jishengpeng/WavTokenizer

@jishengpeng

[ICLR 2025] Modelos de codec acústico discreto SOTA com 40/75 tokens por segundo para modelagem de linguagem de áudio.

Estrelas
1.319
Bifurcações
116
Linguagem
Python
Licença
MIT
Último push
há 2 anos
Pythontext-to-speechgpt4osemanticcodecdacacousticspeech-representationaudio-representationencodecmusic-representation-learningsoundstreamspeech-language-model

Ainda não há intel relacionado

Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.