Saltar al contenido principal
buildradar
Iniciar sesión

jishengpeng/WavTokenizer

@jishengpeng

[ICLR 2025] Modelos de códec acústico discreto SOTA con 40/75 tokens por segundo para modelado de lenguaje de audio

Estrellas
1319
Bifurcaciones
116
Lenguaje
Python
Licencia
MIT
Último push
hace 2 años
Pythontext-to-speechgpt4osemanticcodecdacacousticspeech-representationaudio-representationencodecmusic-representation-learningsoundstreamspeech-language-model

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.