Aller au contenu principal
buildradar
Se connecter

jishengpeng/WavTokenizer

@jishengpeng

[ICLR 2025] Modèles de codec acoustique discret SOTA avec 40/75 jetons par seconde pour la modélisation linguistique audio.

Étoiles
1 317
Bifurcations
117
Langage
Python
Licence
MIT
Dernier push
il y a 2 ans
Pythontext-to-speechgpt4osemanticcodecdacacousticspeech-representationaudio-representationencodecmusic-representation-learningsoundstreamspeech-language-model

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.