Zum Hauptinhalt springen
buildradar
Anmelden

jishengpeng/WavTokenizer

@jishengpeng

[ICLR 2025] SOTA diskrete Audio-Codec-Modelle mit 40/75 Tokens pro Sekunde für Audio-Sprachmodellierung

Sterne
1.317
Forks
117
Sprache
Python
Lizenz
MIT
Letzter Push
vor 2 Jahren
Pythontext-to-speechgpt4osemanticcodecdacacousticspeech-representationaudio-representationencodecmusic-representation-learningsoundstreamspeech-language-model

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.