跳到主要内容
buildradar
登录

jishengpeng/WavTokenizer

@jishengpeng

[ICLR 2025] 针对音频语言建模、每秒 40/75 个 token 的 SOTA 离散声学编解码器模型

星数
1,319
Fork 数
116
语言
Python
许可
MIT
最后推送
2年前
Pythontext-to-speechgpt4osemanticcodecdacacousticspeech-representationaudio-representationencodecmusic-representation-learningsoundstreamspeech-language-model

还没有相关情报

radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。